music-generation

Генерировать фоновую музыку в стиле ambient с помощью Lyria через Interactions API.

npx skills add https://github.com/google-gemini/gemini-managed-agents-templates --skill music-generation

Music Generation

Generate background music for the radio show using the Lyria model via the Interactions API.

Embedded Script

python3 skills/music-generation/scripts/generate_music.py --workspace ./workspace --mood tech

Arguments

ArgumentDefaultDescription
--workspaceworkspaceRoot workspace directory
--mooddefaultMusic mood (see moods below)

Moods

MoodStylePair with --style
tech (default)Clean synths, electronic pulse, Silicon Valley startup vibeexplainer, debate
chillSoft pads, gentle piano, lo-fi warmthroundtable, explainer
debateBuilding tension, brass-like synths, panel discussion openerdebate, interview

What it does

  1. Selects the music prompt based on --mood.
  2. Calls the Interactions API with the lyria-3-clip-preview model.
  3. Generates a ~30-second music clip.
  4. Saves as MP3 to {workspace}/audio/music/background.mp3.
  5. Gracefully handles failures — the pipeline continues without music.

Dependencies

  • google-genai (>= 2.0.0)

Output

  • File: {workspace}/audio/music/background.mp3
  • Format: MP3
  • Duration: ~30 seconds

Fallback

Lyria is experimental. If generation fails with a policy error or returns no music, the script will attempt to retry once with a simpler fallback prompt: "Create a 30-second simple ambient background track. Instrumental only, calm and neutral."

If the fallback attempt also fails, the pipeline proceeds without background music — the audio-mixing step handles this gracefully.

Больше skills от google-gemini

agent-tui
google-gemini
Main Agents: Do NOT use this skill directly. If you need to test the TUI, invoke the `tui_tester` subagent. Drive terminal UI (TUI) applications…
gemini-api-cli
google-gemini
Руководство по использованию инструмента командной строки Gemini API. Используйте, когда вам нужно взаимодействовать с Gemini API через командную строку, управлять агентами или генерировать медиа (изображения,…
behavioral-evals
google-gemini
Руководство по созданию, запуску, исправлению и продвижению поведенческих оценок. Используется при проверке логики принятия решений агентом, отладке сбоев, отладке подсказок…
gemini-live-api-dev
google-gemini
Реализация двусторонней потоковой передачи в реальном времени с Gemini через WebSockets для аудио-, видео- и текстовых диалогов. Поддерживает ввод/вывод аудио (16 кГц PCM), видеокадры, текст и автоматические транскрипции с обнаружением голосовой активности для обработки прерываний. Включает встроенные аудиофункции: аффективный диалог, упреждающее аудио и режим размышления; вызов функций для синхронного и асинхронного использования инструментов; а также привязку к Google Search. Предлагает управление сессиями с сжатием контекста, возобновлением и...
gemini-omni-flash-api
google-gemini
Используйте этот навык для генеративного видеомонтажа, преобразования текста в видео, генерации видео по изображению-референсу и анимации переходов от первого кадра к видео с помощью…
gemini-api-dev
google-gemini
Создавайте приложения с моделями Google Gemini, поддерживающими мультимодальный контент, вызов функций и структурированные выходные данные на Python, JavaScript, Go и Java. Доступ к текущим моделям Gemini 3 (Pro, Flash, Pro Image) с контекстом в 1 миллион токенов; устаревшие модели Gemini 2.x и 1.5 больше не поддерживаются. Поддерживается генерация текста, понимание изображений, аудио и видео, вызов функций, структурированный вывод JSON, выполнение кода, кэширование контекста и эмбеддинги. Официальные SDK: google-genai (Python),...
gemini-interactions-api
google-gemini
Унифицированный интерфейс для моделей и агентов Gemini с состоянием на стороне сервера, потоковой передачей и оркестрацией инструментов. Поддерживает несколько актуальных моделей (gemini-3-flash-preview, gemini-3-pro-preview, gemini-2.5-flash/pro) и агента Deep Research; автоматически заменяет устаревшие идентификаторы моделей на актуальные альтернативы. Выгружает историю диалога на сервер через previous_interaction_id для многошаговых взаимодействий с сохранением состояния без ручного управления историей. Встроенная оркестрация инструментов, включая...
deliver
google-gemini
Публикует сжатую версию брифинга во входящий вебхук Google Chat или Slack, так что ежедневный запуск доставляет себя сам — молча пропускается, когда вебхук не…