music-generation

Generieren Sie ambient Hintergrundmusik mit Lyria über die Interactions API.

npx skills add https://github.com/google-gemini/gemini-managed-agents-templates --skill music-generation

Music Generation

Generate background music for the radio show using the Lyria model via the Interactions API.

Embedded Script

python3 skills/music-generation/scripts/generate_music.py --workspace ./workspace --mood tech

Arguments

ArgumentDefaultDescription
--workspaceworkspaceRoot workspace directory
--mooddefaultMusic mood (see moods below)

Moods

MoodStylePair with --style
tech (default)Clean synths, electronic pulse, Silicon Valley startup vibeexplainer, debate
chillSoft pads, gentle piano, lo-fi warmthroundtable, explainer
debateBuilding tension, brass-like synths, panel discussion openerdebate, interview

What it does

  1. Selects the music prompt based on --mood.
  2. Calls the Interactions API with the lyria-3-clip-preview model.
  3. Generates a ~30-second music clip.
  4. Saves as MP3 to {workspace}/audio/music/background.mp3.
  5. Gracefully handles failures — the pipeline continues without music.

Dependencies

  • google-genai (>= 2.0.0)

Output

  • File: {workspace}/audio/music/background.mp3
  • Format: MP3
  • Duration: ~30 seconds

Fallback

Lyria is experimental. If generation fails with a policy error or returns no music, the script will attempt to retry once with a simpler fallback prompt: "Create a 30-second simple ambient background track. Instrumental only, calm and neutral."

If the fallback attempt also fails, the pipeline proceeds without background music — the audio-mixing step handles this gracefully.

Mehr Skills von google-gemini

agent-tui
google-gemini
Main Agents: Do NOT use this skill directly. If you need to test the TUI, invoke the `tui_tester` subagent. Drive terminal UI (TUI) applications…
gemini-api-cli
google-gemini
Anleitung zur Verwendung des Gemini API CLI-Tools. Verwenden Sie es, wenn Sie über die Befehlszeile mit der Gemini API interagieren, Agents verwalten oder Medien (Bilder, …) erstellen müssen.
behavioral-evals
google-gemini
Anleitung zum Erstellen, Ausführen, Beheben und Fördern von Verhaltensevaluierungen. Verwenden Sie dies zur Überprüfung der Entscheidungslogik von Agenten, zum Debuggen von Fehlern, zum Debuggen von Prompts…
gemini-live-api-dev
google-gemini
Echtzeit-bidirektionales Streaming mit Gemini über WebSockets für Audio-, Video- und Textgespräche. Unterstützt Audio-Eingabe/-Ausgabe (16 kHz PCM), Videobilder, Text und automatische Transkriptionen mit Spracherkennung zur Unterbrechungsverwaltung. Enthält native Audiofunktionen: affektiven Dialog, proaktives Audio und Denkmodus; Funktionsaufrufe für synchrone und asynchrone Werkzeugnutzung; sowie Google Search Grounding. Bietet Sitzungsverwaltung mit Kontextkomprimierung, Wiederaufnahme und...
gemini-omni-flash-api
google-gemini
Nutzen Sie diese Fähigkeit für generative Videobearbeitung, Text-zu-Video, bildreferenzierte Videogenerierung und Übergangsanimationen vom ersten Bild zum Video unter Verwendung der…
gemini-api-dev
google-gemini
Erstellen Sie Anwendungen mit Googles Gemini-Modellen, die multimodale Inhalte, Funktionsaufrufe und strukturierte Ausgaben in Python, JavaScript, Go und Java unterstützen. Greifen Sie auf aktuelle Gemini 3 Modelle (Pro, Flash, Pro Image) mit 1M Token-Kontext zu; ältere Gemini 2.x und 1.5 Modelle sind veraltet. Unterstützt Textgenerierung, Bild-/Audio-/Video-Verständnis, Funktionsaufrufe, strukturierte JSON-Ausgabe, Codeausführung, Kontext-Caching und Embeddings. Offizielle SDKs verfügbar: google-genai (Python),...
gemini-interactions-api
google-gemini
Einheitliche Schnittstelle für Gemini-Modelle und Agents mit serverseitigem Zustand, Streaming und Tool-Orchestrierung. Unterstützt mehrere aktuelle Modelle (gemini-3-flash-preview, gemini-3-pro-preview, gemini-2.5-flash/pro) und den Deep Research Agent; ersetzt automatisch veraltete Modell-IDs durch aktuelle Alternativen. Auslagern des Gesprächsverlaufs an den Server über previous_interaction_id für zustandsbehaftete Multi-Turn-Interaktionen ohne manuelle Verlaufverwaltung. Integrierte Tool-Orchestrierung inklusive...
deliver
google-gemini
Veröffentlicht eine gekürzte Version des Briefings an einen Google Chat- oder Slack-Incoming-Webhook, sodass sich der tägliche Lauf selbst zustellt – und überspringt still, wenn kein Webhook …