cover-image-generation

Генерировать обложки для радиошоу с помощью Gemini 3 Flash Image (с запасным вариантом на Pro).

npx skills add https://github.com/google-gemini/gemini-managed-agents-templates --skill cover-image-generation

Image Generation Skill

This skill generates an appropriate cover image for the radio show based on a prompt, using the Gemini 3 Flash Image model, with a fallback to the Gemini 3 Pro Image model ("Nano Banana Pro") if needed.

Requirements

  • Python 3.10+
  • google-genai Python package (>= 2.0.1)

Instructions

  1. Generate an image (Recommended: use the metadata file directly):

    python3 skills/cover-image-generation/scripts/generate_image.py \
      --workspace ./workspace \
      --metadata ./workspace/data/show_notes.json
    

    Note: Using --metadata will automatically extract the show title and apply a random, high-quality prompt template. This is the preferred method.

    Alternative (Manual prompt):

    python3 skills/cover-image-generation/scripts/generate_image.py \
      --workspace ./workspace \
      --prompt "A prompt describing the image"
    
  2. Output:

    • The image will be saved to {workspace}/images/cover.png.

Model

  • Primary Model: gemini-3-flash-image-preview
  • Fallback Model: gemini-3-pro-image-preview
  • Resolution: 1:1 (default)

Prompting rules

When using the --metadata option, this skill uses a set of predefined prompt templates and selects one at random to generate cover images. It dynamically inserts the show title into the selected template.

  • Example Prompt: "A professional podcast cover image for a show titled 'AI Talk Radio' on the 'AI Talk Radio' station. The design features the text 'AI Talk Radio' in a bold, stylish white font centered on the cover. The background is a vibrant purple with a textured water ripple effect that covers the entire frame, creating a dynamic and clean aesthetic."

If you choose to use the --prompt option instead, you must construct the prompt yourself. In that case, follow these rules:

Forbidden themes

  • Do not ask for futuristic, cyberpunk or neon themes
  • Do not include any text other than the show title

Больше skills от google-gemini

agent-tui
google-gemini
Main Agents: Do NOT use this skill directly. If you need to test the TUI, invoke the `tui_tester` subagent. Drive terminal UI (TUI) applications…
gemini-api-cli
google-gemini
Руководство по использованию инструмента командной строки Gemini API. Используйте, когда вам нужно взаимодействовать с Gemini API через командную строку, управлять агентами или генерировать медиа (изображения,…
behavioral-evals
google-gemini
Руководство по созданию, запуску, исправлению и продвижению поведенческих оценок. Используется при проверке логики принятия решений агентом, отладке сбоев, отладке подсказок…
gemini-live-api-dev
google-gemini
Реализация двусторонней потоковой передачи в реальном времени с Gemini через WebSockets для аудио-, видео- и текстовых диалогов. Поддерживает ввод/вывод аудио (16 кГц PCM), видеокадры, текст и автоматические транскрипции с обнаружением голосовой активности для обработки прерываний. Включает встроенные аудиофункции: аффективный диалог, упреждающее аудио и режим размышления; вызов функций для синхронного и асинхронного использования инструментов; а также привязку к Google Search. Предлагает управление сессиями с сжатием контекста, возобновлением и...
gemini-omni-flash-api
google-gemini
Используйте этот навык для генеративного видеомонтажа, преобразования текста в видео, генерации видео по изображению-референсу и анимации переходов от первого кадра к видео с помощью…
gemini-api-dev
google-gemini
Создавайте приложения с моделями Google Gemini, поддерживающими мультимодальный контент, вызов функций и структурированные выходные данные на Python, JavaScript, Go и Java. Доступ к текущим моделям Gemini 3 (Pro, Flash, Pro Image) с контекстом в 1 миллион токенов; устаревшие модели Gemini 2.x и 1.5 больше не поддерживаются. Поддерживается генерация текста, понимание изображений, аудио и видео, вызов функций, структурированный вывод JSON, выполнение кода, кэширование контекста и эмбеддинги. Официальные SDK: google-genai (Python),...
gemini-interactions-api
google-gemini
Унифицированный интерфейс для моделей и агентов Gemini с состоянием на стороне сервера, потоковой передачей и оркестрацией инструментов. Поддерживает несколько актуальных моделей (gemini-3-flash-preview, gemini-3-pro-preview, gemini-2.5-flash/pro) и агента Deep Research; автоматически заменяет устаревшие идентификаторы моделей на актуальные альтернативы. Выгружает историю диалога на сервер через previous_interaction_id для многошаговых взаимодействий с сохранением состояния без ручного управления историей. Встроенная оркестрация инструментов, включая...
deliver
google-gemini
Публикует сжатую версию брифинга во входящий вебхук Google Chat или Slack, так что ежедневный запуск доставляет себя сам — молча пропускается, когда вебхук не…