ai-image-generation

Генерируйте AI-изображения с помощью GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve и более 50 моделей через CLI inference.sh. Модели: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Возможности: текст-в-изображение, изображение-в-изображение, инпейнтинг, LoRA, редактирование изображений, апскейлинг, рендеринг текста. Используется для: AI-арт, макеты продуктов, концепт-арт, графика для соцсетей, маркетинговые визуалы, иллюстрации. Триггеры: flux, генерация изображений, ai image, текст в...

npx skills add https://github.com/skills-101/superpowers --skill ai-image-generation

Install the belt CLI skill: npx skills add belt-sh/cli

AI Image Generation

Generate images with 50+ AI models via inference.sh CLI.

AI Image Generation

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

# Generate an image with FLUX
belt app run falai/flux-dev-lora --input '{"prompt": "a cat astronaut in space"}'

Available Models

ModelApp IDBest For
GPT-Image-2openai/gpt-image-2Text-to-image, editing, inpainting
FLUX Dev LoRAfalai/flux-dev-loraHigh quality with custom styles
FLUX.2 Klein LoRAfalai/flux-2-klein-loraFast with LoRA support (4B/9B)
P-Imagepruna/p-imageFast, economical, multiple aspects
P-Image-LoRApruna/p-image-loraFast with preset LoRA styles
P-Image-Editpruna/p-image-editFast image editing
Gemini 3 Progoogle/gemini-3-pro-image-previewGoogle's latest
Gemini 2.5 Flashgoogle/gemini-2-5-flash-imageFast Google model
Grok Imaginexai/grok-imagine-imagexAI's model, multiple aspects
Seedream 4.5bytedance/seedream-4-52K-4K cinematic quality
Seedream 4.0bytedance/seedream-4-0High quality 2K-4K
Seedream 3.0bytedance/seedream-3-0-t2iAccurate text rendering
Revefalai/reveNatural language editing, text rendering
ImagineArt 1.5 Profalai/imagine-art-1-5-pro-previewUltra-high-fidelity 4K
FLUX Klein 4Bpruna/flux-klein-4bUltra-cheap ($0.0001/image)
Topaz Upscalerfalai/topaz-image-upscalerProfessional upscaling

Browse All Image Apps

belt app list --category image

Examples

GPT-Image-2

belt app run openai/gpt-image-2 --input '{
  "prompt": "professional product photo of sneakers, studio lighting",
  "quality": "high"
}'

GPT-Image-2 Editing

belt app run openai/gpt-image-2 --input '{
  "prompt": "change the background to a beach at sunset",
  "images": ["https://your-image.jpg"]
}'

Text-to-Image with FLUX

belt app run falai/flux-dev-lora --input '{
  "prompt": "professional product photo of a coffee mug, studio lighting"
}'

Fast Generation with FLUX Klein

belt app run falai/flux-2-klein-lora --input '{"prompt": "sunset over mountains"}'

Google Gemini 3 Pro

belt app run google/gemini-3-pro-image-preview --input '{
  "prompt": "photorealistic landscape with mountains and lake"
}'

Grok Imagine

belt app run xai/grok-imagine-image --input '{
  "prompt": "cyberpunk city at night",
  "aspect_ratio": "16:9"
}'

Reve (with Text Rendering)

belt app run falai/reve --input '{
  "prompt": "A poster that says HELLO WORLD in bold letters"
}'

Seedream 4.5 (4K Quality)

belt app run bytedance/seedream-4-5 --input '{
  "prompt": "cinematic portrait of a woman, golden hour lighting"
}'

Image Upscaling

belt app run falai/topaz-image-upscaler --input '{"image_url": "https://..."}'

Stitch Multiple Images

belt app run infsh/stitch-images --input '{
  "images": ["https://img1.jpg", "https://img2.jpg"],
  "direction": "horizontal"
}'

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# Pruna P-Image (fast & economical)
npx skills add inference-sh/skills@p-image

# GPT-Image-2 (OpenAI)
npx skills add inference-sh/skills@gpt-image

# FLUX-specific skill
npx skills add inference-sh/skills@flux-image

# Upscaling & enhancement
npx skills add inference-sh/skills@image-upscaling

# Background removal
npx skills add inference-sh/skills@background-removal

# Video generation
npx skills add inference-sh/skills@ai-video-generation

# AI avatars from images
npx skills add inference-sh/skills@ai-avatar-video

Browse all apps: belt app list

Documentation

Больше skills от skills-101

ai-avatar-video
skills-101
Создавайте AI-аватары и видео с говорящей головой через inference.sh CLI. Рекомендуется: P-Video-Avatar (самый быстрый, самый дешевый, встроенный TTS). Также: OmniHuman, Fabric, PixVerse. Аудио: Inworld TTS-2 (100+ языков, управление эмоциями для персонажей), ElevenLabs, Kokoro. Возможности: аватары, управляемые аудио, текст-в-аватар, видео с синхронизацией губ, генерация говорящей головы, виртуальные ведущие, UGC-контент. Используйте для: AI-ведущих, обучающих видео, виртуальных инфлюенсеров, дубляжа, маркетинговых видео, UGC-рекламы, игровых аватаров,...
agent-browser
skills-101
Автоматизация браузера для ИИ-агентов через inference.sh. Навигация по веб-страницам, взаимодействие с элементами с помощью @e-ссылок, создание скриншотов, запись видео. Возможности: веб-скрапинг, заполнение форм, клики, ввод текста, перетаскивание, загрузка файлов, выполнение JavaScript. Использовать для: веб-автоматизации, извлечения данных, тестирования, просмотра страниц агентом, исследований. Триггеры: браузер, веб-автоматизация, скрапинг, навигация, клик, заполнение формы, скриншот, просмотр веб-страниц, playwright, headless-браузер, веб-агент, серфинг в интернете, запись видео
agent-tools
skills-101
Запускайте ИИ-приложения через CLI inference.sh — генерация изображений, создание видео, LLM, поиск, 3D, автоматизация Twitter. Модели: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter и многие другие. Используйте при запуске ИИ-приложений, генерации изображений/видео, вызове LLM, веб-поиске или автоматизации Twitter. Триггеры: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
python-executor
skills-101
Execute Python code in a safe sandboxed environment via [inference.sh](https://inference.sh). Pre-installed: NumPy, Pandas, Matplotlib, requests, BeautifulSoup, Selenium, Playwright, MoviePy, Pillow, OpenCV, trimesh, and 100+ more libraries. Use for: data processing, web scraping, image manipulation, video creation, 3D model processing, PDF generation, API calls, automation scripts. Triggers: python, execute code, run script, web scraping, data analysis, image processing, video editing, 3D...
remotion-render
skills-101
Рендеринг видео из кода компонентов React/Remotion через inference.sh. Передайте TSX-код — получите MP4. Поддерживает все API Remotion: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Настраиваемые разрешение, FPS, длительность, кодек. Используйте для: программной генерации видео, анимированной графики, моушн-дизайна, видео на основе данных, преобразования React-анимаций в видео. Триггеры: remotion, рендер видео из кода, tsx в видео, react видео, программное видео, remotion render, код в видео, анимированные...
infsh-cli
skills-101
Запускайте ИИ-приложения через CLI inference.sh — генерация изображений, создание видео, LLM, поиск, 3D, автоматизация Twitter. Модели: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter и многие другие. Используйте при запуске ИИ-приложений, генерации изображений/видео, вызове LLM, веб-поиске или автоматизации Twitter. Триггеры: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
landing-page-design
skills-101
Оптимизация конверсии лендингов с правилами макета, дизайном hero-секции и психологией CTA. Охватывает формулу above-the-fold, размещение социальных доказательств, мобильный дизайн и F-образную модель чтения. Используется для: лендингов стартапов, страниц продуктов, SaaS-маркетинга, оптимизации конверсии. Триггеры: лендинг, hero-секция, above the fold, оптимизация конверсии, дизайн лендинга, CTA-кнопка, hero-изображение, макет лендинга, SaaS-лендинг, дизайн страницы продукта, коэффициент конверсии, лендинг...
designmarketing
product-photography
skills-101
ИИ-фотография товаров со студийным освещением, лайфстайл-снимками и конвенциями пакшотов. Охватывает ракурсы, фоны, типы теней, hero-снимки и требования к изображениям для электронной коммерции. Использовать для: фото товаров, изображений для электронной коммерции, листингов на Amazon, пакшотов, лайфстайл-фотографии. Триггеры: фотография товаров, фото товара, пакшот, фотография для электронной коммерции, снимок товара, изображение товара, студийная фотография, лайфстайл-товар, фото товара для Amazon, изображение для листинга товара, hero-снимок, мокап товара,...