ai-image-generation

Genera imágenes de IA con GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve y más de 50 modelos a través de la CLI de inference.sh. Modelos: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Capacidades: texto a imagen, imagen a imagen, inpainting, LoRA, edición de imágenes, escalado, renderizado de texto. Usos: arte de IA, maquetas de productos, arte conceptual, gráficos para redes sociales, imágenes de marketing, ilustraciones. Disparadores: flux, generación de imágenes, imagen de IA, texto a...

npx skills add https://github.com/halt-catch-fire/skills --skill ai-image-generation

Install the belt CLI skill: npx skills add belt-sh/cli

AI Image Generation

Generate images with 50+ AI models via inference.sh CLI.

AI Image Generation

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

# Generate an image with FLUX
belt app run falai/flux-dev-lora --input '{"prompt": "a cat astronaut in space"}'

Available Models

ModelApp IDBest For
GPT-Image-2openai/gpt-image-2Text-to-image, editing, inpainting
FLUX Dev LoRAfalai/flux-dev-loraHigh quality with custom styles
FLUX.2 Klein LoRAfalai/flux-2-klein-loraFast with LoRA support (4B/9B)
P-Imagepruna/p-imageFast, economical, multiple aspects
P-Image-LoRApruna/p-image-loraFast with preset LoRA styles
P-Image-Editpruna/p-image-editFast image editing
Gemini 3 Progoogle/gemini-3-pro-image-previewGoogle's latest
Gemini 2.5 Flashgoogle/gemini-2-5-flash-imageFast Google model
Grok Imaginexai/grok-imagine-imagexAI's model, multiple aspects
Seedream 4.5bytedance/seedream-4-52K-4K cinematic quality
Seedream 4.0bytedance/seedream-4-0High quality 2K-4K
Seedream 3.0bytedance/seedream-3-0-t2iAccurate text rendering
Revefalai/reveNatural language editing, text rendering
ImagineArt 1.5 Profalai/imagine-art-1-5-pro-previewUltra-high-fidelity 4K
FLUX Klein 4Bpruna/flux-klein-4bUltra-cheap ($0.0001/image)
Topaz Upscalerfalai/topaz-image-upscalerProfessional upscaling

Browse All Image Apps

belt app list --category image

Examples

GPT-Image-2

belt app run openai/gpt-image-2 --input '{
  "prompt": "professional product photo of sneakers, studio lighting",
  "quality": "high"
}'

GPT-Image-2 Editing

belt app run openai/gpt-image-2 --input '{
  "prompt": "change the background to a beach at sunset",
  "images": ["https://your-image.jpg"]
}'

Text-to-Image with FLUX

belt app run falai/flux-dev-lora --input '{
  "prompt": "professional product photo of a coffee mug, studio lighting"
}'

Fast Generation with FLUX Klein

belt app run falai/flux-2-klein-lora --input '{"prompt": "sunset over mountains"}'

Google Gemini 3 Pro

belt app run google/gemini-3-pro-image-preview --input '{
  "prompt": "photorealistic landscape with mountains and lake"
}'

Grok Imagine

belt app run xai/grok-imagine-image --input '{
  "prompt": "cyberpunk city at night",
  "aspect_ratio": "16:9"
}'

Reve (with Text Rendering)

belt app run falai/reve --input '{
  "prompt": "A poster that says HELLO WORLD in bold letters"
}'

Seedream 4.5 (4K Quality)

belt app run bytedance/seedream-4-5 --input '{
  "prompt": "cinematic portrait of a woman, golden hour lighting"
}'

Image Upscaling

belt app run falai/topaz-image-upscaler --input '{"image_url": "https://..."}'

Stitch Multiple Images

belt app run infsh/stitch-images --input '{
  "images": ["https://img1.jpg", "https://img2.jpg"],
  "direction": "horizontal"
}'

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# Pruna P-Image (fast & economical)
npx skills add inference-sh/skills@p-image

# GPT-Image-2 (OpenAI)
npx skills add inference-sh/skills@gpt-image

# FLUX-specific skill
npx skills add inference-sh/skills@flux-image

# Upscaling & enhancement
npx skills add inference-sh/skills@image-upscaling

# Background removal
npx skills add inference-sh/skills@background-removal

# Video generation
npx skills add inference-sh/skills@ai-video-generation

# AI avatars from images
npx skills add inference-sh/skills@ai-avatar-video

Browse all apps: belt app list

Documentation

Más skills de halt-catch-fire

ai-video-generation
halt-catch-fire
Genera videos de IA con Google Veo, Seedance 2.0, HappyHorse, Wan, Grok y más de 40 modelos a través de la CLI de inference.sh. Modelos: Veo 3.1, Veo 3, Seedance 2.0, HappyHorse 1.0, Wan 2.5, Grok Imagine Video, OmniHuman, Fabric, HunyuanVideo. Capacidades: texto a video, imagen a video, referencia a video, edición de video, sincronización de labios, animación de avatares, mejora de resolución de video, sonido foley. Usos: videos para redes sociales, contenido de marketing, videos explicativos, demostraciones de productos, avatares de IA. Disparadores: generación de video, video de IA,...
creativevideomedia
twitter-automation
halt-catch-fire
Automatiza Twitter/X con publicación, interacción y gestión de usuarios mediante la CLI de inference.sh. Aplicaciones: x/post-tweet, x/post-create (con medios), x/post-like, x/post-retweet, x/dm-send, x/user-follow. Capacidades: publicar tweets, programar contenido, dar like a publicaciones, retweetear, enviar DMs, seguir usuarios, obtener perfiles. Usar para: automatización de redes sociales, programación de contenido, bots de interacción, crecimiento de audiencia, API de X. Disparadores: twitter api, x api, automatización de tweets, publicar en twitter, bot de twitter, automatización de redes sociales, x...
marketingapicommunication
ai-avatar-video
halt-catch-fire
Crea videos de avatar AI y videos de cabezas parlantes mediante la CLI de inference.sh. Recomendado: P-Video-Avatar (más rápido, más barato, TTS integrado). También: OmniHuman, Fabric, PixVerse. Audio: Inworld TTS-2 (más de 100 idiomas, control de emociones para personajes), ElevenLabs, Kokoro. Capacidades: avatares impulsados por audio, texto a avatar, videos de sincronización de labios, generación de cabezas parlantes, presentadores virtuales, contenido UGC. Usar para: presentadores AI, videos explicativos, influencers virtuales, doblaje, videos de marketing, anuncios UGC, avatares para juegos,...
videocreativemedia
agent-browser
halt-catch-fire
Automatización del navegador para agentes de IA a través de inference.sh. Navega por páginas web, interactúa con elementos usando referencias @e, toma capturas de pantalla, graba video. Capacidades: raspado web, llenado de formularios, clics, escritura, arrastrar y soltar, carga de archivos, ejecución de JavaScript. Usos: automatización web, extracción de datos, pruebas, navegación de agentes, investigación. Disparadores: navegador, automatización web, raspar, navegar, hacer clic, llenar formulario, captura de pantalla, navegar por la web, playwright, navegador sin cabeza, agente web, navegar por internet, grabar video
browser-automationweb-scrapingtesting
web-search
halt-catch-fire
We need to translate the given text from English to Spanish. The text describes a web search and content extraction skill using Tavily and Exa via inference.sh CLI. It lists apps, capabilities, uses, and triggers. We must preserve product names (Tavily, Exa, inference.sh CLI), protocol names, URLs (none), numbers, and technical terms. Do not add any extra commentary or labels. Just translate the text inside <text> tags. The text: "Web search and content extraction with Tavily and Exa via inference.sh CLI. Apps: Tavily Search, Tavily Extract, Exa Search, Exa Answer, Exa Extract. Capabilities: AI-powered search, content extraction, direct answers, research. Use for: research, RAG pipelines, fact-checking, content aggregation, agents. Triggers: web search, tavily, exa, search api, content extraction, research, internet search, ai search, search assistant, web scraping, rag, perplexity alternative" Translate to Spanish. Keep proper names as is. "inference.sh
researchweb-scrapingapi
infsh-cli
halt-catch-fire
Ejecuta más de 250 aplicaciones de IA a través de la CLI de inference.sh: generación de imágenes, creación de videos, LLMs, búsqueda, 3D, automatización de Twitter. Modelos: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter y muchos más. Úsalo al ejecutar aplicaciones de IA, generar imágenes/videos, llamar a LLMs, buscar en la web o automatizar Twitter. Disparadores: inference.sh, infsh, modelo de IA, ejecutar IA, IA sin servidor, API de IA, flux, veo, API de Claude, generación de imágenes, generación de videos, openrouter, tavily, búsqueda en Exa, API de Twitter, grok
developmentapicreative
landing-page-design
halt-catch-fire
Optimización de conversión de páginas de aterrizaje con reglas de diseño, diseño de sección hero y psicología de CTA. Cubre la fórmula above-the-fold, colocación de prueba social, diseño móvil y patrón de lectura en F. Útil para: páginas de aterrizaje de startups, páginas de producto, marketing SaaS, optimización de conversión. Disparadores: landing page, hero section, above the fold, conversion optimization, landing page design, cta button, hero image, landing page layout, saas landing page, product page design, conversion rate, landing page...
product-photography
halt-catch-fire
Fotografía de producto con IA con iluminación de estudio, tomas de estilo de vida y convenciones de packshot. Cubre ángulos, fondos, tipos de sombra, tomas principales y requisitos de imagen para comercio electrónico. Útil para: fotos de producto, imágenes de comercio electrónico, listados de Amazon, packshots, fotografía de estilo de vida. Disparadores: fotografía de producto, foto de producto, packshot, fotografía de comercio electrónico, toma de producto, imagen de producto, fotografía de estudio, producto de estilo de vida, foto de producto de Amazon, imagen de listado de producto, toma principal, maqueta de producto,...
creativeecommerceimage