gpt-image

Genera y edita imágenes con OpenAI GPT-Image-2 a través de la CLI de inference.sh. Modelos: GPT-Image-2. Capacidades: texto a imagen, edición de imágenes, inpainting, edición basada en máscaras, referencia multiimagen, generación por lotes. Usar para: maquetas de productos, imágenes de marketing, edición de imágenes, arte conceptual, inpainting, manipulación de fotos. Disparadores: gpt image, gpt-image-2, openai image, chatgpt image, dall-e, dalle, openai image generation, gpt image edit, gpt inpainting, openai dall-e, gpt 4o image

npx skills add https://github.com/qu-skills/skills --skill gpt-image

Install the belt CLI skill: npx skills add belt-sh/cli

GPT-Image-2

Generate and edit images with OpenAI's GPT-Image-2 via inference.sh CLI.

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

belt app run openai/gpt-image-2 --input '{"prompt": "a cat astronaut floating in space"}'

Capabilities

GPT-Image-2 supports text-to-image generation, image editing with reference images, and mask-based inpainting — all through a single model.

FeatureDescription
Text-to-ImageGenerate images from text prompts
Image EditingEdit images using reference images
InpaintingMask-based editing of specific regions
Batch GenerationGenerate up to 10 images at once
Multiple FormatsPNG, JPEG, WebP output
Flexible ResolutionAny size in 32px increments (256–4096)

Examples

Text-to-Image

belt app run openai/gpt-image-2 --input '{
  "prompt": "professional product photo of sneakers on a white background, studio lighting",
  "quality": "high"
}'

Multiple Images

belt app run openai/gpt-image-2 --input '{
  "prompt": "minimalist logo design for a coffee shop",
  "n": 4,
  "quality": "medium"
}'

Image Editing with Reference

belt app run openai/gpt-image-2 --input '{
  "prompt": "change the background to a beach at sunset",
  "images": ["https://your-image.jpg"]
}'

Multi-Image Reference

belt app run openai/gpt-image-2 --input '{
  "prompt": "combine these two characters into one scene",
  "images": ["https://character1.jpg", "https://character2.jpg"]
}'

Inpainting with Mask

belt app run openai/gpt-image-2 --input '{
  "prompt": "replace with a red sports car",
  "images": ["https://street-scene.jpg"],
  "mask": "https://car-mask.png"
}'

Custom Resolution

belt app run openai/gpt-image-2 --input '{
  "prompt": "wide cinematic landscape, mountains at golden hour",
  "width": 1920,
  "height": 1080,
  "quality": "high"
}'

Fast Drafts

belt app run openai/gpt-image-2 --input '{
  "prompt": "quick concept sketch of a robot",
  "quality": "low"
}'

Pricing

Quality~Price per Image
Low$0.006
Medium$0.024
High$0.21

Larger resolutions cost more. See belt app get openai/gpt-image-2 for full pricing details.

Parameters

ParameterTypeDefaultDescription
promptstringrequiredText prompt describing the image
imagesarray-Reference image(s) for editing
maskstring-Mask image for inpainting
ninteger1Number of images (1–10)
qualitystring-low, medium, or high
widthinteger-Output width (256–4096, multiples of 32)
heightinteger-Output height (256–4096, multiples of 32)
output_formatstringpngpng, jpeg, or webp
output_compressioninteger-Compression level for jpeg/webp (0–100)

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# All image generation models
npx skills add inference-sh/skills@ai-image-generation

# FLUX models
npx skills add inference-sh/skills@flux-image

# Pruna P-Image (fast & economical)
npx skills add inference-sh/skills@p-image

Browse all image apps: belt app store --category image

Documentation

Más skills de qu-skills

ai-video-generation
qu-skills
Genera videos de IA con Google Veo, Seedance 2.0, HappyHorse, Wan, Grok y más de 40 modelos a través de la CLI de inference.sh. Modelos: Veo 3.1, Veo 3, Seedance 2.0, HappyHorse 1.0, Wan 2.5, Grok Imagine Video, OmniHuman, Fabric, HunyuanVideo. Capacidades: texto a video, imagen a video, referencia a video, edición de video, sincronización de labios, animación de avatares, mejora de resolución de video, sonido foley. Uso para: videos para redes sociales, contenido de marketing, videos explicativos, demostraciones de productos, avatares de IA. Disparadores: generación de video, video de IA,...
videocreativemedia
remotion-render
qu-skills
Renderiza videos desde código de componentes React/Remotion a través de inference.sh. Envía código TSX, obtén MP4. Soporta todas las APIs de Remotion: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Resolución, FPS, duración y códec configurables. Útil para: generación programática de videos, gráficos animados, diseño en movimiento, videos basados en datos, animaciones de React a video. Disparadores: remotion, renderizar video desde código, tsx a video, react video, video programático, remotion render, código a video, animado...
developmentvideocreative
ai-image-generation
qu-skills
Genera imágenes de IA con GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve y más de 50 modelos a través de la CLI de inference.sh. Modelos: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Capacidades: texto a imagen, imagen a imagen, inpainting, LoRA, edición de imágenes, escalado, renderizado de texto. Usos: arte de IA, maquetas de productos, arte conceptual, gráficos para redes sociales, imágenes de marketing, ilustraciones. Disparadores: flux, generación de imágenes, imagen de IA, texto a...
creativemediaimage
ai-avatar-video
qu-skills
Crea videos de avatar AI y videos de cabeza parlante a través de la CLI de inference.sh. Recomendado: P-Video-Avatar (el más rápido, más barato, TTS integrado). También: OmniHuman, Fabric, PixVerse. Audio: Inworld TTS-2 (más de 100 idiomas, control de emociones para personajes), ElevenLabs, Kokoro. Capacidades: avatares impulsados por audio, texto a avatar, videos de sincronización de labios, generación de cabeza parlante, presentadores virtuales, contenido UGC. Usar para: presentadores AI, videos explicativos, influencers virtuales, doblaje, videos de marketing, anuncios UGC, avatares de juegos,...
videocreativemedia
twitter-automation
qu-skills
Automatiza Twitter/X con publicación, interacción y gestión de usuarios mediante la CLI de inference.sh. Aplicaciones: x/post-tweet, x/post-create (con medios), x/post-like, x/post-retweet, x/dm-send, x/user-follow. Capacidades: publicar tweets, programar contenido, dar like a publicaciones, retweetear, enviar DMs, seguir usuarios, obtener perfiles. Uso para: automatización de redes sociales, programación de contenido, bots de interacción, crecimiento de audiencia, API de X. Disparadores: twitter api, x api, automatización de tweets, publicar en twitter, bot de twitter, automatización de redes sociales, x...
api
agent-browser
qu-skills
Automatización del navegador para agentes de IA a través de inference.sh. Navega por páginas web, interactúa con elementos usando referencias @e, toma capturas de pantalla, graba video. Capacidades: raspado web, llenado de formularios, clics, escritura, arrastrar y soltar, carga de archivos, ejecución de JavaScript. Usos: automatización web, extracción de datos, pruebas, navegación de agentes, investigación. Disparadores: navegador, automatización web, raspar, navegar, hacer clic, llenar formulario, captura de pantalla, navegar por la web, playwright, navegador sin cabeza, agente web, navegar por internet, grabar video
browser-automationweb-scrapingtesting
web-search
qu-skills
Búsqueda web y extracción de contenido con Tavily y Exa a través de la CLI de inference.sh. Aplicaciones: Tavily Search, Tavily Extract, Exa Search, Exa Answer, Exa Extract. Capacidades: búsqueda impulsada por IA, extracción de contenido, respuestas directas, investigación. Uso para: investigación, pipelines RAG, verificación de datos, agregación de contenido, agentes. Disparadores: búsqueda web, tavily, exa, api de búsqueda, extracción de contenido, investigación, búsqueda en internet, búsqueda IA, asistente de búsqueda, web scraping, rag, alternativa a Perplexity
researchweb-scrapingapi
agent-tools
qu-skills
Ejecuta más de 250 aplicaciones de IA mediante la CLI de inference.sh: generación de imágenes, creación de videos, LLMs, búsqueda, 3D, automatización de Twitter. Modelos: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter y muchos más. Úsalo al ejecutar aplicaciones de IA, generar imágenes/videos, llamar a LLMs, buscar en la web o automatizar Twitter. Disparadores: inference.sh, infsh, modelo de IA, ejecutar IA, IA sin servidor, API de IA, flux, veo, API de Claude, generación de imágenes, generación de videos, openrouter, tavily, búsqueda en Exa, API de Twitter, grok
developmentapicreative