gpt-image

Gere e edite imagens com OpenAI GPT-Image-2 via CLI do inference.sh. Modelos: GPT-Image-2. Capacidades: texto para imagem, edição de imagem, inpainting, edição baseada em máscara, referência de múltiplas imagens, geração em lote. Use para: mockups de produtos, visuais de marketing, edição de imagem, arte conceitual, inpainting, manipulação de fotos. Gatilhos: gpt image, gpt-image-2, openai image, chatgpt image, dall-e, dalle, openai image generation, gpt image edit, gpt inpainting, openai dall-e, gpt 4o image

npx skills add https://github.com/qu-skills/skills --skill gpt-image

Install the belt CLI skill: npx skills add belt-sh/cli

GPT-Image

Generate and edit images with OpenAI's GPT-Image-2.5 and GPT-Image-2 via inference.sh CLI.

Models

ModelApp IDPick it for
GPT-Image-2.5 Flareopenai/gpt-image-2-5-flareDefault. Higher quality than GPT-Image-2 at 50% lower latency
GPT-Image-2.5 Sunburstopenai/gpt-image-2-5-sunburstPremium edits: keeps subject and composition, tighter control across multi-turn edits
GPT-Image-2openai/gpt-image-2Previous generation

All three share the same input schema. The 2.5 models add xhigh and max quality tiers.

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

belt app run openai/gpt-image-2-5-flare --input '{"prompt": "a cat astronaut floating in space"}'

Capabilities

Every GPT-Image app supports text-to-image generation, image editing with reference images, and mask-based inpainting through a single app.

FeatureDescription
Text-to-ImageGenerate images from text prompts
Image EditingEdit images using reference images
InpaintingMask-based editing of specific regions
Batch GenerationGenerate up to 10 images at once
Multiple FormatsPNG, JPEG, WebP output
Transparent BackgroundAlpha-channel PNG/WebP output for stickers, icons, product cutouts
Flexible ResolutionAny size in 16px increments (256–3840), aspect ratio up to 3:1

Examples

Text-to-Image

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "professional product photo of sneakers on a white background, studio lighting",
  "quality": "high"
}'

Multiple Images

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "minimalist logo design for a coffee shop",
  "n": 4,
  "quality": "medium"
}'

Image Editing with Reference

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "change the background to a beach at sunset",
  "images": ["https://your-image.jpg"]
}'

Precise Edit with Sunburst

Sunburst is built to change only what you ask for and preserve the rest.

belt app run openai/gpt-image-2-5-sunburst --input '{
  "prompt": "change the jacket to red leather, keep the person, pose and background unchanged",
  "images": ["https://your-photo.jpg"],
  "quality": "high"
}'

Maximum Detail

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "macro photo of a dragonfly wing, intricate veins, morning dew",
  "quality": "max"
}'

Multi-Image Reference

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "combine these two characters into one scene",
  "images": ["https://character1.jpg", "https://character2.jpg"]
}'

Inpainting with Mask

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "replace with a red sports car",
  "images": ["https://street-scene.jpg"],
  "mask": "https://car-mask.png"
}'

Transparent Background

Prompt for an isolated subject — describing a scene or backdrop makes the model draw one. Requires png (default) or webp output.

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "a single red apple with a green leaf, isolated subject",
  "background": "transparent"
}'

Custom Resolution

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "wide cinematic landscape, mountains at golden hour",
  "width": 1920,
  "height": 1080,
  "quality": "high"
}'

Fast Drafts

belt app run openai/gpt-image-2-5-flare --input '{
  "prompt": "quick concept sketch of a robot",
  "quality": "low"
}'

Pricing

Approximate price per 1024x1024 image. Flare and Sunburst cost the same.

QualityGPT-Image-2.5GPT-Image-2
low$0.006$0.006
medium$0.013$0.053
high$0.053$0.21
xhigh$0.094
max$0.21

Larger resolutions cost more. Edits add about $0.008 per reference image. See belt app get openai/gpt-image-2-5-flare for full pricing details.

Parameters

ParameterTypeDefaultDescription
promptstringrequiredText prompt describing the image
imagesarray-Reference image(s) for editing
maskstring-Mask image for inpainting
ninteger1Number of images (1–10)
qualitystringautolow, medium, high, xhigh, max (xhigh/max are 2.5 only)
widthinteger1024Output width (256–3840, multiples of 16, ratio ≤ 3:1)
heightinteger1024Output height (256–3840, multiples of 16, ratio ≤ 3:1)
output_formatstringpngpng, jpeg, or webp
output_compressioninteger-Compression level for jpeg/webp (0–100)
backgroundstringautoauto, transparent, or opaque (transparent needs png/webp)

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# All image generation models
npx skills add inference-sh/skills@ai-image-generation

# FLUX models
npx skills add inference-sh/skills@flux-image

# Pruna P-Image (fast & economical)
npx skills add inference-sh/skills@p-image

Browse all image apps: belt app list --category image

Documentation

Mais skills de qu-skills

ai-video-generation
qu-skills
Gere vídeos de IA com Google Veo, Seedance 2.0, HappyHorse, Wan, Grok e mais de 40 modelos via CLI do inference.sh. Modelos: Veo 3.1, Veo 3, Seedance 2.0, HappyHorse 1.0, Wan 2.5, Grok Imagine Video, OmniHuman, Fabric, HunyuanVideo. Capacidades: texto para vídeo, imagem para vídeo, referência para vídeo, edição de vídeo, sincronização labial, animação de avatar, upscaling de vídeo, som foley. Use para: vídeos para redes sociais, conteúdo de marketing, vídeos explicativos, demonstrações de produtos, avatares de IA. Gatilhos: geração de vídeo, vídeo de IA,...
videocreativemedia
remotion-render
qu-skills
Renderize vídeos a partir de código de componentes React/Remotion via inference.sh. Envie código TSX, receba MP4. Suporta todas as APIs do Remotion: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Resolução, FPS, duração e codec configuráveis. Use para: geração programática de vídeos, gráficos animados, design de movimento, vídeos baseados em dados, animações React para vídeo. Gatilhos: remotion, renderizar vídeo a partir de código, tsx para vídeo, react video, vídeo programático, remotion render, código para vídeo, animado...
developmentvideocreative
ai-image-generation
qu-skills
Gere imagens de IA com GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve e mais de 50 modelos via CLI do inference.sh. Modelos: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Capacidades: texto para imagem, imagem para imagem, inpainting, LoRA, edição de imagem, upscaling, renderização de texto. Use para: arte de IA, mockups de produtos, arte conceitual, gráficos para redes sociais, visuais de marketing, ilustrações. Gatilhos: flux, geração de imagem, imagem de IA, texto para...
creativemediaimage
ai-avatar-video
qu-skills
Crie vídeos de avatar IA e talking head via CLI do inference.sh. Recomendado: P-Video-Avatar (mais rápido, mais barato, TTS integrado). Também: OmniHuman, Fabric, PixVerse. Áudio: Inworld TTS-2 (mais de 100 idiomas, controle de emoção para personagens), ElevenLabs, Kokoro. Capacidades: avatares guiados por áudio, texto para avatar, vídeos com sincronia labial, geração de talking head, apresentadores virtuais, conteúdo UGC. Use para: apresentadores IA, vídeos explicativos, influenciadores virtuais, dublagem, vídeos de marketing, anúncios UGC, avatares para jogos,...
videocreativemedia
twitter-automation
qu-skills
Automatize o Twitter/X com postagem, engajamento e gerenciamento de usuários via CLI do inference.sh. Apps: x/post-tweet, x/post-create (com mídia), x/post-like, x/post-retweet, x/dm-send, x/user-follow. Capacidades: postar tweets, agendar conteúdo, curtir posts, retweetar, enviar DMs, seguir usuários, obter perfis. Use para: automação de mídias sociais, agendamento de conteúdo, bots de engajamento, crescimento de audiência, API do X. Gatilhos: twitter api, x api, automação de tweets, postar no twitter, twitter bot, automação de mídias sociais, x...
api
agent-browser
qu-skills
Automação de navegador para agentes de IA via inference.sh. Navegue por páginas da web, interaja com elementos usando referências @e, tire capturas de tela, grave vídeo. Capacidades: raspagem web, preenchimento de formulários, cliques, digitação, arrastar e soltar, upload de arquivos, execução de JavaScript. Use para: automação web, extração de dados, testes, navegação por agente, pesquisa. Gatilhos: navegador, automação web, raspar, navegar, clicar, preencher formulário, captura de tela, navegar na web, playwright, navegador headless, agente web, surfar na internet, gravar vídeo
browser-automationweb-scrapingtesting
web-search
qu-skills
Pesquisa na web e extração de conteúdo com Tavily e Exa via CLI inference.sh. Apps: Tavily Search, Tavily Extract, Exa Search, Exa Answer, Exa Extract. Capacidades: pesquisa com IA, extração de conteúdo, respostas diretas, pesquisa. Uso para: pesquisa, pipelines RAG, verificação de fatos, agregação de conteúdo, agentes. Gatilhos: pesquisa na web, tavily, exa, api de pesquisa, extração de conteúdo, pesquisa, busca na internet, pesquisa com IA, assistente de pesquisa, raspagem web, rag, alternativa ao perplexity
researchweb-scrapingapi
agent-tools
qu-skills
Execute 250+ aplicativos de IA via CLI inference.sh - geração de imagens, criação de vídeos, LLMs, busca, 3D, automação do Twitter. Modelos: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter e muitos mais. Use ao executar aplicativos de IA, gerar imagens/vídeos, chamar LLMs, buscar na web ou automatizar o Twitter. Gatilhos: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
developmentapicreative