ai-image-generation

tarafından skills-101

inference.sh CLI ile GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve ve 50+ model ile AI görselleri oluşturun. Modeller: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Yetenekler: metinden görsele, görselden görsele, inpainting, LoRA, görsel düzenleme, yükseltme, metin işleme. Kullanım alanları: AI sanatı, ürün mockupları, konsept sanatı, sosyal medya grafikleri, pazarlama görselleri, illüstrasyonlar. Tetikleyiciler: flux, görsel oluşturma, ai görsel, metinden...

npx skills add https://github.com/skills-101/superpowers --skill ai-image-generation

Install the belt CLI skill: npx skills add belt-sh/cli

AI Image Generation

Generate images with 50+ AI models via inference.sh CLI.

AI Image Generation

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

# Generate an image with FLUX
belt app run falai/flux-dev-lora --input '{"prompt": "a cat astronaut in space"}'

Available Models

ModelApp IDBest For
GPT-Image-2openai/gpt-image-2Text-to-image, editing, inpainting
FLUX Dev LoRAfalai/flux-dev-loraHigh quality with custom styles
FLUX.2 Klein LoRAfalai/flux-2-klein-loraFast with LoRA support (4B/9B)
P-Imagepruna/p-imageFast, economical, multiple aspects
P-Image-LoRApruna/p-image-loraFast with preset LoRA styles
P-Image-Editpruna/p-image-editFast image editing
Gemini 3 Progoogle/gemini-3-pro-image-previewGoogle's latest
Gemini 2.5 Flashgoogle/gemini-2-5-flash-imageFast Google model
Grok Imaginexai/grok-imagine-imagexAI's model, multiple aspects
Seedream 4.5bytedance/seedream-4-52K-4K cinematic quality
Seedream 4.0bytedance/seedream-4-0High quality 2K-4K
Seedream 3.0bytedance/seedream-3-0-t2iAccurate text rendering
Revefalai/reveNatural language editing, text rendering
ImagineArt 1.5 Profalai/imagine-art-1-5-pro-previewUltra-high-fidelity 4K
FLUX Klein 4Bpruna/flux-klein-4bUltra-cheap ($0.0001/image)
Topaz Upscalerfalai/topaz-image-upscalerProfessional upscaling

Browse All Image Apps

belt app list --category image

Examples

GPT-Image-2

belt app run openai/gpt-image-2 --input '{
  "prompt": "professional product photo of sneakers, studio lighting",
  "quality": "high"
}'

GPT-Image-2 Editing

belt app run openai/gpt-image-2 --input '{
  "prompt": "change the background to a beach at sunset",
  "images": ["https://your-image.jpg"]
}'

Text-to-Image with FLUX

belt app run falai/flux-dev-lora --input '{
  "prompt": "professional product photo of a coffee mug, studio lighting"
}'

Fast Generation with FLUX Klein

belt app run falai/flux-2-klein-lora --input '{"prompt": "sunset over mountains"}'

Google Gemini 3 Pro

belt app run google/gemini-3-pro-image-preview --input '{
  "prompt": "photorealistic landscape with mountains and lake"
}'

Grok Imagine

belt app run xai/grok-imagine-image --input '{
  "prompt": "cyberpunk city at night",
  "aspect_ratio": "16:9"
}'

Reve (with Text Rendering)

belt app run falai/reve --input '{
  "prompt": "A poster that says HELLO WORLD in bold letters"
}'

Seedream 4.5 (4K Quality)

belt app run bytedance/seedream-4-5 --input '{
  "prompt": "cinematic portrait of a woman, golden hour lighting"
}'

Image Upscaling

belt app run falai/topaz-image-upscaler --input '{"image_url": "https://..."}'

Stitch Multiple Images

belt app run infsh/stitch-images --input '{
  "images": ["https://img1.jpg", "https://img2.jpg"],
  "direction": "horizontal"
}'

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# Pruna P-Image (fast & economical)
npx skills add inference-sh/skills@p-image

# GPT-Image-2 (OpenAI)
npx skills add inference-sh/skills@gpt-image

# FLUX-specific skill
npx skills add inference-sh/skills@flux-image

# Upscaling & enhancement
npx skills add inference-sh/skills@image-upscaling

# Background removal
npx skills add inference-sh/skills@background-removal

# Video generation
npx skills add inference-sh/skills@ai-video-generation

# AI avatars from images
npx skills add inference-sh/skills@ai-avatar-video

Browse all apps: belt app list

Documentation

skills-101 tarafından daha fazla skill

ai-avatar-video
skills-101
inference.sh CLI aracılığıyla AI avatar ve konuşan kafa videoları oluşturun. Önerilen: P-Video-Avatar (en hızlı, en ucuz, yerleşik TTS). Ayrıca: OmniHuman, Fabric, PixVerse. Ses: Inworld TTS-2 (100+ dil, karakterler için duygu yönlendirme), ElevenLabs, Kokoro. Özellikler: ses odaklı avatarlar, metinden avatara, dudak senkronlu videolar, konuşan kafa üretimi, sanal sunucular, UGC içerik. Kullanım alanları: AI sunucular, açıklayıcı videolar, sanal fenomenler, dublaj, pazarlama videoları, UGC reklamları, oyun avatarları,...
agent-browser
skills-101
inference.sh üzerinden AI ajanları için tarayıcı otomasyonu. Web sayfalarında gezinin, @e referanslarını kullanarak öğelerle etkileşime geçin, ekran görüntüsü alın, video kaydedin. Yetenekler: web kazıma, form doldurma, tıklama, yazma, sürükle-bırak, dosya yükleme, JavaScript çalıştırma. Şunlar için kullanın: web otomasyonu, veri çıkarma, test etme, ajan taraması, araştırma. Tetikleyiciler: tarayıcı, web otomasyonu, kazıma, gezinme, tıklama, form doldurma, ekran görüntüsü, web'de gezinme, playwright, başsız tarayıcı, web ajanı, internette sörf, video kaydetme
agent-tools
skills-101
inference.sh CLI üzerinden AI uygulamaları çalıştırın - görüntü oluşturma, video oluşturma, LLM'ler, arama, 3D, Twitter otomasyonu. Modeller: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter ve daha fazlası. AI uygulamaları çalıştırırken, görüntü/video oluştururken, LLM çağırırken, web araması yaparken veya Twitter'ı otomatikleştirirken kullanın. Tetikleyiciler: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
python-executor
skills-101
Execute Python code in a safe sandboxed environment via [inference.sh](https://inference.sh). Pre-installed: NumPy, Pandas, Matplotlib, requests, BeautifulSoup, Selenium, Playwright, MoviePy, Pillow, OpenCV, trimesh, and 100+ more libraries. Use for: data processing, web scraping, image manipulation, video creation, 3D model processing, PDF generation, API calls, automation scripts. Triggers: python, execute code, run script, web scraping, data analysis, image processing, video editing, 3D...
remotion-render
skills-101
React/Remotion bileşen kodundan inference.sh üzerinden videolar oluşturun. TSX kodu verin, MP4 alın. Tüm Remotion API'lerini destekler: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Yapılandırılabilir çözünürlük, FPS, süre, codec. Şunlar için kullanın: programatik video üretimi, animasyonlu grafikler, hareket tasarımı, veri odaklı videolar, React animasyonlarını videoya dönüştürme. Tetikleyiciler: remotion, koddan video oluşturma, tsx'ten videoya, react video, programatik video, remotion render, koddan videoya, animasyonlu...
infsh-cli
skills-101
<text> inference.sh CLI üzerinden AI uygulamalarını çalıştırın - görüntü oluşturma, video üretimi, LLM'ler, arama, 3D, Twitter otomasyonu. Modeller: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter ve daha fazlası. AI uygulamaları çalıştırırken, görüntü/video oluştururken, LLM çağırırken, web araması yaparken veya Twitter'ı otomatikleştirirken kullanın. Tetikleyiciler: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok </text>
landing-page-design
skills-101
Açılış sayfası dönüşüm optimizasyonu; yerleşim kuralları, hero bölümü tasarımı ve CTA psikolojisi ile birlikte. Katlama çizgisi üstü formülü, sosyal kanıt yerleşimi, mobil tasarım ve F-deseni okuma düzenini kapsar. Kullanım alanları: start-up açılış sayfaları, ürün sayfaları, SaaS pazarlaması, dönüşüm optimizasyonu. Tetikleyiciler: landing page, hero section, above the fold, conversion optimization, landing page design, cta button, hero image, landing page layout, saas landing page, product page design, conversion rate, landing page...
designmarketing
product-photography
skills-101
Yapay zeka ürün fotoğrafçılığı; stüdyo aydınlatması, yaşam tarzı çekimleri ve packshot konvansiyonlarıyla. Açıları, arka planları, gölge türlerini, hero shot'ları ve e-ticaret görsel gereksinimlerini kapsar. Şunlar için kullanılır: ürün fotoğrafları, e-ticaret görselleri, Amazon listeleme görselleri, packshot'lar, yaşam tarzı fotoğrafçılığı. Tetikleyiciler: ürün fotoğrafçılığı, ürün fotoğrafı, packshot, e-ticaret fotoğrafçılığı, ürün çekimi, ürün görseli, stüdyo fotoğrafçılığı, yaşam tarzı ürün, amazon ürün fotoğrafı, ürün listeleme görseli, hero shot, ürün mockup'ı,...