infsh-cli

Ejecuta aplicaciones de IA mediante la CLI de inference.sh: generación de imágenes, creación de videos, LLM, búsqueda, 3D, automatización de Twitter. Modelos: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter y muchos más. Úsalo al ejecutar aplicaciones de IA, generar imágenes/videos, llamar a LLM, buscar en la web o automatizar Twitter. Desencadenantes: inference.sh, infsh, modelo de IA, ejecutar IA, IA sin servidor, API de IA, flux, veo, API de claude, generación de imágenes, generación de videos, openrouter, tavily, búsqueda de exa, API de twitter, grok

npx skills add https://github.com/skills-101/superpowers --skill infsh-cli

Install the belt CLI skill: npx skills add belt-sh/cli

inference.sh

Run AI apps in the cloud with a simple CLI. No GPU required.

inference.sh

Install CLI

curl -fsSL https://cli.inference.sh | sh
belt login

What does the installer do? The install script detects your OS and architecture, downloads the correct binary from dist.inference.sh, verifies its SHA-256 checksum, and places it in your PATH. That's it — no elevated permissions, no background processes, no telemetry. If you have cosign installed, the installer also verifies the Sigstore signature automatically.

Manual install (if you prefer not to pipe to sh):

# Download the binary and checksums
curl -LO https://dist.inference.sh/cli/checksums.txt
curl -LO $(curl -fsSL https://dist.inference.sh/cli/manifest.json | grep -o '"url":"[^"]*"' | grep $(uname -s | tr A-Z a-z)-$(uname -m | sed 's/x86_64/amd64/;s/aarch64/arm64/') | head -1 | cut -d'"' -f4)
# Verify checksum
sha256sum -c checksums.txt --ignore-missing
# Extract and install
tar -xzf inferencesh-cli-*.tar.gz
mv inferencesh-cli-* ~/.local/bin/inferencesh

Quick Examples

# Generate an image
belt app run falai/flux-dev-lora --input '{"prompt": "a cat astronaut"}'

# Generate a video
belt app run google/veo-3-1-fast --input '{"prompt": "drone over mountains"}'

# Call Claude
belt app run openrouter/claude-sonnet-45 --input '{"prompt": "Explain quantum computing"}'

# Web search
belt app run tavily/search-assistant --input '{"query": "latest AI news"}'

# Post to Twitter
belt app run x/post-tweet --input '{"text": "Hello from AI!"}'

# Generate 3D model
belt app run infsh/rodin-3d-generator --input '{"prompt": "a wooden chair"}'

Local File Uploads

The CLI automatically uploads local files when you provide a path instead of a URL:

# Upscale a local image
belt app run falai/topaz-image-upscaler --input '{"image": "/path/to/photo.jpg", "upscale_factor": 2}'

# Image-to-video from local file
belt app run falai/wan-2-5-i2v --input '{"image": "./my-image.png", "prompt": "make it move"}'

# Avatar with local audio and image
belt app run bytedance/omnihuman-1-5 --input '{"audio": "/path/to/speech.mp3", "image": "/path/to/face.jpg"}'

# Post tweet with local media
belt app run x/post-create --input '{"text": "Check this out!", "media": "./screenshot.png"}'

Commands

TaskCommand
Browse the app storebelt app list
Search the storebelt app search "flux"
Filter by categorybelt app list --category image
List your appsbelt app list
Get app detailsbelt app get google/veo-3-1-fast
Generate sample inputbelt app sample google/veo-3-1-fast --save input.json
Run appbelt app run google/veo-3-1-fast --input input.json
Run without waitingbelt app run <app> --input input.json --no-wait
Check task statusbelt task get <task-id>

What's Available

CategoryExamples
ImageFLUX, Gemini 3 Pro, Grok Imagine, Seedream 4.5, Reve, Topaz Upscaler
VideoVeo 3.1, Seedance 2.0, Wan 2.5, OmniHuman, Fabric, HunyuanVideo Foley
LLMsClaude Opus/Sonnet/Haiku, Gemini 3 Pro, Kimi K2, GLM-4, any OpenRouter model
SearchTavily Search, Tavily Extract, Exa Search, Exa Answer, Exa Extract
3DRodin 3D Generator
Twitter/Xpost-tweet, post-create, dm-send, user-follow, post-like, post-retweet
UtilitiesMedia merger, caption videos, image stitching, audio extraction

Related Skills

# Image generation (FLUX, Gemini, Grok, Seedream)
npx skills add inference-sh/skills@ai-image-generation

# Video generation (Veo, Seedance, Wan, OmniHuman)
npx skills add inference-sh/skills@ai-video-generation

# LLMs (Claude, Gemini, Kimi, GLM via OpenRouter)
npx skills add inference-sh/skills@llm-models

# Web search (Tavily, Exa)
npx skills add inference-sh/skills@web-search

# AI avatars & lipsync (OmniHuman, Fabric, PixVerse)
npx skills add inference-sh/skills@ai-avatar-video

# Twitter/X automation
npx skills add inference-sh/skills@twitter-automation

# Model-specific
npx skills add inference-sh/skills@flux-image
npx skills add inference-sh/skills@google-veo

# Utilities
npx skills add inference-sh/skills@image-upscaling
npx skills add inference-sh/skills@background-removal

Reference Files

Documentation

Más skills de skills-101

ai-image-generation
skills-101
Genera imágenes de IA con GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve y más de 50 modelos mediante la CLI de inference.sh. Modelos: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Capacidades: text-to-image, image-to-image, inpainting, LoRA, edición de imágenes, upscaling, renderizado de texto. Úsalo para: arte con IA, maquetas de productos, concept art, gráficos para redes sociales, visuales de marketing, ilustraciones. Desencadenantes: flux, image generation, ai image, text to...
ai-avatar-video
skills-101
Crea videos de avatares IA y cabezas parlantes mediante la CLI de inference.sh. Recomendado: P-Video-Avatar (el más rápido, más económico, con TTS integrado). También: OmniHuman, Fabric, PixVerse. Audio: Inworld TTS-2 (más de 100 idiomas, control de emociones para personajes), ElevenLabs, Kokoro. Capacidades: avatares controlados por audio, texto a avatar, videos con sincronización de labios, generación de cabezas parlantes, presentadores virtuales, contenido UGC. Uso para: presentadores IA, videos explicativos, influencers virtuales, doblaje, videos de marketing, anuncios UGC, avatares para juegos,...
agent-browser
skills-101
Automatización de navegador para agentes de IA mediante inference.sh. Navega páginas web, interactúa con elementos usando referencias @e, toma capturas de pantalla, graba video. Capacidades: extracción web, llenado de formularios, clics, escritura, arrastrar y soltar, carga de archivos, ejecución de JavaScript. Úsalo para: automatización web, extracción de datos, pruebas, navegación de agentes, investigación. Disparadores: navegador, automatización web, extraer, navegar, clic, llenar formulario, captura de pantalla, navegar web, playwright, navegador headless, agente web, navegar por internet, grabar video
agent-tools
skills-101
Ejecuta aplicaciones de IA mediante la CLI de inference.sh: generación de imágenes, creación de videos, LLMs, búsqueda, 3D, automatización de Twitter. Modelos: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter y muchos más. Úsalo al ejecutar aplicaciones de IA, generar imágenes/videos, llamar a LLMs, búsqueda web o automatizar Twitter. Disparadores: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
python-executor
skills-101
Execute Python code in a safe sandboxed environment via [inference.sh](https://inference.sh). Pre-installed: NumPy, Pandas, Matplotlib, requests, BeautifulSoup, Selenium, Playwright, MoviePy, Pillow, OpenCV, trimesh, and 100+ more libraries. Use for: data processing, web scraping, image manipulation, video creation, 3D model processing, PDF generation, API calls, automation scripts. Triggers: python, execute code, run script, web scraping, data analysis, image processing, video editing, 3D...
remotion-render
skills-101
Renderiza videos a partir de código de componentes React/Remotion mediante inference.sh. Pasa código TSX, obtén MP4. Compatible con todas las APIs de Remotion: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Resolución, FPS, duración y códec configurables. Úsalo para: generación programática de videos, gráficos animados, motion design, videos basados en datos, animaciones de React a video. Disparadores: remotion, render video from code, tsx to video, react video, programmatic video, remotion render, code to video, animated...
landing-page-design
skills-101
Optimización de conversión de landing pages con reglas de diseño, diseño de sección hero y psicología del CTA. Cubre la fórmula del above-the-fold, la colocación de pruebas sociales, el diseño móvil y la lectura en patrón F. Útil para: landing pages de startups, páginas de producto, marketing SaaS, optimización de conversión. Disparadores: landing page, sección hero, above the fold, optimización de conversión, diseño de landing page, botón CTA, imagen hero, layout de landing page, landing page SaaS, diseño de página de producto, tasa de conversión, landing page...
designmarketing
product-photography
skills-101
Fotografía de productos con IA que incluye iluminación de estudio, tomas de estilo de vida y convenciones de packshot. Cubre ángulos, fondos, tipos de sombra, tomas principales y requisitos de imágenes para comercio electrónico. Útil para: fotos de productos, imágenes de comercio electrónico, listados de Amazon, packshots, fotografía de estilo de vida. Activadores: fotografía de productos, foto de producto, packshot, fotografía de comercio electrónico, toma de producto, imagen de producto, fotografía de estudio, producto de estilo de vida, foto de producto de Amazon, imagen de listado de producto, toma principal, mockup de producto,...