ai-video-generation

Генерируйте AI-видео с помощью Google Veo, Seedance 2.0, HappyHorse, Wan, Grok и 40+ моделей через CLI inference.sh. Модели: Veo 3.1, Veo 3, Seedance 2.0, HappyHorse 1.0, Wan 2.5, Grok Imagine Video, OmniHuman, Fabric, HunyuanVideo. Возможности: текст-в-видео, изображение-в-видео, референс-в-видео, редактирование видео, липсинк, анимация аватаров, апскейлинг видео, звук фоли. Используйте для: видео для соцсетей, маркетинговый контент, объясняющие видео, демонстрации продуктов, AI-аватары. Триггеры: генерация видео, ai video,...

npx skills add https://github.com/qu-skills/skills --skill ai-video-generation

Install the belt CLI skill: npx skills add belt-sh/cli

AI Video Generation

Generate videos with 40+ AI models via inference.sh CLI.

AI Video Generation

Quick Start

Requires inference.sh CLI (belt). Install instructions

belt login

# Generate a video with Veo
belt app run google/veo-3-1-fast --input '{"prompt": "drone shot flying over a forest"}'

Available Models

Text-to-Video

ModelApp IDBest For
Veo 3.1 Fastgoogle/veo-3-1-fastFast, with optional audio
Veo 3.1google/veo-3-1Best quality, frame interpolation
Veo 3google/veo-3High quality with audio
Veo 3 Fastgoogle/veo-3-fastFast with audio
Veo 2google/veo-2Realistic videos
P-Videopruna/p-videoFast, economical, with audio support
WAN-T2Vpruna/wan-t2vEconomical 480p/720p
Grok Videoxai/grok-imagine-videoxAI, configurable duration
Seedance 2.0bytedance/seedance-2-0Text/image/ref-to-video with sync audio, up to 1080p
Seedance 2.0 Fastbytedance/seedance-2-0-fastFast variant, same capabilities
HappyHorse T2Valibaba/happyhorse-1-0-t2vPhysically realistic, up to 15s

Image-to-Video

ModelApp IDBest For
Wan 2.5falai/wan-2-5Animate any image
Wan 2.5 I2Vfalai/wan-2-5-i2vHigh quality i2v
WAN-I2Vpruna/wan-i2vEconomical 480p/720p
P-Videopruna/p-videoFast i2v with audio
Seedance 2.0bytedance/seedance-2-0Animate images with sync audio, up to 1080p
Seedance 2.0 Fastbytedance/seedance-2-0-fastFast variant, same capabilities
HappyHorse I2Valibaba/happyhorse-1-0-i2vAnimate images, up to 1080P/15s
HappyHorse R2Valibaba/happyhorse-1-0-r2vCharacter-preserving from references

Avatar / Lipsync

ModelApp IDBest For
OmniHuman 1.5bytedance/omnihuman-1-5Multi-character
OmniHuman 1.0bytedance/omnihuman-1-0Single character
Fabric 1.0falai/fabric-1-0Image talks with lipsync
PixVerse Lipsyncfalai/pixverse-lipsyncRealistic lipsync

Video Editing

ModelApp IDBest For
HappyHorse Editalibaba/happyhorse-1-0-video-editNatural language video editing

Utilities

ToolApp IDDescription
HunyuanVideo Foleyinfsh/hunyuanvideo-foleyAdd sound effects to video
Topaz Upscalerfalai/topaz-video-upscalerUpscale video quality
Media Mergerinfsh/media-mergerMerge videos with transitions

Browse All Video Apps

belt app store --category video

Examples

Text-to-Video with Veo

belt app run google/veo-3-1-fast --input '{
  "prompt": "A timelapse of a flower blooming in a garden"
}'

Grok Video

belt app run xai/grok-imagine-video --input '{
  "prompt": "Waves crashing on a beach at sunset",
  "duration": 5
}'

Image-to-Video with Wan 2.5

belt app run falai/wan-2-5 --input '{
  "image_url": "https://your-image.jpg"
}'

AI Avatar / Talking Head

belt app run bytedance/omnihuman-1-5 --input '{
  "image_url": "https://portrait.jpg",
  "audio_url": "https://speech.mp3"
}'

Fabric Lipsync

belt app run falai/fabric-1-0 --input '{
  "image_url": "https://face.jpg",
  "audio_url": "https://audio.mp3"
}'

Seedance 2.0 Text-to-Video with Audio

belt app run bytedance/seedance-2-0 --input '{
  "prompt": "a jazz band performing in a dimly lit club",
  "generate_audio": true,
  "duration": 10
}'

Seedance 2.0 Image-to-Video

belt app run bytedance/seedance-2-0 --input '{
  "image": "https://your-image.jpg",
  "prompt": "gentle camera movement, leaves rustling in the wind",
  "generate_audio": true
}'

Seedance 2.0 Reference-to-Video

belt app run bytedance/seedance-2-0 --input '{
  "prompt": "A person who looks like the reference walking through a garden",
  "reference_image": "https://portrait.jpg",
  "generate_audio": true
}'

HappyHorse Text-to-Video

belt app run alibaba/happyhorse-1-0-t2v --input '{
  "prompt": "a golden retriever running through autumn leaves, slow motion",
  "duration": 10,
  "resolution": "1080P"
}'

HappyHorse Video Editing

belt app run alibaba/happyhorse-1-0-video-edit --input '{
  "video": "https://your-video.mp4",
  "prompt": "change the background to a snowy mountain landscape"
}'

PixVerse Lipsync

belt app run falai/pixverse-lipsync --input '{
  "image_url": "https://portrait.jpg",
  "audio_url": "https://speech.mp3"
}'

Video Upscaling

belt app run falai/topaz-video-upscaler --input '{"video_url": "https://..."}'

Add Sound Effects (Foley)

belt app run infsh/hunyuanvideo-foley --input '{
  "video_url": "https://silent-video.mp4",
  "prompt": "footsteps on gravel, birds chirping"
}'

Merge Videos

belt app run infsh/media-merger --input '{
  "videos": ["https://clip1.mp4", "https://clip2.mp4"],
  "transition": "fade"
}'

Related Skills

# Full platform skill (all apps)
npx skills add inference-sh/skills@infsh-cli

# Pruna P-Video (fast & economical)
npx skills add inference-sh/skills@p-video

# Google Veo specific
npx skills add inference-sh/skills@google-veo

# Seedance 2.0
npx skills add inference-sh/skills@seedance

# HappyHorse 1.0
npx skills add inference-sh/skills@happyhorse

# AI avatars & lipsync
npx skills add inference-sh/skills@ai-avatar-video

# Text-to-speech (for video narration)
npx skills add inference-sh/skills@text-to-speech

# Image generation (for image-to-video)
npx skills add inference-sh/skills@ai-image-generation

# Twitter (post videos)
npx skills add inference-sh/skills@twitter-automation

Browse all apps: belt app store

Documentation

Больше skills от qu-skills

remotion-render
qu-skills
Рендеринг видео из React/Remotion компонентного кода через inference.sh. Передайте TSX-код, получите MP4. Поддерживает все Remotion API: useCurrentFrame, useVideoConfig, spring, interpolate, AbsoluteFill, Sequence. Настраиваемое разрешение, FPS, длительность, кодек. Используется для: программной генерации видео, анимированной графики, моушн-дизайна, видео на основе данных, преобразования React-анимаций в видео. Триггеры: remotion, render video from code, tsx to video, react video, programmatic video, remotion render, code to video, animated...
developmentvideocreative
ai-image-generation
qu-skills
Генерируйте AI-изображения с помощью GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve и более 50 моделей через CLI inference.sh. Модели: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Возможности: текст-в-изображение, изображение-в-изображение, инпейнтинг, LoRA, редактирование изображений, апскейлинг, рендеринг текста. Используется для: AI-арт, макеты продуктов, концепт-арт, графика для соцсетей, маркетинговые визуалы, иллюстрации. Триггеры: flux, image generation, ai image, text to...
creativemediaimage
ai-avatar-video
qu-skills
Создавайте AI-аватары и видео с говорящими головами через CLI inference.sh. Рекомендуется: P-Video-Avatar (самый быстрый, дешёвый, встроенный TTS). Также: OmniHuman, Fabric, PixVerse. Аудио: Inworld TTS-2 (100+ языков, управление эмоциями для персонажей), ElevenLabs, Kokoro. Возможности: аватары, управляемые аудио, текст-в-аватар, видео с синхронизацией губ, генерация говорящих голов, виртуальные ведущие, UGC-контент. Используйте для: AI-ведущие, обучающие видео, виртуальные инфлюенсеры, дубляж, маркетинговые видео, UGC-реклама, игровые аватары,...
videocreativemedia
twitter-automation
qu-skills
Автоматизация Twitter/X с публикацией, взаимодействием и управлением пользователями через CLI inference.sh. Приложения: x/post-tweet, x/post-create (с медиа), x/post-like, x/post-retweet, x/dm-send, x/user-follow. Возможности: публикация твитов, планирование контента, лайки, ретвиты, отправка личных сообщений, подписка на пользователей, получение профилей. Используется для: автоматизации социальных сетей, планирования контента, ботов взаимодействия, роста аудитории, X API. Триггеры: twitter api, x api, tweet automation, post to twitter, twitter bot, social media automation, x...
api
agent-browser
qu-skills
Автоматизация браузера для AI-агентов через inference.sh. Навигация по веб-страницам, взаимодействие с элементами с помощью @e-ссылок, создание скриншотов, запись видео. Возможности: веб-скрапинг, заполнение форм, клики, ввод текста, перетаскивание, загрузка файлов, выполнение JavaScript. Используется для: веб-автоматизации, извлечения данных, тестирования, просмотра страниц агентом, исследований. Триггеры: браузер, веб-автоматизация, скрапинг, навигация, клик, заполнение формы, скриншот, просмотр веб-страниц, playwright, headless-браузер, веб-агент, серфинг в интернете, запись видео
browser-automationweb-scrapingtesting
web-search
qu-skills
Веб-поиск и извлечение контента с помощью Tavily и Exa через CLI inference.sh. Приложения: Tavily Search, Tavily Extract, Exa Search, Exa Answer, Exa Extract. Возможности: поиск на основе ИИ, извлечение контента, прямые ответы, исследования. Используется для: исследований, RAG-пайплайнов, проверки фактов, агрегации контента, агентов. Триггеры: веб-поиск, tavily, exa, search api, извлечение контента, исследование, интернет-поиск, ИИ-поиск, поисковый ассистент, веб-скрапинг, rag, альтернатива perplexity
researchweb-scrapingapi
agent-tools
qu-skills
Запускайте 250+ AI-приложений через CLI inference.sh — генерация изображений, создание видео, LLM, поиск, 3D, автоматизация Twitter. Модели: FLUX, Veo, Gemini, Grok, Claude, Seedance, OmniHuman, Tavily, Exa, OpenRouter и многие другие. Используйте при запуске AI-приложений, генерации изображений/видео, вызове LLM, веб-поиске или автоматизации Twitter. Триггеры: inference.sh, infsh, ai model, run ai, serverless ai, ai api, flux, veo, claude api, image generation, video generation, openrouter, tavily, exa search, twitter api, grok
developmentapicreative
python-executor
qu-skills
We need to translate the given text from English to Russian, preserving the name "python-executor" only if it appears in the source text. The source text does not contain "python-executor" explicitly; it's the directory item name but not inside the <text>. So we don't include it. We translate the description, keeping product names, protocol names, URLs, numbers, technical terms. The URL is https://inference.sh, keep as is. Library names: NumPy, Pandas, Matplotlib, requests, BeautifulSoup, Selenium, Playwright, MoviePy, Pillow, OpenCV, trimesh - keep as is. Also "100+ more libraries" - translate "more libraries" but keep "100+". Triggers list: translate the words but keep the technical terms like "python", "execute code", "run script", "web scraping", "data analysis", "image processing", "video editing", "3D..." - these are likely to be kept in English or translated? The instruction says "preserve product names, protocol names
developmentdata-analysisweb-scraping