媒体技能
ego lite browser
赞助ego lite 是AI代理运行网页自动化时最快的浏览器,可与Codex或Claude Code共享您的登录状态,零成本,零配置。
Alpha Vantage MCP Server
赞助获取金融市场数据:实时和历史股票、ETF、期权、外汇、加密货币、大宗商品、基本面、技术指标等
- 125.4k
design
nextlevelbuilderWe need to translate the given text from English to Simplified Chinese. The instruction says to preserve product names, protocol names, URLs, numbers, and technical terms. The name "design" is to be preserved if it appears in the source text, but it does appear as part of "design skill" and elsewhere. However, the instruction says "Do not include the name unless it appears in the source text." So we should translate the text as is, keeping "design" as is when it appears. Also preserve terms like "Gemini AI", "Chart.js", "SVG", "Gemini 3.1 Pro", "HTML", "CIP", etc. Numbers and styles should be kept. The text is a description of a comprehensive design skill. Translate naturally. Let me break down the text: "Comprehensive design skill: brand identity, design tokens, UI styling, logo generation (55 styles, Gemini AI), corporate identity program (50 deliverables, CIP mockups), HTML presentations (Chart.js), banner design (22 styles, social/ads/web/print), icon design
设计创意媒体 - 43
elevenlabs-music-generation
agentspace-soGenerate full songs and instrumental tracks with ElevenLabs Music on RunComfy via the `runcomfy` CLI. ElevenLabs Music turns a style description plus structured lyrics into studio-quality 44.1 kHz stereo audio — 5 seconds to 5 minutes — with section-level control (Intro / Verse / Chorus / Bridge), multilingual vocals, and commercial-friendly output. Generate a backing track, a full vocal song, a jingle, a podcast intro, a game loop, or an instrumental bed. Calls `runcomfy run...
创意音频媒体 - 6
elevenlabs-music-generation
doany-aiGenerate full songs and instrumental tracks with ElevenLabs Music on RunComfy via the `runcomfy` CLI. ElevenLabs Music turns a style description plus structured lyrics into studio-quality 44.1 kHz stereo audio — 5 seconds to 5 minutes — with section-level control (Intro / Verse / Chorus / Bridge), multilingual vocals, and commercial-friendly output. Generate a backing track, a full vocal song, a jingle, a podcast intro, a game loop, or an instrumental bed. Calls `runcomfy run...
创意音频媒体 - 12
elevenlabs-music-generation
runcomfy-comGenerate full songs and instrumental tracks with ElevenLabs Music on RunComfy via the `runcomfy` CLI. ElevenLabs Music turns a style description plus structured lyrics into studio-quality 44.1 kHz stereo audio — 5 seconds to 5 minutes — with section-level control (Intro / Verse / Chorus / Bridge), multilingual vocals, and commercial-friendly output. Generate a backing track, a full vocal song, a jingle, a podcast intro, a game loop, or an instrumental bed. Calls `runcomfy run...
创意音频媒体 - 44.2k
embedded-captions
heygen-com为说话人视频添加字幕。一个包含32种视觉风格的目录(CATALOG.md),基于两种引擎:列流(字幕合成到场景中——遮罩遮挡+混合模式;奶油/墨水/编辑/主题演讲/纪录片/响亮/霓虹/故障/铬/速度)和主题构成(锚点/军械/终端/霓虹灯/星尘/跺脚/记分牌/交通/VHS/街机/档案/激光/雷声/全息/生物光/极光/光谱/剪纸/弹出/黑板/涂鸦/画笔/水墨/勒索/最后一页/夜城...
视频创意媒体 - 0
extension-camera
caffeinelabs支持网络摄像头。
媒体视频图像 - 0
extension-object-storage
caffeinelabs通用文件/对象存储,适用于图片、视频、文件、文档等批量数据。非常适合图片库、视频库及其他文件或对象管理。支持超过IC限制的大文件,可通过浏览器缓存的HTTP URL访问。
开发媒体 - 0
extension-qr-code
caffeinelabs使用摄像头的二维码扫描器。
生产力媒体图像 - 44.2k
faceless-explainer
heygen-comfaceless-explainer 视频工作流程 - 任意文本(文章/笔记/主题/简报)→ narrator_scripts.json + 音频(语音+背景音乐)+ section_plan.md → 排版/抽象图形/图表/数据可视化视频。典型时长约3分钟以内(最佳时长约30-90秒);真正较长的内容属于通用视频,不适用此工作流程。生成自身的旁白(TTS)——不与用户提供/预先录制的画外音同步(那是通用视频)。不涉及网站抓取,无真实产品截图……
视频创意媒体 - 6
flux-2-klein
doany-ai在RunComfy上使用Flux 2 Klein(Black Forest Labs的Flux 2蒸馏快速变体)生成图像——该技能内置了模型文档中的提示模式,因此相比对同一模型进行简单提示,能获得更清晰的输出。文档说明了Flux 2 Klein的优势(亚秒级延迟、多参考品牌风格、声明式主语优先提示)、步数策略(快速迭代用4–8步,精修用约25步)、9B与4B变体的权衡,以及何时转向Flux 2 Pro/...
创意图像媒体 - 44.2k
general-video
heygen-com用作自定义HyperFrames HTML视频合成创作的后备方案,适用于无专门工作流程的场景。涵盖较长或多场景作品、品牌/宣传片、蒙太奇、标题卡、动态海报、静态循环以及任意长度或格式的自由创作。不适用于营销产品推广(product-launch-video)、通用网站转视频(website-to-video)、主题解说(faceless-explainer)、GitHub PR视频(pr-to-video)、为现有素材添加字幕等场景。
视频创意媒体 - 727
gpt-image
101-skills通过inference.sh CLI使用OpenAI GPT-Image-2生成和编辑图像。模型:GPT-Image-2。功能:文本转图像、图像编辑、修复、基于遮罩的编辑、多图像参考、批量生成。用途:产品模型图、营销视觉素材、图像编辑、概念艺术、修复、照片处理。触发词:gpt image、gpt-image-2、openai image、chatgpt image、dall-e、dalle、openai image generation、gpt image edit、gpt inpainting、openai dall-e、gpt 4o image
创意媒体图像 - 727
gpt-image
qu-skills通过inference.sh CLI使用OpenAI GPT-Image-2生成和编辑图像。模型:GPT-Image-2。功能:文本转图像、图像编辑、修复、基于遮罩的编辑、多图像参考、批量生成。用途:产品模型、营销视觉、图像编辑、概念艺术、修复、照片处理。触发词:gpt image、gpt-image-2、openai image、chatgpt image、dall-e、dalle、openai image generation、gpt image edit、gpt inpainting、openai dall-e、gpt 4o image
创意图像媒体 - 12
gpt-image-2
runcomfy-comGenerate and edit images with OpenAI GPT Image 2 (ChatGPT Images 2.0) on RunComfy. Documents GPT Image 2's strengths (embedded text, logos, multilingual typography, instruction precision), its 3 fixed sizes, edit-with-preservation language, and when to route to a sibling (Flux 2 / Nano Banana Pro / Seedream) instead. Calls `runcomfy run openai/gpt-image-2/text-to-image` or `/edit` through the local RunComfy CLI. Triggers on "gpt image 2", "gpt-image-2", "ChatGPT Images 2", "image 2", or any...
创意图像媒体 - 727
happyhorse
101-skills通过inference.sh命令行界面,使用阿里巴巴HappyHorse 1.0模型生成和编辑视频。模型包括:HappyHorse T2V、I2V、R2V、Video Edit。功能:文本转视频、图像转视频、参考转视频、自然语言视频编辑、角色保留、720P/1080P分辨率、最长15秒。用途:物理逼真视频、视频编辑、角色一致性内容、产品演示、社交媒体。触发词:happyhorse、happy horse、alibaba video、happyhorse 1.0、dashscope video、alibaba...
视频创意媒体 - 727
happyhorse
qu-skills通过inference.sh命令行界面,使用阿里巴巴HappyHorse 1.0模型生成和编辑视频。模型包括:HappyHorse T2V、I2V、R2V、Video Edit。功能:文本转视频、图像转视频、参考转视频、自然语言视频编辑、角色保留、720P/1080P分辨率、最长15秒。用途:物理逼真视频、视频编辑、角色一致性内容、产品演示、社交媒体。触发词:happyhorse、happy horse、alibaba video、happyhorse 1.0、dashscope video、alibaba...
创意视频媒体 - 43
happyhorse-1-0
agentspace-so在RunComfy上使用HappyHorse 1.0生成文本到视频。介绍HappyHorse 1.0的优势(在Artificial Analysis Video Arena排名第一,原生1080p并同步音频,多镜头角色一致性,支持6种语言提示),时长/宽高比/分辨率方案,以及何时转向Wan
创意视频媒体 - 6
happyhorse-1-0
doany-ai在 RunComfy 上使用 HappyHorse 1.0 生成文本到视频。介绍 HappyHorse 1.0 的优势(在 Artificial Analysis Video Arena 排名第一,原生 1080p 并带有同步音频,多镜头角色一致性,支持 6 种语言提示)、时长
创意视频媒体 - 12
happyhorse-1-0
runcomfy-com在RunComfy上使用HappyHorse 1.0生成文本到视频。介绍HappyHorse 1.0的优势(在Artificial Analysis Video Arena排名第一,原生1080p并同步音频,多
创意视频媒体 - 874
higgsfield-generate
higgsfield-ai通过Higgsfield AI生成图像/视频。默认:GPT Image 2用于图像/设计/文字,Seedance 2.0用于视频,Nano Banana 2/Pro用于角色/参考图像工作,Marketing Studio用于包含头像/产品/钩子的广告、设置,以及Soul V2/Cinema/Cast/Location和Kling 3.0。使用场景:“生成一张图像”、“制作一段视频”、“让这张照片动起来”、“图像转视频”、“编辑/风格化/混音这张图像”、“制作一个短片”、“创建一则广告”、“制作UGC视频”、“产品演示”、“开箱”、“品牌视频”……
创意媒体视频 - 874
higgsfield-soul-id
higgsfield-ai训练一个灵魂角色——基于个人面部特征的个性化模型,用于Higgsfield生成身份保真的图像和视频。使用场景:“创建我的灵魂”、“训练我的面部”、“制作我的数字分身”、“为我构建头像”、“学习我的外貌”、“创建我的角色”、“为视频设置身份”、“我希望我的脸出现在生成的
创意媒体视频 - 44.2k
hyperframes
heygen-com对于任何制作、创建、编辑、动画或渲染视频、动画或动态图形的请求——包括宣传片、解说视频、带字幕的片段、标题卡、叠加层或任何合成内容——请先阅读此说明。HyperFrames 通过 HTML 渲染视频;这是入口技能,也是智能体创作或编辑视频的默认方式。它会将请求路由到正确的专业工作流程,并指向 HyperFrames 领域技能,因此在尝试任何其他视频或动画技能之前,请先阅读此说明,而不是猜测工作流程。
创意视频媒体 - 44.2k
hyperframes-core
heygen-comHyperFrames HTML 组合合约。用于组合结构、数据属性、剪辑、轨道、子组合、变量、媒体播放、确定性渲染规则以及最小可渲染项目的验证。
开发媒体创意 - 44.2k
hyperframes-media
heygen-com为HyperFrames合成提供资产预处理——多供应商TTS(HeyGen / ElevenLabs / Kokoro本地)、多供应商BGM(Google Lyria / 本地MusicGen)、Whisper转录、背景移除及字幕编写。用于npx hyperframes tts、bgm、transcribe、remove-background、语音/供应商选择、音乐情绪提示、字幕/副标题/歌词/卡拉OK/逐词样式。
媒体音频视频 - 44.2k
hyperframes-read-first
heygen-com对于任何制作、创建、生成、编辑、动画化或渲染视频、动画、动态图形、解说视频、标题卡、叠加层、带字幕视频、产品宣传片、网站视频、公关或更新日志视频、数据蒙太奇、动态海报或HyperFrames HTML合成的请求,请从此处开始。当用户希望HyperFrames创作或渲染完成的MP4/网络视频、选择工作流程,或在产品发布视频、无脸解说视频、网站转视频等之间路由时,请在其他视频或动画技能之前使用此功能。
创意视频媒体 - 74.6k
Image Enhancer
composiohq该技能可处理您的图片和截图,使其更清晰、更锐利、更专业。
媒体 - 43
image-edit
agentspace-so在RunComfy上编辑图像——该技能是一个智能路由,能将用户意图匹配到RunComfy目录中的正确编辑模型。可选择Nano Banana Edit(最多批量处理20张,默认保留身份特征)、OpenAI GPT Image 2 Edit(多语言图像内文本重写、多参考合成、布局精准)、Flux Kontext Pro(单参考高保真局部编辑)或Z-Image Turbo Inpaint(遮罩驱动的精准区域编辑)。该技能整合了每个模型的文档化提示模式,从而...
创意图像媒体 - 6
image-edit
doany-ai在RunComfy上编辑图像——该技能是一个智能路由,能将用户意图匹配到RunComfy目录中的正确编辑模型。可选择Nano Banana Edit(最多批量处理20张,默认保留身份特征)、OpenAI GPT Image 2 Edit(多语言图像内文本重写、多参考合成、布局精准)、Flux Kontext Pro(单参考高保真局部编辑)或Z-Image Turbo Inpaint(遮罩驱动的精准区域编辑)。该技能整合了每个模型的文档化提示模式,从而...
创意图像媒体 - 12
image-edit
runcomfy-com在RunComfy上编辑图像——该技能是一个智能路由,能将用户意图匹配到RunComfy目录中的正确编辑模型。可选择Nano Banana Edit(最多批量处理20张,默认保留身份特征)、OpenAI GPT Image 2 Edit(多语言图像内文本重写、多参考合成、布局精准)、Flux Kontext Pro(单参考高保真局部编辑)或Z-Image Turbo Inpaint(遮罩驱动的精准区域编辑)。该技能整合了每个模型文档中的提示模式,从而...
创意图像媒体 - 43
image-inpainting
agentspace-soMask-driven image inpainting on RunComfy via the `runcomfy` CLI. Routes to Tongyi MAI Z-Image Turbo Inpainting (the dedicated inpainting endpoint with mask, strength, and control-scale) and to identity-preserving edit models (Nano Banana 2 Edit, GPT Image 2 Edit, FLUX Kontext Pro) when a mask isn't available and the region must be described instead. Use for object removal, watermark removal, region replacement, blemish cleanup, and any controlled local edit where a binary mask defines the...
创意图像媒体
第 31–60 个,共 122 个