Atlas Cloud MCP Server (Image / Video / LLM APIs)
Un potente servidor MCP para APIs de IA de imagen, video y LLM. Integra modelos como Seedance y Nano Banana en tu flujo de trabajo con una interfaz simple y unificada impulsada por Atlas Cloud.
Documentación
Atlas Cloud MCP Server
English | 中文 | 日本語 | 한국어 | Español | Français
Usa los más de 300 modelos de imagen / video / LLM de Atlas Cloud en Claude Code, Codex, Gemini CLI, Cursor, Cline y más. Genera imágenes, videos y chat mediante herramientas MCP estándar.
→ Obtén tu clave API gratuita de Atlas Cloud · Más de 300 modelos · Compatible con OpenAI
Modelos Compatibles
- 🎬 Video (216) — MiniMax H3 Max · MiniMax H3 Fast · Gemini Omni 1.1 Flash · MiniMax H3 · Wan-3.0-Prime · Wan-3.0
- 🎨 Imagen (138) — GPT Image 2.5 Sunburst · GPT Image 2.5 Flare · Seedream v4.7 · MAI-Image-2.6-Flash
- 🧊 3D (14) — Seed3D 2.0 · Tripo H3.1 · Hunyuan 3D Rapid · Hunyuan 3D Pro
- 💬 LLM (77) — DeepSeek V4.1 Flash · DeepSeek V4 Pro 0813 · Grok 4.6 · DeepSeek V4 Flash 0731
- 🔊 Audio (TTS · Música · ASR) (13) — Seed Audio 1.0 · MiniMax Speech 2.6 Turbo · MiniMax Speech 2.6 HD · xAI TTS v1
- 📚 Explora más — todos los 490 modelos en vivo »
🎬 Modelos de video más recientes — Seedance 2.5 · Kling 4.0 · Wan 3.0 · Kling Video O3.
Contenido
Lo Que Puedes Hacer
Pídele a tu asistente de IA en lenguaje natural — él descubre el modelo correcto, construye los parámetros y envía la tarea:
- 🎨 "Crea una imagen principal para esta publicación de blog" — texto a imagen con Nano Banana Pro, GPT Image 2, Flux 2, Seedream, Imagen…
- 🎬 "Convierte esta foto de producto en un anuncio de 5 segundos" — imagen a video con Seedance 2.5, Kling 3, Kling Video O3, Veo 3.1…
- 🧊 "Crea un modelo 3D a partir de esta foto" — imagen a 3D / texto a 3D con Hunyuan 3D (salida GLB/OBJ/USDZ)
- 🔊 "Lee este guion en voz alta" — texto a voz con Seed Audio, ElevenLabs, xAI TTS
- 🎵 "Escribe una canción temática para mi aplicación" — generación de música con Suno, MiniMax Music
- 📝 "Transcribe esta grabación de reunión" — voz a texto con Seed ASR, xAI STT
- 🎞️ "Convierte este guion en un storyboard de 6 tomas" — encadena LLM → imagen → video en una sola conversación
- ✏️ "Edita esta imagen — añade un sombrero" — sube un archivo local y luego ejecuta un modelo de edición de imágenes
- 💸 "¿Cuánto crédito queda y cuánto gasté este mes?" — consulta saldo, uso y desglose de costos
- 💬 "¿Qué hay en esta captura de pantalla?" — chat LLM con Claude, GPT, DeepSeek, Qwen, Gemini, GLM…, incluyendo entrada de imagen/video en los modelos que la aceptan
- 🕓 "¿Qué generé ayer?" — explora el historial de generaciones y recupera las URLs de salida
Bajo el capó: descubrimiento de modelos, esquemas de parámetros dinámicos por modelo (validados antes de cada solicitud para que los parámetros inválidos fallen rápido sin gastar créditos, más una bandera dry_run en cada herramienta de generación que muestra el cuerpo exacto de la solicitud sin enviarla), carga de medios, generación rápida en un paso, historial de generaciones, saldo de cuenta y uso, y búsqueda en documentación — todo expuesto como herramientas MCP estándar (consulta Herramientas Disponibles).
Las llamadas LLM son conscientes del protocolo: cada modelo se invoca mediante el contrato que realmente declara — OpenAI chat completions, OpenAI Responses, Anthropic Messages o Gemini nativo generateContent — por lo que los modelos nativos de Gemini funcionan sin ningún manejo especial de tu parte.
Inicio Rápido
Requisitos Previos
- Node.js >= 18
- Clave API de Atlas Cloud — Obtén una gratis en atlascloud.ai
Consulta .env.example para la variable de entorno a configurar.
Agentes CLI (instalación en una línea)
El camino más rápido — estos agentes de codificación de IA añaden el servidor con un solo comando:
# Claude Code
claude mcp add atlascloud -- npx -y atlascloud-mcp
# OpenAI Codex CLI
codex mcp add atlascloud -- npx -y atlascloud-mcp
# Gemini CLI
gemini mcp add atlascloud -- npx -y atlascloud-mcp
# Goose CLI
goose mcp add atlascloud -- npx -y atlascloud-mcp
Configura primero la variable de entorno
ATLASCLOUD_API_KEYen tu shell.
IDEs, editores y extensiones (configuración JSON)
Añade esto a la configuración MCP de tu cliente — funciona con cualquier cliente compatible con MCP:
{
"mcpServers": {
"atlascloud": {
"command": "npx",
"args": ["-y", "atlascloud-mcp"],
"env": {
"ATLASCLOUD_API_KEY": "your-api-key-here"
}
}
}
}
| Cliente | Dónde añadirlo |
|---|---|
| Cursor | Configuración → MCP → Añadir Servidor |
| Cline | MCP Marketplace → Añadir Servidor |
| Continue | config.yaml → MCP |
| Windsurf | Configuración → MCP → Añadir Servidor |
| VS Code (Copilot) | .vscode/mcp.json o Configuración → MCP |
| Trae | Configuración → MCP → Añadir Servidor |
| JetBrains IDEs | Configuración → Herramientas → Asistente de IA → MCP |
| ChatGPT Desktop | Configuración → MCP |
| Amazon Q Developer | Configuración MCP |
| Roo Code | Configuración → MCP → Añadir Servidor |
¿Prefieres Skills?
Si prefieres usar Skills en lugar de MCP, también ofrecemos un paquete Atlas Cloud Skills para Claude Code y otros agentes compatibles con skills.
Herramientas Disponibles
| Herramienta | Descripción |
|---|---|
atlas_search_docs | Busca en la documentación y modelos de Atlas Cloud por palabra clave |
atlas_list_models | Lista los modelos disponibles, filtrados por tipo (Texto/Imagen/Video/Audio), sub-tipo (3d/tts/stt/music/lyrics) o palabra clave |
atlas_get_model_info | Obtén información detallada del modelo, incluyendo esquema de API, parámetros y ejemplos de uso |
atlas_generate_image | Genera imágenes y modelos 3D (imagen a 3D / texto a 3D) con cualquier modelo de Imagen compatible |
atlas_generate_video | Genera videos con cualquier modelo de video compatible |
atlas_generate_audio | Genera audio — voz (TTS) y música/canciones (Suno, MiniMax Music) — con cualquier modelo de audio compatible |
atlas_transcribe_audio | Transcribe voz a texto (ASR) — reuniones, entrevistas, notas de voz |
atlas_quick_generate | Generación de imagen/video/audio en un paso — encuentra automáticamente el modelo por palabra clave, construye los parámetros y envía |
atlas_upload_media | Sube una imagen, audio, video o documento local y obtén una URL para pasarla a cualquier modelo |
atlas_chat | Chatea con modelos LLM — el endpoint y el formato de solicitud se eligen automáticamente por modelo (OpenAI chat/responses, Anthropic messages, Gemini nativo); admite entrada de imagen/video/audio |
atlas_get_prediction | Verifica el estado y resultado de una tarea de generación — URLs de medios, transcripciones, letras, portadas y costo |
atlas_list_predictions | Explora tareas de generación anteriores — recupera un ID de predicción perdido o revisa resultados anteriores |
atlas_get_balance | Obtén el saldo de cuenta y resumen de crédito para tu clave API |
atlas_get_model_usage | Obtén el uso diario de modelos (solicitudes, tokens, conteos de imagen/video) en un rango de fechas |
atlas_get_model_costs | Obtén los rangos de costo diario por modelo (gasto) en un rango de fechas |
Ejemplos de Uso
Buscar modelos
"Busca en Atlas Cloud modelos de generación de video"
Tu asistente de IA usará atlas_search_docs o atlas_list_models para encontrar los modelos relevantes.
Generar una imagen
"Genera una imagen de un gato en el espacio usando Seedream"
El asistente:
- Usará
atlas_list_modelspara encontrar los modelos de imagen Seedream - Usará
atlas_get_model_infopara obtener los parámetros del modelo - Usará
atlas_generate_imagecon los parámetros correctos
Generar un video
"Crea un video de un lanzamiento de cohete usando Kling v3"
El asistente:
- Encontrará el modelo de video Kling
- Obtendrá su esquema para entender los parámetros requeridos
- Usará
atlas_generate_videocon los parámetros apropiados
Subir una imagen local para edición o generación de video
"Edita esta imagen /Users/me/photos/cat.jpg para añadirle un sombrero"
El asistente:
- Usará
atlas_upload_mediapara subir el archivo local y obtener una URL - Encontrará un modelo de edición de imágenes
- Usará
atlas_generate_imagecon la URL subida
Nota: Los archivos subidos son solo para uso temporal con tareas de generación de Atlas Cloud. Los archivos pueden eliminarse periódicamente. No lo uses como alojamiento permanente de archivos — el abuso puede resultar en la suspensión de la clave API.
Generar voz (TTS)
"Lee esta frase en voz alta con Seed Audio: Bienvenido a Atlas Cloud"
El asistente:
- Usará
atlas_list_modelscontype="Audio"para encontrar el modelo TTS - Usará
atlas_generate_audiocon el texto a sintetizar - Usará
atlas_get_predictionpara recuperar la URL del audio generado
Generar música
"Crea una pista synthwave alegre de 30 segundos para mi demo de producto con Suno"
Los modelos de música (Suno Chirp, MiniMax Music) son modelos de tipo Audio, por lo que el asistente usa atlas_generate_audio con una descripción de canción (y opcionalmente letras), luego recupera la URL del audio mediante atlas_get_prediction.
Transcribir audio (voz a texto)
"Transcribe esta grabación de entrevista: https://example.com/interview.mp3 "
El asistente usa atlas_transcribe_audio con un modelo de voz a texto (por ejemplo, bytedance/seed-asr-2.0) y el audio_url, luego recupera la transcripción mediante atlas_get_prediction. Para archivos locales, primero llama a atlas_upload_media para obtener una URL.
Generar un modelo 3D
"Convierte esta foto de producto en un modelo 3D con Hunyuan 3D"
Los modelos 3D son de tipo Imagen, por lo que el asistente usa atlas_generate_image con el parámetro image y recupera un archivo GLB/OBJ/USDZ mediante atlas_get_prediction.
Chatear con un LLM
"Pídele a Qwen que explique la computación cuántica"
El asistente usará atlas_chat con el modelo Qwen. Para un modelo que acepte imágenes o video, adjúntalos al mensaje y se convertirán automáticamente al protocolo de ese modelo.
Verificar una llamada antes de pagar por ella
"Muéstrame exactamente lo que enviarías a Kling para esto, no lo ejecutes aún"
Cada herramienta de generación acepta dry_run: true — resuelve el modelo, construye la solicitud, la valida contra el esquema del modelo, imprime el cuerpo JSON exacto y se detiene. No se envía nada y no se cobra nada. Útil cuando una URL de medio podría ir a más de un campo de entrada, o cuando una palabra clave podría coincidir con varios modelos.
Encontrar una generación anterior
"¿Qué generé ayer? Dame el enlace del video otra vez"
El asistente usa atlas_list_predictions para listar tareas recientes y atlas_get_prediction para el resultado completo. Así también se recupera una tarea cuyo ID de predicción se perdió — el trabajo continúa ejecutándose (y se cobra) incluso si la llamada de envío expiró.
Verificar saldo y uso
"¿Cuánto crédito de Atlas Cloud me queda y cuánto gasté este mes?"
El asistente usará atlas_get_balance para el saldo actual y atlas_get_model_costs para el desglose de gastos.
Desarrollo
# Install dependencies
npm install
# Build
npm run build
# Run in development mode
npm run dev
Más Herramientas de Atlas Cloud
- 🧰 ¿Quieres usarlo desde la terminal? → atlascloud-cli
- 🤖 ¿Quieres usarlo en Claude Code / Cursor? → Atlas Cloud MCP Server
- 🎬 ¿Lo quieres como Skill de Claude Code / Codex / Gemini CLI? → atlas-cloud-skills
- 🎨 Nodos ComfyUI → atlascloud_comfyui
- 🔁 Nodos n8n → n8n-nodes-atlascloud
- 💬 Únete a nuestro Discord → discord.gg/MWmMr4q9es
- 🌐 Sitio web → atlascloud.ai