Atlas Cloud MCP Server (Image / Video / LLM APIs)

Un potente servidor MCP para APIs de IA de imagen, video y LLM. Integra modelos como Seedance y Nano Banana en tu flujo de trabajo con una interfaz simple y unificada impulsada por Atlas Cloud.

Documentación

Atlas Cloud

Atlas Cloud MCP Server

npm version npm downloads license github stars PRs Welcome

English | 中文 | 日本語 | 한국어 | Español | Français

Usa los más de 300 modelos de imagen / video / LLM de Atlas Cloud en Claude Code, Codex, Gemini CLI, Cursor, Cline y más. Genera imágenes, videos y chat mediante herramientas MCP estándar.

→ Obtén tu clave API gratuita de Atlas Cloud · Más de 300 modelos · Compatible con OpenAI


Modelos Compatibles

  • 🎬 Video (216) — MiniMax H3 Max · MiniMax H3 Fast · Gemini Omni 1.1 Flash · MiniMax H3 · Wan-3.0-Prime · Wan-3.0
  • 🎨 Imagen (138) — GPT Image 2.5 Sunburst · GPT Image 2.5 Flare · Seedream v4.7 · MAI-Image-2.6-Flash
  • 🧊 3D (14) — Seed3D 2.0 · Tripo H3.1 · Hunyuan 3D Rapid · Hunyuan 3D Pro
  • 💬 LLM (77) — DeepSeek V4.1 Flash · DeepSeek V4 Pro 0813 · Grok 4.6 · DeepSeek V4 Flash 0731
  • 🔊 Audio (TTS · Música · ASR) (13) — Seed Audio 1.0 · MiniMax Speech 2.6 Turbo · MiniMax Speech 2.6 HD · xAI TTS v1
  • 📚 Explora más — todos los 490 modelos en vivo »

🎬 Modelos de video más recientes — Seedance 2.5 · Kling 4.0 · Wan 3.0 · Kling Video O3.

Contenido

Lo Que Puedes Hacer

Pídele a tu asistente de IA en lenguaje natural — él descubre el modelo correcto, construye los parámetros y envía la tarea:

  • 🎨 "Crea una imagen principal para esta publicación de blog" — texto a imagen con Nano Banana Pro, GPT Image 2, Flux 2, Seedream, Imagen…
  • 🎬 "Convierte esta foto de producto en un anuncio de 5 segundos" — imagen a video con Seedance 2.5, Kling 3, Kling Video O3, Veo 3.1…
  • 🧊 "Crea un modelo 3D a partir de esta foto" — imagen a 3D / texto a 3D con Hunyuan 3D (salida GLB/OBJ/USDZ)
  • 🔊 "Lee este guion en voz alta" — texto a voz con Seed Audio, ElevenLabs, xAI TTS
  • 🎵 "Escribe una canción temática para mi aplicación" — generación de música con Suno, MiniMax Music
  • 📝 "Transcribe esta grabación de reunión" — voz a texto con Seed ASR, xAI STT
  • 🎞️ "Convierte este guion en un storyboard de 6 tomas" — encadena LLM → imagen → video en una sola conversación
  • ✏️ "Edita esta imagen — añade un sombrero" — sube un archivo local y luego ejecuta un modelo de edición de imágenes
  • 💸 "¿Cuánto crédito queda y cuánto gasté este mes?" — consulta saldo, uso y desglose de costos
  • 💬 "¿Qué hay en esta captura de pantalla?" — chat LLM con Claude, GPT, DeepSeek, Qwen, Gemini, GLM…, incluyendo entrada de imagen/video en los modelos que la aceptan
  • 🕓 "¿Qué generé ayer?" — explora el historial de generaciones y recupera las URLs de salida

Bajo el capó: descubrimiento de modelos, esquemas de parámetros dinámicos por modelo (validados antes de cada solicitud para que los parámetros inválidos fallen rápido sin gastar créditos, más una bandera dry_run en cada herramienta de generación que muestra el cuerpo exacto de la solicitud sin enviarla), carga de medios, generación rápida en un paso, historial de generaciones, saldo de cuenta y uso, y búsqueda en documentación — todo expuesto como herramientas MCP estándar (consulta Herramientas Disponibles).

Las llamadas LLM son conscientes del protocolo: cada modelo se invoca mediante el contrato que realmente declara — OpenAI chat completions, OpenAI Responses, Anthropic Messages o Gemini nativo generateContent — por lo que los modelos nativos de Gemini funcionan sin ningún manejo especial de tu parte.

Inicio Rápido

Requisitos Previos

Consulta .env.example para la variable de entorno a configurar.

Agentes CLI (instalación en una línea)

El camino más rápido — estos agentes de codificación de IA añaden el servidor con un solo comando:

# Claude Code
claude mcp add atlascloud -- npx -y atlascloud-mcp

# OpenAI Codex CLI
codex mcp add atlascloud -- npx -y atlascloud-mcp

# Gemini CLI
gemini mcp add atlascloud -- npx -y atlascloud-mcp

# Goose CLI
goose mcp add atlascloud -- npx -y atlascloud-mcp

Configura primero la variable de entorno ATLASCLOUD_API_KEY en tu shell.

IDEs, editores y extensiones (configuración JSON)

Añade esto a la configuración MCP de tu cliente — funciona con cualquier cliente compatible con MCP:

{
  "mcpServers": {
    "atlascloud": {
      "command": "npx",
      "args": ["-y", "atlascloud-mcp"],
      "env": {
        "ATLASCLOUD_API_KEY": "your-api-key-here"
      }
    }
  }
}
ClienteDónde añadirlo
CursorConfiguración → MCP → Añadir Servidor
ClineMCP Marketplace → Añadir Servidor
Continueconfig.yaml → MCP
WindsurfConfiguración → MCP → Añadir Servidor
VS Code (Copilot).vscode/mcp.json o Configuración → MCP
TraeConfiguración → MCP → Añadir Servidor
JetBrains IDEsConfiguración → Herramientas → Asistente de IA → MCP
ChatGPT DesktopConfiguración → MCP
Amazon Q DeveloperConfiguración MCP
Roo CodeConfiguración → MCP → Añadir Servidor

¿Prefieres Skills?

Si prefieres usar Skills en lugar de MCP, también ofrecemos un paquete Atlas Cloud Skills para Claude Code y otros agentes compatibles con skills.

Herramientas Disponibles

HerramientaDescripción
atlas_search_docsBusca en la documentación y modelos de Atlas Cloud por palabra clave
atlas_list_modelsLista los modelos disponibles, filtrados por tipo (Texto/Imagen/Video/Audio), sub-tipo (3d/tts/stt/music/lyrics) o palabra clave
atlas_get_model_infoObtén información detallada del modelo, incluyendo esquema de API, parámetros y ejemplos de uso
atlas_generate_imageGenera imágenes y modelos 3D (imagen a 3D / texto a 3D) con cualquier modelo de Imagen compatible
atlas_generate_videoGenera videos con cualquier modelo de video compatible
atlas_generate_audioGenera audio — voz (TTS) y música/canciones (Suno, MiniMax Music) — con cualquier modelo de audio compatible
atlas_transcribe_audioTranscribe voz a texto (ASR) — reuniones, entrevistas, notas de voz
atlas_quick_generateGeneración de imagen/video/audio en un paso — encuentra automáticamente el modelo por palabra clave, construye los parámetros y envía
atlas_upload_mediaSube una imagen, audio, video o documento local y obtén una URL para pasarla a cualquier modelo
atlas_chatChatea con modelos LLM — el endpoint y el formato de solicitud se eligen automáticamente por modelo (OpenAI chat/responses, Anthropic messages, Gemini nativo); admite entrada de imagen/video/audio
atlas_get_predictionVerifica el estado y resultado de una tarea de generación — URLs de medios, transcripciones, letras, portadas y costo
atlas_list_predictionsExplora tareas de generación anteriores — recupera un ID de predicción perdido o revisa resultados anteriores
atlas_get_balanceObtén el saldo de cuenta y resumen de crédito para tu clave API
atlas_get_model_usageObtén el uso diario de modelos (solicitudes, tokens, conteos de imagen/video) en un rango de fechas
atlas_get_model_costsObtén los rangos de costo diario por modelo (gasto) en un rango de fechas

Ejemplos de Uso

Buscar modelos

"Busca en Atlas Cloud modelos de generación de video"

Tu asistente de IA usará atlas_search_docs o atlas_list_models para encontrar los modelos relevantes.

Generar una imagen

"Genera una imagen de un gato en el espacio usando Seedream"

El asistente:

  1. Usará atlas_list_models para encontrar los modelos de imagen Seedream
  2. Usará atlas_get_model_info para obtener los parámetros del modelo
  3. Usará atlas_generate_image con los parámetros correctos

Generar un video

"Crea un video de un lanzamiento de cohete usando Kling v3"

El asistente:

  1. Encontrará el modelo de video Kling
  2. Obtendrá su esquema para entender los parámetros requeridos
  3. Usará atlas_generate_video con los parámetros apropiados

Subir una imagen local para edición o generación de video

"Edita esta imagen /Users/me/photos/cat.jpg para añadirle un sombrero"

El asistente:

  1. Usará atlas_upload_media para subir el archivo local y obtener una URL
  2. Encontrará un modelo de edición de imágenes
  3. Usará atlas_generate_image con la URL subida

Nota: Los archivos subidos son solo para uso temporal con tareas de generación de Atlas Cloud. Los archivos pueden eliminarse periódicamente. No lo uses como alojamiento permanente de archivos — el abuso puede resultar en la suspensión de la clave API.

Generar voz (TTS)

"Lee esta frase en voz alta con Seed Audio: Bienvenido a Atlas Cloud"

El asistente:

  1. Usará atlas_list_models con type="Audio" para encontrar el modelo TTS
  2. Usará atlas_generate_audio con el texto a sintetizar
  3. Usará atlas_get_prediction para recuperar la URL del audio generado

Generar música

"Crea una pista synthwave alegre de 30 segundos para mi demo de producto con Suno"

Los modelos de música (Suno Chirp, MiniMax Music) son modelos de tipo Audio, por lo que el asistente usa atlas_generate_audio con una descripción de canción (y opcionalmente letras), luego recupera la URL del audio mediante atlas_get_prediction.

Transcribir audio (voz a texto)

"Transcribe esta grabación de entrevista: https://example.com/interview.mp3 "

El asistente usa atlas_transcribe_audio con un modelo de voz a texto (por ejemplo, bytedance/seed-asr-2.0) y el audio_url, luego recupera la transcripción mediante atlas_get_prediction. Para archivos locales, primero llama a atlas_upload_media para obtener una URL.

Generar un modelo 3D

"Convierte esta foto de producto en un modelo 3D con Hunyuan 3D"

Los modelos 3D son de tipo Imagen, por lo que el asistente usa atlas_generate_image con el parámetro image y recupera un archivo GLB/OBJ/USDZ mediante atlas_get_prediction.

Chatear con un LLM

"Pídele a Qwen que explique la computación cuántica"

El asistente usará atlas_chat con el modelo Qwen. Para un modelo que acepte imágenes o video, adjúntalos al mensaje y se convertirán automáticamente al protocolo de ese modelo.

Verificar una llamada antes de pagar por ella

"Muéstrame exactamente lo que enviarías a Kling para esto, no lo ejecutes aún"

Cada herramienta de generación acepta dry_run: true — resuelve el modelo, construye la solicitud, la valida contra el esquema del modelo, imprime el cuerpo JSON exacto y se detiene. No se envía nada y no se cobra nada. Útil cuando una URL de medio podría ir a más de un campo de entrada, o cuando una palabra clave podría coincidir con varios modelos.

Encontrar una generación anterior

"¿Qué generé ayer? Dame el enlace del video otra vez"

El asistente usa atlas_list_predictions para listar tareas recientes y atlas_get_prediction para el resultado completo. Así también se recupera una tarea cuyo ID de predicción se perdió — el trabajo continúa ejecutándose (y se cobra) incluso si la llamada de envío expiró.

Verificar saldo y uso

"¿Cuánto crédito de Atlas Cloud me queda y cuánto gasté este mes?"

El asistente usará atlas_get_balance para el saldo actual y atlas_get_model_costs para el desglose de gastos.

Desarrollo

# Install dependencies
npm install

# Build
npm run build

# Run in development mode
npm run dev

Más Herramientas de Atlas Cloud