Minimax MCP Tools
Se integra con la API de Minimax para generación de imágenes y conversión de texto a voz impulsadas por IA.
Documentación
Minimax MCP Tools

Un servidor de Model Context Protocol (MCP) para la integración con Minimax AI, que proporciona generación de imágenes asíncrona y texto a voz con limitación de velocidad avanzada y manejo de errores.
English | 简体中文
Configuración de MCP
Añade a tu configuración de MCP:
{
"mcpServers": {
"minimax-mcp-tools": {
"command": "npx",
"args": ["minimax-mcp-tools"],
"env": {
"MINIMAX_API_KEY": "your_api_key_here"
}
}
}
}
Diseño Asíncrono - Perfecto para Producción de Contenido a Escala
Este servidor MCP utiliza un patrón asíncrono de envío y barrera diseñado para la creación de contenido por lotes:
🎬 Producción de Presentaciones Narradas - Genera docenas de imágenes de diapositivas y la narración correspondiente en paralelo
📚 Creación de Audiolibros Impulsada por IA - Produce capítulos con múltiples voces de personajes simultáneamente
🖼️ Generación de Recursos para Sitios Web - Crea contenido visual consistente y elementos de audio para proyectos web
🎯 Pipelines de Contenido Multimedia - Perfecto para flujos de trabajo de contenido impulsados por LLM que requieren tanto visuales como audio
Beneficios de la Arquitectura:
- Fase de Envío: Las herramientas devuelven inmediatamente IDs de tareas, las tareas se ejecutan en segundo plano
- Limitación de Velocidad Inteligente: Limitación de velocidad adaptativa (10 RPM imágenes, 20 RPM voz) con capacidad de ráfaga
- Sincronización de Barrera:
task_barrierespera a todas las tareas y devuelve resultados completos - Optimización de Lotes: Envía múltiples tareas para saturar los límites de velocidad, luego aplica la barrera una vez para obtener el máximo rendimiento
Herramientas
submit_image_generation
Enviar Tarea de Generación de Imágenes - Genera imágenes de forma asíncrona.
Requerido: prompt, outputFile
Opcional: aspectRatio, customSize, seed, subjectReference, style
submit_speech_generation
Enviar Tarea de Generación de Voz - Convierte texto a voz de forma asíncrona.
Requerido: text, outputFile
Opcional: highQuality, voiceId, speed, volume, pitch, emotion, format, sampleRate, bitrate, languageBoost, intensity, timbre, sound_effects
task_barrier
Esperar la Finalización de Tareas - Espera a que TODAS las tareas enviadas se completen y recupera los resultados. Esencial para el procesamiento por lotes.
Arquitectura
sequenceDiagram
participant User
participant MCP as MCP Server
participant TM as Task Manager
participant API as Minimax API
Note over User, API: Async Submit-and-Barrier Pattern
User->>MCP: submit_image_generation(prompt1)
MCP->>TM: submitImageTask()
TM-->>MCP: taskId: img-001
MCP-->>User: "Task img-001 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /image/generate
API-->>TM: image data + save file
end
User->>MCP: submit_speech_generation(text1)
MCP->>TM: submitTTSTask()
TM-->>MCP: taskId: tts-002
MCP-->>User: "Task tts-002 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /speech/generate
API-->>TM: audio data + save file
end
User->>MCP: submit_image_generation(prompt2)
MCP->>TM: submitImageTask()
TM-->>MCP: taskId: img-003
MCP-->>User: "Task img-003 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /image/generate (queued)
API-->>TM: image data + save file
end
User->>MCP: task_barrier()
MCP->>TM: barrier()
TM->>TM: wait for all tasks
TM-->>MCP: results summary
MCP-->>User: ✅ All tasks completed<br/>Files available at specified paths
Note over User, API: Immediate Task Submission + Background Rate-Limited Execution
Licencia
MIT