Minimax MCP Tools
Integra com a API Minimax para geração de imagens e conversão de texto em fala com tecnologia de IA.
Documentação
Ferramentas MCP da Minimax

Um servidor Model Context Protocol (MCP) para integração com a Minimax AI, fornecendo geração assíncrona de imagens e conversão de texto em fala com controle avançado de limite de taxa e tratamento de erros.
English | 简体中文
Configuração do MCP
Adicione às suas configurações do MCP:
{
"mcpServers": {
"minimax-mcp-tools": {
"command": "npx",
"args": ["minimax-mcp-tools"],
"env": {
"MINIMAX_API_KEY": "your_api_key_here"
}
}
}
}
Design Assíncrono - Perfeito para Produção de Conteúdo em Escala
Este servidor MCP utiliza um padrão assíncrono de envio e barreira projetado para criação de conteúdo em lote:
🎬 Produção de Apresentações Narradas - Gere dezenas de imagens de slides e narrações correspondentes em paralelo
📚 Criação de Audiobooks com IA - Produza capítulos com múltiplas vozes de personagens simultaneamente
🖼️ Geração de Ativos para Sites - Crie conteúdo visual consistente e elementos de áudio para projetos web
🎯 Pipelines de Conteúdo Multimídia - Perfeito para fluxos de trabalho de conteúdo orientados por LLM que exigem visuais e áudio
Benefícios da Arquitetura:
- Fase de Envio: As ferramentas retornam imediatamente com IDs de tarefas, que são executadas em segundo plano
- Limite de Taxa Inteligente: Limite de taxa adaptativo (10 RPM para imagens, 20 RPM para fala) com capacidade de rajada
- Sincronização por Barreira:
task_barrieraguarda todas as tarefas e retorna resultados abrangentes - Otimização de Lote: Envie múltiplas tarefas para saturar os limites de taxa e, em seguida, aplique a barreira uma única vez para máxima produtividade
Ferramentas
submit_image_generation
Enviar Tarefa de Geração de Imagem - Gere imagens de forma assíncrona.
Obrigatório: prompt, outputFile
Opcional: aspectRatio, customSize, seed, subjectReference, style
submit_speech_generation
Enviar Tarefa de Geração de Fala - Converta texto em fala de forma assíncrona.
Obrigatório: text, outputFile
Opcional: highQuality, voiceId, speed, volume, pitch, emotion, format, sampleRate, bitrate, languageBoost, intensity, timbre, sound_effects
task_barrier
Aguardar Conclusão de Tarefas - Aguarde a conclusão de TODAS as tarefas enviadas e recupere os resultados. Essencial para processamento em lote.
Arquitetura
sequenceDiagram
participant User
participant MCP as MCP Server
participant TM as Task Manager
participant API as Minimax API
Note over User, API: Async Submit-and-Barrier Pattern
User->>MCP: submit_image_generation(prompt1)
MCP->>TM: submitImageTask()
TM-->>MCP: taskId: img-001
MCP-->>User: "Task img-001 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /image/generate
API-->>TM: image data + save file
end
User->>MCP: submit_speech_generation(text1)
MCP->>TM: submitTTSTask()
TM-->>MCP: taskId: tts-002
MCP-->>User: "Task tts-002 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /speech/generate
API-->>TM: audio data + save file
end
User->>MCP: submit_image_generation(prompt2)
MCP->>TM: submitImageTask()
TM-->>MCP: taskId: img-003
MCP-->>User: "Task img-003 submitted"
par Background Execution (Rate Limited)
TM->>API: POST /image/generate (queued)
API-->>TM: image data + save file
end
User->>MCP: task_barrier()
MCP->>TM: barrier()
TM->>TM: wait for all tasks
TM-->>MCP: results summary
MCP-->>User: ✅ All tasks completed<br/>Files available at specified paths
Note over User, API: Immediate Task Submission + Background Rate-Limited Execution
Licença
MIT