Minimax MCP Tools

Se integra con la API de Minimax para generación de imágenes y conversión de texto a voz impulsadas por IA.

Documentación

Minimax MCP Tools

Banner

Un servidor de Model Context Protocol (MCP) para la integración con Minimax AI, que proporciona generación de imágenes asíncrona y texto a voz con limitación de velocidad avanzada y manejo de errores.

English | 简体中文

Configuración de MCP

Añade a tu configuración de MCP:

{
  "mcpServers": {
    "minimax-mcp-tools": {
      "command": "npx",
      "args": ["minimax-mcp-tools"],
      "env": {
        "MINIMAX_API_KEY": "your_api_key_here"
      }
    }
  }
}

Diseño Asíncrono - Perfecto para Producción de Contenido a Escala

Este servidor MCP utiliza un patrón asíncrono de envío y barrera diseñado para la creación de contenido por lotes:

🎬 Producción de Presentaciones Narradas - Genera docenas de imágenes de diapositivas y la narración correspondiente en paralelo
📚 Creación de Audiolibros Impulsada por IA - Produce capítulos con múltiples voces de personajes simultáneamente
🖼️ Generación de Recursos para Sitios Web - Crea contenido visual consistente y elementos de audio para proyectos web
🎯 Pipelines de Contenido Multimedia - Perfecto para flujos de trabajo de contenido impulsados por LLM que requieren tanto visuales como audio

Beneficios de la Arquitectura:

  1. Fase de Envío: Las herramientas devuelven inmediatamente IDs de tareas, las tareas se ejecutan en segundo plano
  2. Limitación de Velocidad Inteligente: Limitación de velocidad adaptativa (10 RPM imágenes, 20 RPM voz) con capacidad de ráfaga
  3. Sincronización de Barrera: task_barrier espera a todas las tareas y devuelve resultados completos
  4. Optimización de Lotes: Envía múltiples tareas para saturar los límites de velocidad, luego aplica la barrera una vez para obtener el máximo rendimiento

Herramientas

submit_image_generation

Enviar Tarea de Generación de Imágenes - Genera imágenes de forma asíncrona.

Requerido: prompt, outputFile
Opcional: aspectRatio, customSize, seed, subjectReference, style

submit_speech_generation

Enviar Tarea de Generación de Voz - Convierte texto a voz de forma asíncrona.

Requerido: text, outputFile
Opcional: highQuality, voiceId, speed, volume, pitch, emotion, format, sampleRate, bitrate, languageBoost, intensity, timbre, sound_effects

task_barrier

Esperar la Finalización de Tareas - Espera a que TODAS las tareas enviadas se completen y recupera los resultados. Esencial para el procesamiento por lotes.

Arquitectura

sequenceDiagram
    participant User
    participant MCP as MCP Server
    participant TM as Task Manager
    participant API as Minimax API

    Note over User, API: Async Submit-and-Barrier Pattern

    User->>MCP: submit_image_generation(prompt1)
    MCP->>TM: submitImageTask()
    TM-->>MCP: taskId: img-001
    MCP-->>User: "Task img-001 submitted"
    
    par Background Execution (Rate Limited)
        TM->>API: POST /image/generate
        API-->>TM: image data + save file
    end

    User->>MCP: submit_speech_generation(text1)
    MCP->>TM: submitTTSTask()
    TM-->>MCP: taskId: tts-002
    MCP-->>User: "Task tts-002 submitted"
    
    par Background Execution (Rate Limited)
        TM->>API: POST /speech/generate
        API-->>TM: audio data + save file
    end

    User->>MCP: submit_image_generation(prompt2)
    MCP->>TM: submitImageTask()
    TM-->>MCP: taskId: img-003
    MCP-->>User: "Task img-003 submitted"

    par Background Execution (Rate Limited)
        TM->>API: POST /image/generate (queued)
        API-->>TM: image data + save file
    end

    User->>MCP: task_barrier()
    MCP->>TM: barrier()
    TM->>TM: wait for all tasks
    TM-->>MCP: results summary
    MCP-->>User: ✅ All tasks completed<br/>Files available at specified paths

    Note over User, API: Immediate Task Submission + Background Rate-Limited Execution

Licencia

MIT