Brainiall TTS MCP
Servidor MCP de texto a voz alojado con 54 voces neuronales en 9 idiomas, incluido el portugués brasileño, con autenticación mediante clave API y facturación de pago por uso.
Documentación
Servidor MCP Brainiall TTS
Texto a voz alojado para agentes de IA mediante el Protocolo de Contexto de Modelo.
54 voces neuronales, 9 idiomas — incluyendo portugués brasileño nativo (pf_dora, pm_alex, pm_santa) — servido desde una API alojada de pago por uso. Sin GPU, sin descargas de modelos, sin suscripción a ElevenLabs: trae una clave de API y paga $0.008 por cada 1.000 caracteres ($10 de crédito gratis al registrarte).
Por qué este servidor
Cualquier otro servidor MCP de TTS o ejecuta modelos localmente (pesado, lento de configurar) o envuelve una clave de terceros por la que ya pagas una suscripción. Este es una API alojada y medida:
- Cero configuración — servidor remoto, nada que instalar
- Pago por uso — $0.008/1K caracteres, facturado contra tu saldo de Brainiall
- $10 de crédito gratis — regístrate en app.brainiall.com
- Salida WAV — PCM de 16 bits, 24 kHz mono, devuelto como contenido de audio MCP reproducible o JSON en base64
Inicio rápido
Obtén una clave de API en app.brainiall.com ($10 de crédito de bienvenida, sin tarjeta requerida).
VS Code / GitHub Copilot
El botón instala el servidor remoto en modo de descubrimiento, para que VS Code pueda listar sus herramientas sin un secreto. La síntesis aún falla de forma segura hasta que agregues tu clave de API de Brainiall. Para una configuración de espacio de trabajo segura que solicite una vez y almacene la clave en el almacenamiento de secretos de VS Code, copia .vscode/mcp.json en tu proyecto o clona este repositorio, luego inicia brainiallTts desde MCP: Listar Servidores.
{
"inputs": [
{
"type": "promptString",
"id": "brainiall-api-key",
"description": "Brainiall API key",
"password": true
}
],
"servers": {
"brainiallTts": {
"type": "http",
"url": "https://api.brainiall.com/mcp/tts/mcp",
"headers": {
"Authorization": "Bearer ${input:brainiall-api-key}"
}
}
}
}
Después de que el servidor se inicie, prueba:
Usa Brainiall TTS para listar las voces en portugués brasileño, luego lee "Olá do VS Code" con
pf_dora.
El formato de URL de instalación y la configuración de entrada de secretos siguen la guía oficial de MCP de VS Code y la referencia de configuración.
Agente en la nube de GitHub Copilot
Usa la configuración de servidor remoto restringida para el agente en la nube de Copilot o la revisión de código de Copilot. Permite las tres herramientas de Brainiall y resuelve el token Bearer desde el secreto COPILOT_MCP_BRAINIALL_API_KEY de Agents del repositorio; no se confirma ninguna clave de API.
Continue (VS Code / JetBrains)
Copia el bloque MCP de Continue listo para usar
a .continue/mcpServers/brainiall-tts.yaml, luego pon
BRAINIALL_API_KEY=your-key en .continue/.env. Mantén ese archivo .env fuera
del control de versiones.
El bloque usa el transporte streamable-http compatible con Continue y resuelve
la clave mediante ${{ secrets.BRAINIALL_API_KEY }}; no se confirma ninguna credencial.
Consulta la configuración y prueba de humo de Continue.
Constructores de Dify
Para un flujo de trabajo de voz en Dify, usa el proveedor de voz BRAINIALL de código abierto y mantén la clave de API en el almacén de credenciales de Dify. La ruta de intención acotada de Dify explica el límite de propiedad del llamador; no es una asociación con Dify ni una garantía de comportamiento en producción.
Servidor remoto (recomendado — nada que instalar)
CLI de Codex / IDE / aplicación de escritorio de ChatGPT
Usa la configuración de Codex con ámbito de proyecto. Lee
BRAINIALL_API_KEY del entorno, permite las tres herramientas de Brainiall
y solicita confirmación antes de cada llamada.
Claude Code
Usa la configuración de Claude Code respaldada por entorno. Mantiene la clave fuera de .mcp.json, limita el servidor al proyecto actual y documenta el límite de datos externos y uso medido.
Claude Desktop / cualquier cliente con configuración estilo .mcp.json
{
"mcpServers": {
"brainiall-tts": {
"type": "http",
"url": "https://api.brainiall.com/mcp/tts/mcp",
"headers": {
"Authorization": "Bearer YOUR_BRAINIALL_API_KEY"
}
}
}
}
Cursor (~/.cursor/mcp.json)
{
"mcpServers": {
"brainiall-tts": {
"url": "https://api.brainiall.com/mcp/tts/mcp",
"headers": {
"Authorization": "Bearer YOUR_BRAINIALL_API_KEY"
}
}
}
}
LM Studio
Usa el enlace directo oficial de un clic y el límite explícito de privacidad del modelo local en la guía de configuración de LM Studio.
OpenCode v2
Usa el esquema de servidor remoto y el encabezado Bearer respaldado por entorno en la guía de configuración de OpenCode v2.
Msty Studio
Usa la guía de campo manual de Msty Studio para una conexión HTTP Streamable. El archivo de referencia no se presenta como una integración oficial ni un ajuste preestablecido de importación.
Interfaz de chat de Hugging Face (autoalojada)
Usa el ejemplo de MCP_SERVERS de administrador
y un modelo capaz de usar herramientas. La guía documenta el límite de clave compartida para servidores
base.
Clientes que requieren /v1/audio/speech
Usa el adaptador TTS parcial con forma de OpenAI sin dependencias cuando un cliente pueda configurar una ruta de voz estilo OpenAI pero no pueda llamar al endpoint nativo de Brainiall. El adaptador devuelve solo WAV, declara la frecuencia de muestreo observada en el encabezado WAV, nunca reintenta una solicitud medida y documenta los límites exactos de compatibilidad. Es un adaptador de referencia local, no una afirmación de que la API alojada de Brainiall sea nativamente compatible con OpenAI.
Ejecutar localmente (sin stdio, aún llama a la API alojada)
El servidor en sí es un envoltorio delgado: puedes autoalojarlo y hará proxy a api.brainiall.com con tu clave:
docker build -t brainiall-tts-mcp .
docker run -p 8080:8080 -e APIM_KEY=YOUR_BRAINIALL_API_KEY brainiall-tts-mcp
# MCP endpoint: http://localhost:8080/mcp
Herramientas
| Herramienta | Descripción | Costo |
|---|---|---|
synthesize_speech | Convierte texto (≤5000 caracteres) a voz WAV. Parámetros: text, language (predeterminado pt), voice, speed (0.5–2.0), output_format (audio | base64_json) | $0.008/1K caracteres |
list_voices | Catálogo completo de voces con idioma, género, acento, grado de calidad. Filtro opcional language | gratis |
check_tts_service | Estado de salud del backend | gratis |
Voces
| Idioma | Voces |
|---|---|
| Portugués (BR) | pf_dora, pm_alex, pm_santa |
| Inglés (EE. UU.) | af_heart, af_bella, af_nova, am_adam, am_michael + 14 más |
| Inglés (GB) | bf_alice, bf_emma, bm_daniel, bm_george + 4 más |
| Español | ef_dora, em_alex, em_santa |
| Francés | ff_siwis, fm_gilles |
| Italiano | if_sara, im_nicola |
| Hindi | hf_alpha, hf_beta, hm_omega, hm_psi |
| Japonés | jf_alpha, jf_gongitsune, jm_kumo + 2 más |
| Mandarín | zf_xiaoxiao, zm_yunxi + 6 más |
Ejemplo
Pregunta a tu agente:
"Lee este párrafo en voz alta en portugués brasileño con una voz femenina"
El agente llama a synthesize_speech(text=..., language="pt", voice="pf_dora") y recibe audio WAV reproducible.
Para indicaciones listas para copiar y pruebas de humo para narración, accesibilidad, práctica de idiomas y alertas de agentes, consulta Recetas de flujos de trabajo de agentes.
Para pruebas y automatización con clientes REST, importa la colección de Postman. Contiene pruebas de humo de salud, lista de voces y síntesis de dos caracteres, y mantiene la clave de API en una variable de colección en lugar de en la URL de la solicitud.
Para automatización sin código, importa el flujo de trabajo de texto a WAV de n8n. Usa la credencial de Autenticación de Encabezado de n8n en lugar de incrustar una clave en el flujo de trabajo, envía campos editables de texto, voz y velocidad a la API alojada, y devuelve el WAV en la propiedad binaria speech. La plantilla está validada estáticamente; selecciona tu credencial y ejecútala en tu propia instancia de n8n para validar la integración en vivo.
Para generación de código, clientes de API y descubrimiento de directorios, usa la especificación OpenAPI 3.1 legible por máquina. La especificación documenta el catálogo de voces autenticado y los endpoints de síntesis WAV sin incrustar una clave de API.
Autenticación y facturación
Pasa tu clave de API de Brainiall como token Bearer (consulta las configuraciones anteriores). El uso se mide por carácter contra el saldo de tu cuenta: la misma clave funciona en todas las API de Brainiall (STT, OCR, NLP, imagen y más en brainiall.com).
Endpoints
- MCP (HTTP Streamable):
https://api.brainiall.com/mcp/tts/mcp - Salud:
https://api.brainiall.com/mcp/tts/health - API REST subyacente:
POST https://api.brainiall.com/v1/tts/synthesize
Licencia
MIT