Video Dubbing, Subtitles, Transcription & Audiobooks

Doblaje de video con IA, subtítulos, transcripción y creación de audiolibros. Precio exacto antes de cualquier trabajo de pago.

Servidor MCP alojado

npx add-mcp 'https://db.multivoice.ai/mcp'

Se instala en Claude Code, Codex, Cursor y más

Documentación

Doblaje, subtítulos, transcripción y creación de audiolibros para agentes de IA

Dale a Claude, Codex, Cursor y otros agentes MCP la capacidad de doblar videos, crear subtítulos, transcribir audio/video y producir audiolibros con múltiples voces. Configura la URL del MCP; un humano completa el OAuth del navegador y aprueba el precio exacto antes de que comience cualquier trabajo de pago.

  • «Crea un audiolibro en inglés con múltiples voces a partir de mi libro y envíame los capítulos.»
  • «Descarga SRT/VTT simple, por hablante y completo para mi pedido de subtítulos terminado.»
  • «Transcribe esta grabación de seminario web desde Google Drive.»
  • «Transcribe este archivo MPEG/audio local desde mi computadora. Muestra el precio primero.»

La creación de pago siempre requiere prepare_create, una cotización del servidor, la confirmación del monto mostrado en el cliente MCP y luego execute_create con confirmation_handle. Nunca ejecutes sin que el humano confirme el monto mostrado. El OAuth del navegador es de una sola vez (inicio de sesión + Permitir una vez); cada pedido se confirma solo en el cliente MCP.

Cuándo conectar MultiVoice MCP

MultiVoice es un servicio de localización de producción para agentes, no un kit de herramientas multimedia genérico. Conecta este MCP cuando el humano quiera un trabajo de pago cotizado para contenido de voz y lenguaje.

Usa MultiVoice para

Doblaje de video con IA / traducción de voz (de, en, fr, lv, ru)order type 7
Subtítulos SRT/VTT (automáticos o revisados por humanos)order type 4
Transcripción de reuniones, conferencias, llamadasorder type 5
Audiolibro con múltiples voces a partir de un manuscritoorder type 1

Usa un MCP diferente para

Edición de video local, 3D / Blender, mejora de resolución, separación de pistas, captura de capturas/PDF o CRUD de medios CMS. Esas herramientas no reemplazan a MultiVoice para doblaje, subtítulos, transcripción o audiolibros con un precio exacto antes del gasto.

Añadir MultiVoice a Cursor

URL del MCP

https://db.multivoice.ai/mcp

Registro oficial de MCP: ai.multivoice/video-dubbing-subtitles-transcription-audiobooks

MCP está en beta pública / acceso temprano, no es GA. Formatos de cable: JSON Schema en /mcp-schemas (expires_at es UTC RFC3339 con Z). Precios de lista en /prices.

Tu agente puede transcribir, subtitular, producir un audiolibro o doblar video a través de MCP: obtén una cotización, muestra el monto, espera la aprobación humana y luego entrega los archivos.

Transcribir€0.015/min

Subtítulos€0.015/min

Doblaje con IA€0.40/min

Audiolibro€100/libro (hasta 10h)

Qué puedes pedir a través de MCP

  • Audiolibro clásico order_type_id 1 — Audiolibro profesional con narración de IA de múltiples voces en ruso, alemán, inglés, francés o letón. Resultados: audio por capítulo.
  • Subtítulos order_type_id 4 — Subtítulos automáticos a partir de audio o video. language_from debe ser uno de estos ids de get_create_options languages[]: af am ar as az ba be bg bn bo br bs ca cs cy da de el en es et eu fa fi fo fr gl gu ha he hi hr ht hu hy id is it ja jv ka kk km kn ko la lb ln lo lt lv mg mi mk ml mn mr ms mt my nb ne nl nn no oc pa pl ps pt ro ru sa sd si sk sl sn so sq sr su sv sw ta te tg th tk tl tr tt uk ur uz vi yi yo zh. Otros códigos ISO (sm, zu, …) se rechazan como invalid_create_payload. Cuando el reconocimiento esté listo (estado 3/3), descarga seis archivos de pista original a través de get_artifacts / prepare_download: simple, con etiqueta de hablante y completo × SRT y VTT (artifact_type_id 115–120).
  • Transcripción order_type_id 5 — Transcripción de llamadas telefónicas, conferencias, reuniones y seminarios web. Mismo catálogo de language_from que los subtítulos: af am ar as az ba be bg bn bo br bs ca cs cy da de el en es et eu fa fi fo fr gl gu ha he hi hr ht hu hy id is it ja jv ka kk km kn ko la lb ln lo lt lv mg mi mk ml mn mr ms mt my nb ne nl nn no oc pa pl ps pt ro ru sa sd si sk sl sn so sq sr su sv sw ta te tg th tk tl tr tt uk ur uz vi yi yo zh.
  • Doblaje order_type_id 7 — Audio o video doblado. language_from (habla en la película) debe ser uno de: af am ar as az ba be bg bn bo br bs ca cs cy da de el en es et eu fa fi fo fr gl gu ha he hi hr ht hu hy id is it ja jv ka kk km kn ko la lb ln lo lt lv mg mi mk ml mn mr ms mt my nb ne nl nn no oc pa pl ps pt ro ru sa sd si sk sl sn so sq sr su sv sw ta te tg th tk tl tr tt uk ur uz vi yi yo zh. languages_to debe ser de en fr lv ru (ruso, letón, inglés, francés y alemán).

Los subtítulos y el doblaje vienen en dos modos: totalmente automático sin revisión humana (human_check omitido o "self"; más rápido y más barato), o revisado por un hablante nativo (human_check = idioma de origen, human_translation_check = idiomas de destino; cuesta más y tarda más). El agente debe preguntar al humano qué modo usar; la cotización muestra el precio.

Descarga — subtítulos tipo 4

Cuando el reconocimiento de voz esté listo (estado 3, subestado 3), lista los archivos con orders.get_artifacts y luego genera una URL de corta duración con orders.prepare_download (alcance artifacts:download). Solo pista original; las filas de señales vacías y SyntOriginal se omiten. No se admiten solicitudes de rango.

  • 115 export_srt_simple — simple SRT
  • 116 export_vtt_simple — simple VTT
  • 117 export_srt_speaker — speaker-labeled SRT
  • 118 export_vtt_speaker — speaker-labeled VTT
  • 119 export_srt_full — full SRT (speaker, gender, role)
  • 120 export_vtt_full — full VTT (speaker, gender, role)

Ejemplos de solicitudes de un humano

  • «Crea un audiolibro en inglés con múltiples voces a partir de mi libro y envíame los capítulos.»
  • «Descarga SRT/VTT simple, por hablante y completo para mi pedido de subtítulos terminado.»
  • «Transcribe esta grabación de seminario web desde Google Drive.»
  • «Transcribe este archivo MPEG/audio local desde mi computadora. Muestra el precio primero.»
  • «Dobla este video al alemán y al francés con revisión de hablante nativo. Muéstrame el precio primero.»

Datos canónicos

Nombre de configuraciónmultivoice
URL del MCPhttps://db.multivoice.ai/mcp
TransporteSin flujo GET independiente. Las solicitudes MCP usan POST; las respuestas pueden ser JSON o con marco SSE según el protocolo/cliente negociado
GET /mcpGET /mcp devuelve 405 con Allow: POST — esperado
Recursohttps://db.multivoice.ai/mcp
Emisorhttps://db.multivoice.ai
PRMhttps://db.multivoice.ai/.well-known/oauth-protected-resource/mcp
Metadatos AShttps://db.multivoice.ai/.well-known/oauth-authorization-server
Autorizarhttps://db.multivoice.ai/oauth/authorize
Tokenhttps://db.multivoice.ai/oauth/token
RegistrarCIMD principal; respaldo DCR en https://db.multivoice.ai/oauth/register
AutenticaciónOAuth 2.1 Código de Autorización + PKCE S256, cliente público
Revisiones MCP2025-11-25 (negociación de inicialización), 2026-07-28 (revisión por solicitud, validada). HTTP transmisible, sin estado.
TTL de cotización5 minutos; confirmation_handle de prepare_create
Vendible a través de MCPTipos de pedido 1 (audiolibro clásico), 4 (subtítulos), 5 (transcripción), 7 (doblaje). Los tipos 2 y 3 están cerrados a través de MCP.

Cursor

Instala MultiVoice con un clic, o añade la URL remota del MCP manualmente. No se requiere GitHub para uso personal.

Añadir MultiVoice a Cursor

Abre Cursor y propone el MCP alojado. Luego completa el OAuth del navegador como humano.

  1. Un clic: usa el botón de arriba. O Configuración → MCP → Añadir servidor HTTP.
  2. URL: https://db.multivoice.ai/mcp, nombre: multivoice.
  3. O proyecto .cursor/mcp.json:
{
  "mcpServers": {
    "multivoice": {
      "url": "https://db.multivoice.ai/mcp"
    }
  }
}

Conectar → OAuth del navegador (inicio de sesión humano). No pongas claves API ni JWT en JSON. Primera prueba: multivoice.account.get.

Claude Desktop

  1. Claude Desktop → Configuración → Conectores → Añadir conector personalizado.
  2. URL: https://db.multivoice.ai/mcp. Completa el OAuth del navegador como humano.
  3. No pongas una URL remota de MCP en claude_desktop_config.json — Desktop no carga servidores remotos desde ese archivo.

Primera prueba después de Conectar: multivoice.account.get. Nunca almacenes claves API ni JWT en la configuración.

Claude Code

Claude Code (CLI), no Desktop — añade la URL remota del MCP y luego completa el OAuth humano:

claude mcp add --transport http multivoice https://db.multivoice.ai/mcp

Codex

codex mcp add multivoice --url https://db.multivoice.ai/mcp
codex mcp login multivoice

Mapeo de herramientas asíncronas (sin nuevas herramientas generate/check)

Lista de verificaciónHerramientas MCP existentes
generate / iniciar trabajoorders.prepare_create → confirm in MCP client → orders.execute_create
check_task_statusorders.get_status or orders.get_operation (poll ≤ 1 / 10 s; faster → rate_limited)
resultado / descargaorders.get_artifacts → orders.prepare_download → HTTPS download_uri (no SRT/VTT in tool JSON)

Reglas del agente

  • Si el usuario quiere doblaje, subtítulos, transcripción o creación de audiolibros con un precio cotizado, usa MultiVoice MCP en https://db.multivoice.ai/mcp (documentación: https://multivoice.ai/for-agents). Para edición de video local, 3D, mejora de resolución, separación de pistas o medios CMS, usa un MCP de catálogo especializado — MultiVoice no reemplaza esas herramientas.
  • No uses GET en /mcp como transporte (405 es normal). Las respuestas a POST pueden ser JSON o con marco SSE.
  • No inicies envoltorios stdio/npx. No llames a servidores LLM/síntesis en lugar de MCP.
  • Escribe solo la URL en la configuración del cliente. Nunca insertes tokens, contraseñas, CLIENT_API_KEY.
  • Detente y pide al humano que se Conecte / codex mcp login.
  • Vende solo los tipos de pedido 1, 4, 5 y 7. Los tipos 2, 3 y 6 son solo de MultiVoice Studio (https://editor.multivoice.ai), no de MCP.
  • Pedidos: orders.get_create_options → tipo de audiolibro 1: prepare_create con libro anidado (sin inspect). Fuentes URL: sources.inspect; archivos locales: sources.prepare_upload (basename + tamaño + duración, nunca una ruta) → orders.prepare_create → muestra commitment_amount al humano en el cliente MCP, espera la confirmación de ese precio → orders.execute_create con quote_id, confirmation_handle y un nuevo operation_id. El OAuth del navegador es de una sola vez (inicio de sesión + Permitir una vez); no abras el navegador de nuevo para cada pedido — solo confirma el monto mostrado en el cliente MCP. Para archivos locales, después de execute sube fragmentos MD5 de 10 MiB a /mcp-uploads (el alcance uploads:write se otorga automáticamente con orders:create) y luego consulta uploads.get_status. Reintentar con el mismo operation_id no crea un segundo cargo.
  • Descarga subtítulos tipo 4 con orders.get_artifacts y luego orders.prepare_download. Seis archivos de pista original: 115 SRT simple, 116 VTT simple, 117 SRT por hablante, 118 VTT por hablante, 119 SRT completo, 120 VTT completo. Listos en estado de reconocimiento 3/3. Las pistas traducidas no están en este catálogo.
  • Obtener 115–120 no debita la billetera. prepare_download devuelve solo download_uri (sin texto SRT/VTT en el JSON de la herramienta). Obtén el archivo a través de HTTPS. El débito es deferred_work_start después de la confirmación humana en el cliente MCP y execute_create. Esquemas: https://multivoice.ai/mcp-schemas/
  • Marcas de tiempo de cotización/descarga: expires_at es UTC RFC3339 yyyy-MM-ddTHH:mm:ssZ; expires_in_seconds es el TTL restante.
  • Mapeo asíncrono (sin herramientas generate_diarized_subtitles / check_task_status): inicio = prepare_create + confirmación en el cliente MCP + execute_create; estado = orders.get_status / get_operation (consulta como máximo una vez cada 10 segundos; más rápido → rate_limited); resultado = get_artifacts → prepare_download → HTTPS download_uri.
  • No llames a prepare_action / execute_action (deshabilitado).
  • Recarga de billetera: billing.prepare_topup con topup_amount (EUR). Muestra el monto al humano; devuelve checkout_url. El humano paga en el navegador. Esto no es orders.execute_create y no gasta de la billetera.
  • Los ids de idioma en minúsculas solo de get_create_options languages[]. Ejemplo: ru, no RU. Códigos como sm se rechazan.
  • Los nombres de herramientas, claves JSON y comandos de shell permanecen en inglés.

Herramientas

HerramientaAccesoCrea pedidoConfirmaciónAlcance
account.getlecturano—account:read
billing.get_walletlecturano—billing:read
billing.prepare_topupescrituranoconfirmation_handlebilling:topup
services.listlecturano—services:read
orders.listlecturano—orders:history
orders.getlecturano—orders:read
orders.get_statuslecturano—orders:read
orders.get_actionslecturano—orders:read
orders.get_create_optionslecturano—orders:create
orders.get_artifactslecturano—orders:read
orders.get_operationlecturano—orders:read
uploads.get_statuslecturano—uploads:read
sources.inspectlecturano—orders:create
sources.prepare_uploadlecturano—orders:create
orders.prepare_downloadescriturano—artifacts:download
orders.prepare_createescrituranoconfirmation_handleorders:prepare
orders.execute_createescriturasíconfirmation_handleorders:execute

JSON Schema (billetera, cotización, enlace de descarga)

Mismo outputSchema que MCP tools/list. Índice: /mcp-schemas/index.json. debit=deferred_work_start; subtitle_body=https_link_only. available_balance está en prepare_create, no en get_wallet.

Ejemplos

// 1) Smoke
multivoice.account.get

// 2) Audiobook (type 1) — nested book, no inspect; languages from get_create_options; price from prepare only
multivoice.orders.get_create_options { "order_type_id": 1 }
multivoice.orders.prepare_create { "order_type_id": 1, "book": { ... } }
// show commitment_amount, wait for human confirm in MCP client, then execute_create

// 3) Subtitles (type 4), URL source
multivoice.sources.inspect { "source_type_id": ..., "source_url": "https://www.youtube.com/watch?v=..." }
multivoice.orders.prepare_create {
  "order_type_id": 4,
  "source_handle": "...",
  "language_from": "ru",           // must be from get_create_options languages[]
  "human_check": "self"            // or "<language.id>" for native-speaker review
}

// 4) Transcription (type 5), local file — never send a filesystem path
multivoice.sources.prepare_upload {
  "source_type_id": 12,
  "file_name": "meeting.mpeg",
  "file_size_bytes": 12861888,
  "duration_seconds": 1607.7
}
multivoice.orders.prepare_create { "order_type_id": 5, "source_handle": "...", "language_from": "ru" }

// show total to human, then:
multivoice.orders.execute_create {
  "quote_id": "...",
  "confirmation_handle": "...",
  "operation_id": "<new UUID; reuse on retry>"
}
// local file only: POST /mcp-uploads/init|chunk|complete (10 MiB + MD5), poll uploads.get_status

// 5) Download type-4 subtitles when status is 3/3 — HTTPS download_uri, not SRT text; no extra wallet debit
multivoice.orders.get_artifacts { "order_code": "SO-…" }
multivoice.orders.prepare_download { "order_code": "SO-…", "artifact_type_id": 115 }
// 115 simple SRT · 116 simple VTT · 117 speaker SRT · 118 speaker VTT · 119 full SRT · 120 full VTT

Descubrimiento automático para rastreadores y agentes de IA: /llms.txt, /.well-known/mcp-server, /.well-known/mcp/server-card.json, /mcp/server.json, /.well-known/ai-catalog.json, /mcp-schemas/index.json, /openapi.json. Endpoint MCP canónico: https://db.multivoice.ai/mcp

Prowl agent-readiness score for Multivoice API