Speak AI
Conecta Claude, ChatGPT, Cursor y Windsurf a tu espacio de trabajo de Speak AI: transcribe, puntúa, busca y actúa sobre cada conversación (107 herramientas, MIT).
Documentación
Conecta Speak AI a Claude o ChatGPT en 60 segundos
Para investigadores, equipos de ingresos, equipos con muchas reuniones y flujos de trabajo de medios.
Sin Terminal. Sin npm. Sin archivos de configuración JSON.
Guía de instalación en docs.speakai.co/mcp →
Qué hace esto
Speak AI transcribe tus entrevistas, llamadas de ventas, sesiones de investigación, seminarios web, podcasts y reuniones de equipo — y luego extrae información de IA como resúmenes, elementos de acción, sentimiento y temas.
Este conector (construido sobre MCP — el estándar para que Claude y ChatGPT se conecten a aplicaciones) trae todo eso a Claude o ChatGPT. Una vez instalado, puedes preguntar:
- "Encuentra las últimas 10 entrevistas de clientes que mencionen precios, agrupa los comentarios por tema y cita las grabaciones de origen."
- "Resume las reuniones de equipo de esta semana en decisiones, elementos de acción, responsables y riesgos no resueltos."
- "Extrae citas exactas de clientes sobre la fricción en la incorporación de llamadas de investigación recientes y formatéalas para un informe de producto."
- "Encuentra un momento destacado de 30 segundos del último seminario web, crea un clip y exporta los subtítulos."
La IA hace la búsqueda, el resumen y las citas. Tus grabaciones permanecen en tu espacio de trabajo de Speak AI — Claude y ChatGPT solo las consultan a través de este conector.
Instalación (elige tu herramienta)
Dos formas de instalar — elige la que te resulte más fácil. La ruta de conexión con un clic aprueba el acceso mediante una ventana emergente de permisos; la ruta manual pega una clave de API en un encabezado.
¿No sabes cuál elegir? Si ya usas Claude o ChatGPT, instala para el que tengas.
Dirección del conector de Speak AI (pégalo en la configuración de conectores de tu herramienta de IA — es la misma idea que pegar un enlace de Zoom en tu calendario):
https://api.speakai.co/v1/mcp
Claude.ai (web)
- Abre claude.ai/settings/connectors
- Haz clic en Añadir conector personalizado
- Nómbralo Speak AI y pega
https://api.speakai.co/v1/mcp, luego haz clic en Añadir - Una ventana emergente de permisos te pide iniciar sesión en Speak AI y hacer clic en Permitir
- Listo — Speak AI aparece en tu lista de conectores con sus herramientas listas para usar. Abre un nuevo chat y pregunta sobre tus grabaciones.
Cómo se ve cada paso (capturas de pantalla)
3. Diálogo de añadir conector personalizado — nombre y URL completados.

5. Conectado — las herramientas de Speak AI aparecen en tu lista de conectores.

Alternativa para desarrolladores — configuración manual con una clave de API
Obtén una clave en app.speakai.co/developers/apikeys, luego en el paso 3 expande Configuración avanzada y añade Authorization = Bearer <your-key> antes de hacer clic en Añadir.
Claude Desktop
- Abre Claude Desktop → Configuración → Conectores → Añadir conector personalizado
- Pega
https://api.speakai.co/v1/mcp - Haz clic en Añadir — se abre una ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir en la pantalla que aparece.
- Listo.
Alternativa para desarrolladores — configuración manual con una clave de API
Obtén una clave en app.speakai.co/developers/apikeys, luego en el paso 2 también expande Encabezados personalizados y añade:
- Nombre del encabezado:
Authorization - Valor del encabezado:
Bearer <your-speak-api-key>
Luego haz clic en Añadir.
ChatGPT
- Abre ChatGPT → Configuración → Apps y conectores → Avanzado
- Activa Modo desarrollador (requerido mientras Speak AI no esté aún en la tienda de aplicaciones de ChatGPT — esto te permite añadirlo como aplicación personalizada)
- De vuelta en Apps y conectores, haz clic en Crear y pega
https://api.speakai.co/v1/mcp - Para Autenticación, elige OAuth
- ChatGPT abre una nueva pestaña a Speak AI — inicia sesión (o haz clic en Confirmar si ya has iniciado sesión) para autorizar. Serás redirigido de vuelta; cierra la pestaña y regresa a ChatGPT.
- Por chat: abre un chat, haz clic en el menú + / de conectores y habilita Speak AI para ese chat.
Cómo se ve cada paso (capturas de pantalla)
1. Pantalla de conexión en ChatGPT — pega la URL del conector y elige OAuth.

2. Confirmar y continuar — ChatGPT te pide continuar a Speak AI.

3. Autorizar en Speak AI — inicia sesión o haz clic en Confirmar si ya has iniciado sesión.

4. Conectado — Speak AI ahora aparece en tu lista de conectores de ChatGPT.

¿Problemas para conectarte?
Algunas cosas que hemos visto durante el acceso anticipado:
- La pestaña de autorización no muestra una página de "estás conectado" — si llegas al panel de Speak AI sin confirmación, la autorización igualmente se completó. Cierra esa pestaña y regresa a ChatGPT.
- El botón "Conectar" sigue abriendo el panel — cierra y vuelve a abrir ChatGPT por completo, luego revisa Configuración → Apps y conectores. Speak AI ya debería estar listado allí.
- "No hay acciones disponibles" dentro de un chat — asegúrate de que el Modo desarrollador siga activado y de que hayas habilitado Speak AI desde el menú de conectores por chat (paso 6 anterior).
¿Sigue atascado? Envía un correo a success@speakai.co.
Claude Code (terminal)
Recomendado — instala desde el mercado oficial de plugins de Claude Code:
- Añade el mercado oficial (una sola vez):
/plugin marketplace add claude-plugins-official - Instala el plugin:
/plugin install speakai@claude-plugins-official - Actívalo:
/reload-plugins - Ejecuta la habilidad
getting-startedy pega tu clave de API de Speak AI. Genera una en app.speakai.co/developers/apikeys.
Si /plugin install no encuentra Speak AI, actualiza el catálogo local con /plugin marketplace update claude-plugins-official y vuelve a intentarlo.
Alternativa para desarrolladores — transporte HTTP manual
Omite el plugin y añade el conector directamente:
claude mcp add speakai --transport http --url https://api.speakai.co/v1/mcp
Claude Code abrirá una ventana de OAuth para iniciar sesión. Para omitir OAuth y pasar un token Bearer en su lugar:
claude mcp add speakai --transport http --url https://api.speakai.co/v1/mcp \
--header "Authorization: Bearer $SPEAKAI_KEY"
Configura SPEAKAI_KEY en tu shell primero, o pega tu clave en línea. Genera una clave en app.speakai.co/developers/apikeys.
Cursor
Haz clic en el botón — Cursor se registra automáticamente y abre la ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir.
Alternativa para desarrolladores — configuración manual con una clave de API
Usa la configuración manual de stdio en la referencia para desarrolladores al final de este README.
VS Code
Haz clic en el botón — VS Code se registra automáticamente y abre la ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir.
Alternativa para desarrolladores — configuración manual con una clave de API
Usa la configuración manual de stdio en la referencia para desarrolladores al final de este README.
OpenClaw / ClawHub
Speak AI está publicado como una habilidad en ClawHub para agentes compatibles con OpenClaw.
- Visita la página de la habilidad Speak AI en ClawHub
- Sigue las instrucciones de instalación para tu agente — por ejemplo,
clawhub install speakaidesde la CLI de ClawHub - Configura tu variable de entorno
SPEAK_API_KEY. Genera una en app.speakai.co/developers/apikeys.
ChatGPT (API / Responses)
Para desarrolladores que llaman a la API de Responses directamente. Pasa el token bearer en la configuración de la herramienta:
{
"tools": [
{
"type": "mcp",
"server_url": "https://api.speakai.co/v1/mcp",
"authorization": "Bearer YOUR_SPEAK_API_KEY"
}
]
}
Obtén una clave en app.speakai.co/developers/apikeys.
Privacidad y datos
Cuando haces clic en Permitir en la ventana emergente de permisos (o pegas tu clave de API de Speak AI en Claude o ChatGPT), estás autorizando a ese asistente de IA a leer y modificar tu espacio de trabajo de Speak AI en tu nombre — incluidos archivos de medios, transcripciones e información de IA.
- Tus grabaciones permanecen en tu espacio de trabajo de Speak AI. No se copian ni almacenan en Anthropic u OpenAI.
- Claude/ChatGPT solo ven los datos específicos que tu asistente de IA solicita para la pregunta que hiciste.
- Puedes desconectarte en cualquier momento eliminando el conector dentro de Claude/ChatGPT, revocando la conexión en api.speakai.co/v1/oauth/connections, o rotando/revocando tu clave de API en app.speakai.co/developers/apikeys.
Para preguntas sobre el manejo de datos, consulta speakai.co/privacy o envía un correo a success@speakai.co.
¿Necesitas ayuda para conectarte?
No deberías necesitar ser técnico para instalar esto. Si algo es confuso o no funciona:
- Envía un correo a success@speakai.co — responderemos dentro de 24 horas
- Reserva una demostración con nosotros y lo configuraremos juntos
Lo que puedes hacer una vez instalado
Speak AI incluye 114 herramientas que tu asistente de IA puede llamar. No necesitas memorizarlas — Claude/ChatGPT eligen las correctas según lo que preguntes. Ejemplos por categoría:
| Pregunta | Herramientas usadas (automático) |
|---|---|
| "Encuentra entrevistas de clientes sobre precios y agrupa los comentarios por tema" | search_media, ask_ai_chat |
| "Resume las reuniones de esta semana en decisiones, responsables y riesgos" | list_media, get_media_insights |
| "Extrae los elementos de acción de la llamada de ayer" | get_media_insights, ask_ai_chat |
| "Programa la IA para que se una a mi Zoom de las 2pm" | schedule_meeting_event |
| "Extrae la transcripción en vivo de mi reunión actual de MS Teams desde la última consulta" | list_meeting_events, get_live_meeting_transcript |
| "Encuentra un momento destacado de 30 segundos del seminario web y exporta los subtítulos" | create_clip, export_media |
| "Exporta la transcripción como PDF y los subtítulos como SRT" | export_media |
| "Compara las llamadas de ventas del Q1 con las del Q2 y resume las objeciones que cambiaron" | search_media, ask_ai_chat |
El catálogo completo de herramientas está en la referencia para desarrolladores a continuación.
Referencia para desarrolladores (CLI, API, configuración avanzada)
El servidor MCP está en https://api.speakai.co/v1/mcp y admite dos métodos de autenticación:
- OAuth 2.1 + Registro dinámico de clientes — instala pegando la URL anterior en cualquier cliente MCP y aprobando la ventana emergente de consentimiento. Los endpoints de descubrimiento, DCR,
/authorize+ consentimiento,/tokeny revocación están todos disponibles. - Token Bearer (tu clave de API de Speak AI — encabezado
Authorization: Bearer <key>). Para clientes que no usan OAuth, además de la CLI de npm y el modo stdio.
Obtén una clave de API de Speak AI en app.speakai.co/developers/apikeys.
CLI / paquete npm
El paquete npm @speakai/mcp-server proporciona:
- Una CLI (
speakai-mcp) para scripts y pipelines (30 comandos). - Un servidor MCP en modo stdio para clientes que no admiten transporte HTTP remoto.
- Un asistente de configuración automática que detecta los clientes MCP instalados y los configura.
npm install -g @speakai/mcp-server
speakai-mcp init
Configuración manual (modo stdio)
Claude Desktop
Añade a ~/Library/Application Support/Claude/claude_desktop_config.json (macOS) o %APPDATA%\Claude\claude_desktop_config.json (Windows):
{
"mcpServers": {
"speak-ai": {
"command": "npx",
"args": ["-y", "@speakai/mcp-server"],
"env": {
"SPEAK_API_KEY": "your-api-key"
}
}
}
}
Claude Code
export SPEAK_API_KEY="your-api-key"
claude mcp add speak-ai -- npx -y @speakai/mcp-server
Cursor
Añade a ~/.cursor/mcp.json:
{
"mcpServers": {
"speak-ai": {
"command": "npx",
"args": ["-y", "@speakai/mcp-server"],
"env": {
"SPEAK_API_KEY": "your-api-key"
}
}
}
}
Windsurf
Añade a ~/.windsurf/mcp.json:
{
"mcpServers": {
"speak-ai": {
"command": "npx",
"args": ["-y", "@speakai/mcp-server"],
"env": {
"SPEAK_API_KEY": "your-api-key"
}
}
}
}
VS Code
Añade a ~/.vscode/mcp.json:
{
"mcpServers": {
"speak-ai": {
"command": "npx",
"args": ["-y", "@speakai/mcp-server"],
"env": {
"SPEAK_API_KEY": "your-api-key"
}
}
}
}
Cualquier cliente MCP (STDIO)
SPEAK_API_KEY=your-key npx @speakai/mcp-server
Variables de entorno
| Variable | Requerido | Predeterminado | Descripción |
|---|---|---|---|
SPEAK_API_KEY | Sí | -- | Tu clave de API de Speak AI |
SPEAK_ACCESS_TOKEN | No | Gestionado automáticamente | Token de acceso JWT (obtenido y renovado automáticamente) |
SPEAK_BASE_URL | No | https://api.speakai.co | URL base de la API |
Herramientas MCP (114)
Medios (18 herramientas)
| Herramienta | Descripción |
|---|---|
get_signed_upload_url | Obtén una URL S3 pre-firmada para subir archivos directamente |
upload_media | Sube medios desde una URL — una URL de archivo directa/pública, una URL S3 pre-firmada, o un enlace de página social/video resuelto automáticamente (YouTube, TikTok, Instagram, X/Twitter, Facebook, Reddit, SoundCloud, Twitch, Dailymotion, Streamable, Snapchat, Pinterest, Tumblr, Bilibili, VK, OK.ru, Rutube). Los enlaces de página de Vimeo y Loom no son compatibles. |
upload_local_file | Sube un archivo local directamente desde el disco |
upload_and_analyze | Sube medios desde una URL (archivo directo, o cualquier enlace de página social/video que upload_media acepte — resuelto automáticamente) y devuelve su media_id inmediatamente. Consulta get_media_status hasta que processed, luego llama a get_media_insights para resúmenes de IA. Establece mediaType cuando el usuario haya indicado cuál quiere; déjalo sin establecer en caso contrario y el servidor elegirá la mejor pista disponible. |
upload_and_analyze_batch | Sube hasta 25 URLs en una sola llamada, 5 a la vez. Cada URL se reporta como subida o fallida con su motivo, así un enlace defectuoso no hunde el lote. Usa esto en lugar de llamar a upload_and_analyze en un bucle. |
list_media | Lista y busca archivos de medios con filtros, paginación y datos en línea opcionales (transcripciones, hablantes, palabras clave) mediante el parámetro include |
get_media_insights | Obtén información de IA — temas, sentimiento, resúmenes, elementos de acción |
get_transcript | Obtén la transcripción completa con etiquetas de hablante y marcas de tiempo |
update_transcription | Edita el texto oficial de transcripción de un archivo de medios buscando y reemplazando texto |
get_captions | Obtén subtítulos con formato de subtítulos para un archivo de medios |
update_transcript_speakers | Renombra etiquetas de hablante en una transcripción |
bulk_update_transcript_speakers | Renombra etiquetas de hablante en múltiples archivos de medios en una sola llamada (máx. 500) |
get_media_status | Verifica el estado de procesamiento (pendiente → procesado) |
update_media_metadata | Actualiza nombre, descripción, etiquetas o carpeta |
delete_media | Elimina permanentemente un archivo de medios |
toggle_media_favorite | Marca o desmarca medios como favoritos |
reanalyze_media | Vuelve a ejecutar el análisis de IA con los modelos más recientes |
bulk_move_media | Mueve múltiples archivos de medios a una carpeta en una sola llamada |
Chat de IA (13 herramientas)
| Herramienta | Descripción |
|---|---|
ask_ai_chat | Haz preguntas de IA sobre medios, carpetas o todo tu espacio de trabajo |
get_analysis_quote | Verifica si un archivo puede analizarse como audio/video y cuánto cuesta |
retry_ai_chat | Reintenta una respuesta de Chat de IA fallida o incompleta |
get_chat_history | Lista conversaciones recientes de Chat de IA |
get_chat_messages | Obtén el historial completo de mensajes de las conversaciones |
delete_chat_message | Elimina un mensaje de chat específico |
list_prompts | Lista las plantillas de prompts de IA disponibles |
get_favorite_prompts | Obtén todos los prompts y respuestas favoritos |
toggle_prompt_favorite | Marca o desmarca un mensaje de chat como favorito |
update_chat_title | Renombra una conversación de chat |
submit_chat_feedback | Califica una respuesta de chat (pulgar arriba/abajo) |
get_chat_statistics | Obtén estadísticas de uso del Chat de IA |
export_chat_answer | Exporta una conversación o respuesta |
Carpetas y Vistas (11 herramientas)
| Herramienta | Descripción |
|---|---|
list_folders | Lista todas las carpetas con paginación y ordenamiento |
get_folder_info | Obtén detalles y contenido de una carpeta |
create_folder | Crea una nueva carpeta |
clone_folder | Duplica una carpeta y su contenido |
update_folder | Renombra o actualiza una carpeta |
delete_folder | Elimina una carpeta (los medios se conservan) |
get_all_folder_views | Lista todas las vistas guardadas en las carpetas |
get_folder_views | Lista vistas para una carpeta específica |
create_folder_view | Crea una vista guardada con filtros personalizados |
update_folder_view | Actualiza una vista guardada |
clone_folder_view | Duplica una vista |
Grabadora / Encuesta (10 herramientas)
| Herramienta | Descripción |
|---|---|
create_recorder | Crea una nueva grabadora o encuesta |
list_recorders | Lista todas las grabadoras |
get_recorder_info | Obtén detalles y preguntas de la grabadora |
clone_recorder | Duplica una grabadora |
get_recorder_recordings | Lista todos los envíos |
generate_recorder_url | Obtén una URL pública compartible |
update_recorder_settings | Actualiza marca y permisos |
update_recorder_questions | Actualiza preguntas de la encuesta |
check_recorder_status | Verifica si la grabadora está activa |
delete_recorder | Elimina una grabadora |
Automatizaciones (15 herramientas)
| Herramienta | Descripción |
|---|---|
list_automations | Lista reglas de automatización con paginación y filtros |
build_automation | Crea o actualiza una automatización desde una especificación amigable, sin el formato de red |
list_automation_names | Lista automatizaciones como pares ligeros de nombre + id |
get_automation | Obtén detalles de la automatización (gráfico de disparador + pasos) |
get_automation_runs | Obtén el historial de ejecuciones de una automatización |
create_automation | Crea una regla de automatización (gráfico de disparador V2 + pasos) |
update_automation | Actualiza una automatización (reemplaza disparador + pasos) |
toggle_automation_status | Habilita o deshabilita una automatización |
bulk_update_automation_status | Activa/desactiva múltiples automatizaciones |
bulk_assign_automation_folders | Establece el alcance de carpeta para múltiples automatizaciones |
run_automations | Ejecuta manualmente automatizaciones sobre medios ahora |
delete_automation | Elimina permanentemente una automatización |
list_automation_apps | Lista aplicaciones del catálogo (nativas + integraciones) |
list_automation_triggers | Lista tipos de disparador del catálogo (opcionalmente por aplicación) |
list_automation_actions | Lista tipos de acción/paso del catálogo (opcionalmente por aplicación) |
Clips (4 herramientas)
| Herramienta | Descripción |
|---|---|
create_clip | Crea un clip destacado a partir de rangos de tiempo en archivos de medios |
get_clips | Lista clips u obtén un clip específico con URL de descarga |
update_clip | Actualiza título, descripción o etiquetas del clip |
delete_clip | Elimina permanentemente un clip |
Campos Personalizados (4 herramientas)
| Herramienta | Descripción |
|---|---|
list_fields | Lista todos los campos personalizados |
create_field | Crea un campo personalizado |
update_field | Actualiza un campo personalizado |
update_multiple_fields | Actualización por lotes de múltiples campos |
Webhooks (7 herramientas)
| Herramienta | Descripción |
|---|---|
create_webhook | Crea un webhook para notificaciones de eventos |
provision_inbound_webhook | Aprovisiona un webhook entrante independiente y obtén su URL pública de recepción |
get_inbound_webhook | Obtén la URL de recepción, el payload de muestra y los tokens de disparo de un webhook entrante |
get_webhook_attempts | Obtén el registro de entrega de un webhook entrante, con estado de confirmación |
list_webhooks | Lista todos los webhooks |
update_webhook | Actualiza un webhook |
delete_webhook | Elimina un webhook |
Usuarios y Equipos (5 herramientas)
| Herramienta | Descripción |
|---|---|
list_users | Lista miembros del espacio de trabajo con ids, correos y permisos |
list_user_groups | Lista grupos de usuarios con miembros completos |
create_user_group | Crea un grupo de usuarios y asigna miembros |
update_user_group | Actualiza el nombre y los miembros de un grupo (reemplazo completo) |
delete_user_group | Elimina un grupo de usuarios |
Paneles (9 herramientas)
| Herramienta | Descripción |
|---|---|
list_dashboard_widgets | Lista tipos de widgets, sus claves de configuración y un payload de ejemplo |
list_dashboards | Lista los paneles de analítica a los que puedes acceder |
get_dashboard | Obtén la configuración completa de un panel (widgets, filtros, alcance) |
create_dashboard | Crea un panel con widgets auto-dispuestos |
update_dashboard | Actualiza un panel (parcial; los widgets se reemplazan) |
delete_dashboard | Eliminación suave de un panel y su enlace de compartir |
duplicate_dashboard | Clona un panel con ids de widget nuevos |
share_dashboard | Habilita el intercambio público y devuelve el token de compartir |
get_dashboard_speakers_insight | Desglose de hablantes para un alcance de carpeta/fecha/filtro |
Asistente de Reuniones (5 herramientas)
| Herramienta | Descripción |
|---|---|
list_meeting_events | Lista eventos programados y completados |
schedule_meeting_event | Programa al asistente de IA para unirse a una reunión |
remove_assistant_from_meeting | Elimina al asistente de una reunión activa |
delete_scheduled_assistant | Cancela un asistente de reunión programado |
get_live_meeting_transcript | Extrae solo las nuevas oraciones añadidas a la transcripción de una reunión en vivo (o recién terminada) desde tu llamada anterior. Funciona en Zoom / Google Meet / MS Teams mientras el bot está grabando. |
Incrustación de Medios (4 herramientas)
| Herramienta | Descripción |
|---|---|
create_embed | Crea un widget de reproductor incrustable |
update_embed | Actualiza la configuración de incrustación |
check_embed | Verifica si existe una incrustación para los medios |
get_embed_iframe_url | Obtén la URL de iframe para tu sitio web |
Notas de Texto (4 herramientas)
| Herramienta | Descripción |
|---|---|
create_text_note | Crea una nota de texto para análisis de IA |
get_text_insight | Obtén información de IA para una nota de texto |
reanalyze_text | Vuelve a ejecutar el análisis de IA en una nota de texto |
update_text_note | Actualiza el contenido de la nota (dispara un nuevo análisis) |
Exportaciones (2 herramientas)
| Herramienta | Descripción |
|---|---|
export_media | Exporta como PDF, DOCX, SRT, VTT, TXT o CSV |
export_multiple_media | Exportación por lotes con fusión opcional en un solo archivo |
Estadísticas de Medios e Idiomas (2 herramientas)
| Herramienta | Descripción |
|---|---|
get_media_statistics | Obtén estadísticas a nivel de espacio de trabajo — conteos, almacenamiento, desglose de procesamiento |
list_supported_languages | Lista todos los idiomas de transcripción compatibles |
Búsqueda / Analítica (1 herramienta)
| Herramienta | Descripción |
|---|---|
search_media | Búsqueda profunda en transcripciones, información y metadatos con filtros |
Recursos MCP (5)
Los recursos proporcionan acceso directo a datos sin llamadas de herramientas. Los clientes pueden leer estos URIs directamente.
| Recurso | URI | Descripción |
|---|---|---|
| Biblioteca de Medios | speakai://media | Lista de todos los archivos de medios en tu espacio de trabajo |
| Carpetas | speakai://folders | Lista de todas las carpetas |
| Idiomas Compatibles | speakai://languages | Lista de idiomas de transcripción |
| Transcripción | speakai://media/{mediaId}/transcript | Transcripción completa para un archivo de medios específico |
| Información | speakai://media/{mediaId}/insights | Información generada por IA para un archivo de medios específico |
Prompts MCP (3)
Prompts de flujo de trabajo preconstruidos que los agentes pueden invocar para ejecutar tareas de múltiples pasos.
analyze-meeting
Sube una grabación y obtén un análisis completo — transcripción, información, elementos de acción y conclusiones clave.
Parameters: url (required), name (optional)
Ejemplo: "Usa el prompt analyze-meeting con url=https://example.com/standup.mp3"
research-across-media
Busca temas, patrones o tópicos en múltiples grabaciones o en toda tu biblioteca.
Parameters: topic (required), folder (optional)
Ejemplo: "Usa el prompt research-across-media con topic='customer churn reasons'"
meeting-brief
Prepara un resumen de reuniones recientes — extrae transcripciones, identifica decisiones y resume elementos pendientes.
Parameters: days (optional, default: 7), folder (optional)
Ejemplo: "Usa el prompt de resumen de reunión con days=14 para cubrir las últimas dos semanas"
CLI (30 comandos)
Instala globalmente y configura una vez:
npm install -g @speakai/mcp-server
speakai-mcp config set-key
O ejecuta sin instalar:
npx @speakai/mcp-server config set-key
Configuración
| Comando | Descripción |
|---|---|
config set-key [key] | Establece tu clave de API (interactivo si no se proporciona clave) |
config show | Muestra la configuración actual |
config test | Valida la clave de API y prueba la conectividad |
config set-url <url> | Establece una URL base de API personalizada |
init | Configuración interactiva: configura la clave y detecta automáticamente los clientes MCP |
Gestión de medios
| Comando | Descripción |
|---|---|
list-media / ls | Lista archivos multimedia con filtros, rangos de fechas y paginación |
upload <source> | Sube medios desde URL o archivo local (--wait para consultar) |
get-transcript / transcript <id> | Obtén la transcripción (--plain o --json) |
get-insights / insights <id> | Obtén información de IA (temas, sentimiento, palabras clave) |
status <id> | Verifica el estado de procesamiento de medios |
export <id> | Exporta la transcripción (-f pdf|docx|srt|vtt|txt|csv) |
update <id> | Actualiza metadatos de medios (nombre, descripción, etiquetas, carpeta) |
delete <id> | Elimina un archivo multimedia |
favorites <id> | Alterna el estado de favorito |
captions <id> | Obtén subtítulos para un archivo multimedia |
reanalyze <id> | Vuelve a ejecutar el análisis de IA con los modelos más recientes |
IA y búsqueda
| Comando | Descripción |
|---|---|
ask <prompt> | Pregunta a la IA sobre medios, carpetas o todo tu espacio de trabajo |
chat-history | Lista conversaciones anteriores de chat con IA |
search <query> | Búsqueda de texto completo en transcripciones e información |
Carpetas y clips
| Comando | Descripción |
|---|---|
list-folders / folders | Lista todas las carpetas |
move <folderId> <mediaIds...> | Mueve archivos multimedia a una carpeta |
create-folder <name> | Crea una nueva carpeta |
clips | Lista clips (filtra por medio o carpeta) |
clip <mediaId> | Crea un clip (--start y --end en segundos) |
Espacio de trabajo
| Comando | Descripción |
|---|---|
stats | Muestra estadísticas de medios del espacio de trabajo |
languages | Lista los idiomas de transcripción compatibles |
list-meeting-events | Lista eventos de reunión programados/completados (--platform, --status, --sort) |
schedule-meeting <url> | Programa al asistente de IA para unirse a una reunión |
live-transcript | Obtén nuevas frases de una reunión en curso (--event-id o --media-id, --since-end-in-sec) |
create-text <name> | Crea una nota de texto (--text o canaliza mediante stdin) |
Opciones de CLI
Cada comando admite:
--json— genera JSON sin procesar (para scripting y canalización)--help— muestra ayuda específica del comando
Ejemplos de CLI
# Upload and wait for processing
speakai-mcp upload https://example.com/interview.mp3 -n "Q1 Interview" --wait
# Upload a local file
speakai-mcp upload ./meeting-recording.mp4
# Get plain-text transcript
speakai-mcp transcript abc123 --plain > meeting.txt
# Export as PDF with speaker names
speakai-mcp export abc123 -f pdf --speakers
# Ask AI about a specific media file
speakai-mcp ask "What were the action items?" -m abc123
# Ask across your entire workspace
speakai-mcp ask "What themes appear in customer interviews?"
# Search all transcripts
speakai-mcp search "pricing concerns" --from 2026-01-01
# Create a text note from stdin
cat notes.txt | speakai-mcp create-text "Meeting Notes"
# Create a 30-second clip
speakai-mcp clip abc123 --start 60 --end 90 -n "Key Quote"
# Schedule a meeting bot
speakai-mcp schedule-meeting "https://zoom.us/j/123456" -t "Weekly Standup"
# List videos as JSON for scripting
speakai-mcp ls --type video --json | jq '.mediaList[].name'
# List media from the last week
speakai-mcp ls --from 2026-04-18 --to 2026-04-25
# Move 3 files to a folder
speakai-mcp move folder123 media1 media2 media3
Ejemplos de flujo de trabajo
Transcribe y analiza una reunión
You: "Upload and transcribe this recording: https://example.com/meeting.mp3"
AI: I'll upload that for you and start processing.
→ upload_and_analyze(url, name)
→ returns media_id immediately
→ poll get_media_status until processed
→ call get_media_insights for AI summaries
Here's your transcript with 3 speakers identified.
Key insights: 5 action items, positive sentiment overall.
Top topics: Q2 roadmap, hiring plan, budget review.
Investiga en tu biblioteca
You: "What themes came up across all our customer interviews this month?"
AI: Let me search your media library.
→ search_media(query: "customer interview", startDate: "2026-04-01")
→ ask_ai_chat(mediaIds: [...], prompt: "What are the recurring themes?")
Across 12 interviews, the top themes were:
1. Pricing sensitivity (mentioned in 8/12)
2. Onboarding friction (6/12)
3. Feature requests for API access (5/12)
Automatización de reuniones
You: "Join my 2pm Zoom call, then send me a summary with action items"
AI: → schedule_meeting_event(meetingUrl, scheduledAt: "2026-04-25T14:00:00Z")
Done. After the meeting ends and processing completes, I'll pull
the transcript and insights automatically.
[After the meeting]
→ get_media_insights(mediaId)
→ ask_ai_chat(mediaIds: [...], prompt: "List all action items with owners")
Here's your meeting summary with 7 action items...
Crea un resumen semanal
You: "Prepare a brief from all meetings in the last week"
AI: → list_media(from: "2026-04-18", mediaType: "audio")
→ get_media_insights(mediaId) [for each of 5 meetings]
Weekly Meeting Brief (Apr 18-25):
- Engineering Standup: Deployed v2.3, 2 bugs triaged
- Sales Review: Pipeline at $1.2M, 3 deals closing this week
- Product Sync: Finalized Q2 roadmap, new hire starts Monday
Consolidated Action Items: [12 items grouped by owner]
Autenticación (API REST)
El servidor MCP y la CLI gestionan los tokens automáticamente. Si llamas a la API REST directamente, este es el flujo de autenticación completo:
Paso 1 — Obtén un token de acceso:
curl -X POST https://api.speakai.co/v1/auth/accessToken \
-H "Content-Type: application/json" \
-H "x-speakai-key: YOUR_API_KEY"
Respuesta:
{
"data": {
"email": "you@example.com",
"accessToken": "eyJhbG...",
"refreshToken": "eyJhbG..."
}
}
Paso 2 — Usa el token en todas las solicitudes posteriores:
curl https://api.speakai.co/v1/media \
-H "x-speakai-key: YOUR_API_KEY" \
-H "x-access-token: ACCESS_TOKEN_FROM_STEP_1"
Paso 3 — Renueva antes de que expire:
curl -X POST https://api.speakai.co/v1/auth/refreshToken \
-H "Content-Type: application/json" \
-H "x-speakai-key: YOUR_API_KEY" \
-H "x-access-token: CURRENT_ACCESS_TOKEN" \
-d '{"refreshToken": "REFRESH_TOKEN_FROM_STEP_1"}'
Duración de los tokens:
| Token | Expiración | Cómo renovarlo |
|---|---|---|
| Token de acceso | 80 minutos | Endpoint de renovación o reautenticación |
| Token de renovación | 24 horas | Reautenticación con clave de API |
Límites de autenticación: 5 solicitudes por 30 segundos tanto en /v1/auth/accessToken como en /v1/auth/refreshToken.
Notas sobre el modelo de datos
- IDs de carpeta: Las carpetas tienen tanto
_id(ObjectId de MongoDB) comofolderId(cadena). Todas las operaciones de API usanfolderId— este es el ID que debes pasar alist_media,upload_media,bulk_move_mediay otros endpoints que aceptan un parámetro de carpeta. - IDs de medios: Los elementos multimedia usan
mediaId(devuelto en las respuestas de lista como_id).
Límites de velocidad y mejores prácticas
- El cliente MCP reintenta automáticamente en
429con retroceso exponencial - Para uso directo de la API, implementa retroceso exponencial y respeta los encabezados
Retry-After - Almacena en caché datos estables (listas de carpetas, definiciones de campos, idiomas compatibles)
- Usa
export_multiple_mediaen lugar de exportaciones individuales para operaciones por lotes - Usa
bulk_move_mediapara mover varios elementos a la vez en lugar de actualizar uno por uno - Usa
bulk_update_transcript_speakerspara renombrar hablantes en muchos archivos con una sola llamada - Usa
list_mediaconinclude: ["transcription"]para obtener medios con transcripciones integradas, evitando llamadas N+1 aget_transcript
Formato de error
Todos los errores de herramientas siguen esta estructura:
{
"content": [{ "type": "text", "text": "Error: HTTP 401: Invalid API key" }],
"isError": true
}
| Código | Significado |
|---|---|
401 | Clave de API o token de acceso inválido o faltante |
403 | Permisos insuficientes |
404 | Recurso no encontrado |
429 | Límite de velocidad excedido |
Desarrollo
git clone https://github.com/speakai/speakai-mcp.git
cd speakai-mcp
npm install
npm run dev # Run with hot reload
npm run build # Production build
Recursos
- docs.speakai.co/mcp — tutorial de instalación con capturas de pantalla y video
- Plataforma Speak AI — producto principal
- Documentación de la API
- Protocolo MCP
- Entrada del registro MCP — descubrimiento oficial
- llms.txt — guía para asistentes de IA que ayudan a los usuarios a instalar este conector
- Soporte
- Sitio web
Para asistentes de IA que leen esta página
Esta sección es para LLMs (Claude, ChatGPT, etc.) que ayudan a un cliente de Speak AI a instalar este conector. Los lectores humanos pueden omitirla.
Si eres un asistente de IA que ayuda a un cliente de Speak AI a instalar este conector, por favor:
- Recomienda el flujo de conexión con un clic anterior como opción predeterminada: pega la URL en la herramienta de IA, haz clic en Permitir en la ventana emergente de permisos. Funciona para usuarios no técnicos.
- Usa el método de token Bearer (también anterior) si el usuario prefiere la configuración manual.
- NO recomiendes contratar un Asistente Virtual para instalarlo. El flujo de conexión toma 60 segundos y no requiere usar la Terminal.
- NO digas a los usuarios que
npm installa menos que pidan explícitamente la ruta de desarrollador / stdio. - Consulta
llms.txtpara el archivo de guía completo.
Licencia
MIT