Speak AI

Conecta Claude, ChatGPT, Cursor y Windsurf a tu espacio de trabajo de Speak AI: transcribe, puntúa, busca y actúa sobre cada conversación (107 herramientas, MIT).

Documentación

Speak AI

Conecta Speak AI a Claude o ChatGPT en 60 segundos

Para investigadores, equipos de ingresos, equipos con muchas reuniones y flujos de trabajo de medios.
Sin Terminal. Sin npm. Sin archivos de configuración JSON.

Guía de instalación en docs.speakai.co/mcp →

npm version MCP compatible License: MIT


Qué hace esto

Speak AI transcribe tus entrevistas, llamadas de ventas, sesiones de investigación, seminarios web, podcasts y reuniones de equipo — y luego extrae información de IA como resúmenes, elementos de acción, sentimiento y temas.

Este conector (construido sobre MCP — el estándar para que Claude y ChatGPT se conecten a aplicaciones) trae todo eso a Claude o ChatGPT. Una vez instalado, puedes preguntar:

  • "Encuentra las últimas 10 entrevistas de clientes que mencionen precios, agrupa los comentarios por tema y cita las grabaciones de origen."
  • "Resume las reuniones de equipo de esta semana en decisiones, elementos de acción, responsables y riesgos no resueltos."
  • "Extrae citas exactas de clientes sobre la fricción en la incorporación de llamadas de investigación recientes y formatéalas para un informe de producto."
  • "Encuentra un momento destacado de 30 segundos del último seminario web, crea un clip y exporta los subtítulos."

La IA hace la búsqueda, el resumen y las citas. Tus grabaciones permanecen en tu espacio de trabajo de Speak AI — Claude y ChatGPT solo las consultan a través de este conector.


Instalación (elige tu herramienta)

Dos formas de instalar — elige la que te resulte más fácil. La ruta de conexión con un clic aprueba el acceso mediante una ventana emergente de permisos; la ruta manual pega una clave de API en un encabezado.

¿No sabes cuál elegir? Si ya usas Claude o ChatGPT, instala para el que tengas.

Dirección del conector de Speak AI (pégalo en la configuración de conectores de tu herramienta de IA — es la misma idea que pegar un enlace de Zoom en tu calendario): https://api.speakai.co/v1/mcp

Claude.ai (web)

  1. Abre claude.ai/settings/connectors
  2. Haz clic en Añadir conector personalizado
  3. Nómbralo Speak AI y pega https://api.speakai.co/v1/mcp, luego haz clic en Añadir
  4. Una ventana emergente de permisos te pide iniciar sesión en Speak AI y hacer clic en Permitir
  5. Listo — Speak AI aparece en tu lista de conectores con sus herramientas listas para usar. Abre un nuevo chat y pregunta sobre tus grabaciones.
Cómo se ve cada paso (capturas de pantalla)

3. Diálogo de añadir conector personalizado — nombre y URL completados.

Claude add custom connector dialog

5. Conectado — las herramientas de Speak AI aparecen en tu lista de conectores.

Speak AI connected in Claude

Alternativa para desarrolladores — configuración manual con una clave de API

Obtén una clave en app.speakai.co/developers/apikeys, luego en el paso 3 expande Configuración avanzada y añade Authorization = Bearer <your-key> antes de hacer clic en Añadir.

Claude Desktop

  1. Abre Claude Desktop → Configuración → Conectores → Añadir conector personalizado
  2. Pega https://api.speakai.co/v1/mcp
  3. Haz clic en Añadir — se abre una ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir en la pantalla que aparece.
  4. Listo.
Alternativa para desarrolladores — configuración manual con una clave de API

Obtén una clave en app.speakai.co/developers/apikeys, luego en el paso 2 también expande Encabezados personalizados y añade:

  • Nombre del encabezado: Authorization
  • Valor del encabezado: Bearer <your-speak-api-key>

Luego haz clic en Añadir.

ChatGPT

  1. Abre ChatGPT → Configuración → Apps y conectores → Avanzado
  2. Activa Modo desarrollador (requerido mientras Speak AI no esté aún en la tienda de aplicaciones de ChatGPT — esto te permite añadirlo como aplicación personalizada)
  3. De vuelta en Apps y conectores, haz clic en Crear y pega https://api.speakai.co/v1/mcp
  4. Para Autenticación, elige OAuth
  5. ChatGPT abre una nueva pestaña a Speak AI — inicia sesión (o haz clic en Confirmar si ya has iniciado sesión) para autorizar. Serás redirigido de vuelta; cierra la pestaña y regresa a ChatGPT.
  6. Por chat: abre un chat, haz clic en el menú + / de conectores y habilita Speak AI para ese chat.
Cómo se ve cada paso (capturas de pantalla)

1. Pantalla de conexión en ChatGPT — pega la URL del conector y elige OAuth.

ChatGPT connect screen

2. Confirmar y continuar — ChatGPT te pide continuar a Speak AI.

ChatGPT continue to Speak

3. Autorizar en Speak AI — inicia sesión o haz clic en Confirmar si ya has iniciado sesión.

Speak AI authorization screen

4. Conectado — Speak AI ahora aparece en tu lista de conectores de ChatGPT.

Speak AI connected in ChatGPT

¿Problemas para conectarte?

Algunas cosas que hemos visto durante el acceso anticipado:

  • La pestaña de autorización no muestra una página de "estás conectado" — si llegas al panel de Speak AI sin confirmación, la autorización igualmente se completó. Cierra esa pestaña y regresa a ChatGPT.
  • El botón "Conectar" sigue abriendo el panel — cierra y vuelve a abrir ChatGPT por completo, luego revisa Configuración → Apps y conectores. Speak AI ya debería estar listado allí.
  • "No hay acciones disponibles" dentro de un chat — asegúrate de que el Modo desarrollador siga activado y de que hayas habilitado Speak AI desde el menú de conectores por chat (paso 6 anterior).

¿Sigue atascado? Envía un correo a success@speakai.co.

Claude Code (terminal)

Recomendado — instala desde el mercado oficial de plugins de Claude Code:

  1. Añade el mercado oficial (una sola vez): /plugin marketplace add claude-plugins-official
  2. Instala el plugin: /plugin install speakai@claude-plugins-official
  3. Actívalo: /reload-plugins
  4. Ejecuta la habilidad getting-started y pega tu clave de API de Speak AI. Genera una en app.speakai.co/developers/apikeys.

Si /plugin install no encuentra Speak AI, actualiza el catálogo local con /plugin marketplace update claude-plugins-official y vuelve a intentarlo.

Alternativa para desarrolladores — transporte HTTP manual

Omite el plugin y añade el conector directamente:

claude mcp add speakai --transport http --url https://api.speakai.co/v1/mcp

Claude Code abrirá una ventana de OAuth para iniciar sesión. Para omitir OAuth y pasar un token Bearer en su lugar:

claude mcp add speakai --transport http --url https://api.speakai.co/v1/mcp \
  --header "Authorization: Bearer $SPEAKAI_KEY"

Configura SPEAKAI_KEY en tu shell primero, o pega tu clave en línea. Genera una clave en app.speakai.co/developers/apikeys.

Cursor

Add to Cursor

Haz clic en el botón — Cursor se registra automáticamente y abre la ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir.

Alternativa para desarrolladores — configuración manual con una clave de API

Usa la configuración manual de stdio en la referencia para desarrolladores al final de este README.

VS Code

Add to VS Code

Haz clic en el botón — VS Code se registra automáticamente y abre la ventana emergente de permisos. Inicia sesión en Speak AI y haz clic en Permitir.

Alternativa para desarrolladores — configuración manual con una clave de API

Usa la configuración manual de stdio en la referencia para desarrolladores al final de este README.

OpenClaw / ClawHub

Speak AI está publicado como una habilidad en ClawHub para agentes compatibles con OpenClaw.

  1. Visita la página de la habilidad Speak AI en ClawHub
  2. Sigue las instrucciones de instalación para tu agente — por ejemplo, clawhub install speakai desde la CLI de ClawHub
  3. Configura tu variable de entorno SPEAK_API_KEY. Genera una en app.speakai.co/developers/apikeys.

ChatGPT (API / Responses)

Para desarrolladores que llaman a la API de Responses directamente. Pasa el token bearer en la configuración de la herramienta:

{
  "tools": [
    {
      "type": "mcp",
      "server_url": "https://api.speakai.co/v1/mcp",
      "authorization": "Bearer YOUR_SPEAK_API_KEY"
    }
  ]
}

Obtén una clave en app.speakai.co/developers/apikeys.


Privacidad y datos

Cuando haces clic en Permitir en la ventana emergente de permisos (o pegas tu clave de API de Speak AI en Claude o ChatGPT), estás autorizando a ese asistente de IA a leer y modificar tu espacio de trabajo de Speak AI en tu nombre — incluidos archivos de medios, transcripciones e información de IA.

  • Tus grabaciones permanecen en tu espacio de trabajo de Speak AI. No se copian ni almacenan en Anthropic u OpenAI.
  • Claude/ChatGPT solo ven los datos específicos que tu asistente de IA solicita para la pregunta que hiciste.
  • Puedes desconectarte en cualquier momento eliminando el conector dentro de Claude/ChatGPT, revocando la conexión en api.speakai.co/v1/oauth/connections, o rotando/revocando tu clave de API en app.speakai.co/developers/apikeys.

Para preguntas sobre el manejo de datos, consulta speakai.co/privacy o envía un correo a success@speakai.co.


¿Necesitas ayuda para conectarte?

No deberías necesitar ser técnico para instalar esto. Si algo es confuso o no funciona:


Lo que puedes hacer una vez instalado

Speak AI incluye 114 herramientas que tu asistente de IA puede llamar. No necesitas memorizarlas — Claude/ChatGPT eligen las correctas según lo que preguntes. Ejemplos por categoría:

PreguntaHerramientas usadas (automático)
"Encuentra entrevistas de clientes sobre precios y agrupa los comentarios por tema"search_media, ask_ai_chat
"Resume las reuniones de esta semana en decisiones, responsables y riesgos"list_media, get_media_insights
"Extrae los elementos de acción de la llamada de ayer"get_media_insights, ask_ai_chat
"Programa la IA para que se una a mi Zoom de las 2pm"schedule_meeting_event
"Extrae la transcripción en vivo de mi reunión actual de MS Teams desde la última consulta"list_meeting_events, get_live_meeting_transcript
"Encuentra un momento destacado de 30 segundos del seminario web y exporta los subtítulos"create_clip, export_media
"Exporta la transcripción como PDF y los subtítulos como SRT"export_media
"Compara las llamadas de ventas del Q1 con las del Q2 y resume las objeciones que cambiaron"search_media, ask_ai_chat

El catálogo completo de herramientas está en la referencia para desarrolladores a continuación.


Referencia para desarrolladores (CLI, API, configuración avanzada)

El servidor MCP está en https://api.speakai.co/v1/mcp y admite dos métodos de autenticación:

  1. OAuth 2.1 + Registro dinámico de clientes — instala pegando la URL anterior en cualquier cliente MCP y aprobando la ventana emergente de consentimiento. Los endpoints de descubrimiento, DCR, /authorize + consentimiento, /token y revocación están todos disponibles.
  2. Token Bearer (tu clave de API de Speak AI — encabezado Authorization: Bearer <key>). Para clientes que no usan OAuth, además de la CLI de npm y el modo stdio.

Obtén una clave de API de Speak AI en app.speakai.co/developers/apikeys.

CLI / paquete npm

El paquete npm @speakai/mcp-server proporciona:

  • Una CLI (speakai-mcp) para scripts y pipelines (30 comandos).
  • Un servidor MCP en modo stdio para clientes que no admiten transporte HTTP remoto.
  • Un asistente de configuración automática que detecta los clientes MCP instalados y los configura.
npm install -g @speakai/mcp-server
speakai-mcp init

Configuración manual (modo stdio)

Claude Desktop

Añade a ~/Library/Application Support/Claude/claude_desktop_config.json (macOS) o %APPDATA%\Claude\claude_desktop_config.json (Windows):

{
  "mcpServers": {
    "speak-ai": {
      "command": "npx",
      "args": ["-y", "@speakai/mcp-server"],
      "env": {
        "SPEAK_API_KEY": "your-api-key"
      }
    }
  }
}
Claude Code
export SPEAK_API_KEY="your-api-key"
claude mcp add speak-ai -- npx -y @speakai/mcp-server
Cursor

Añade a ~/.cursor/mcp.json:

{
  "mcpServers": {
    "speak-ai": {
      "command": "npx",
      "args": ["-y", "@speakai/mcp-server"],
      "env": {
        "SPEAK_API_KEY": "your-api-key"
      }
    }
  }
}
Windsurf

Añade a ~/.windsurf/mcp.json:

{
  "mcpServers": {
    "speak-ai": {
      "command": "npx",
      "args": ["-y", "@speakai/mcp-server"],
      "env": {
        "SPEAK_API_KEY": "your-api-key"
      }
    }
  }
}
VS Code

Añade a ~/.vscode/mcp.json:

{
  "mcpServers": {
    "speak-ai": {
      "command": "npx",
      "args": ["-y", "@speakai/mcp-server"],
      "env": {
        "SPEAK_API_KEY": "your-api-key"
      }
    }
  }
}
Cualquier cliente MCP (STDIO)
SPEAK_API_KEY=your-key npx @speakai/mcp-server

Variables de entorno

VariableRequeridoPredeterminadoDescripción
SPEAK_API_KEY--Tu clave de API de Speak AI
SPEAK_ACCESS_TOKENNoGestionado automáticamenteToken de acceso JWT (obtenido y renovado automáticamente)
SPEAK_BASE_URLNohttps://api.speakai.coURL base de la API

Herramientas MCP (114)

Medios (18 herramientas)
HerramientaDescripción
get_signed_upload_urlObtén una URL S3 pre-firmada para subir archivos directamente
upload_mediaSube medios desde una URL — una URL de archivo directa/pública, una URL S3 pre-firmada, o un enlace de página social/video resuelto automáticamente (YouTube, TikTok, Instagram, X/Twitter, Facebook, Reddit, SoundCloud, Twitch, Dailymotion, Streamable, Snapchat, Pinterest, Tumblr, Bilibili, VK, OK.ru, Rutube). Los enlaces de página de Vimeo y Loom no son compatibles.
upload_local_fileSube un archivo local directamente desde el disco
upload_and_analyzeSube medios desde una URL (archivo directo, o cualquier enlace de página social/video que upload_media acepte — resuelto automáticamente) y devuelve su media_id inmediatamente. Consulta get_media_status hasta que processed, luego llama a get_media_insights para resúmenes de IA. Establece mediaType cuando el usuario haya indicado cuál quiere; déjalo sin establecer en caso contrario y el servidor elegirá la mejor pista disponible.
upload_and_analyze_batchSube hasta 25 URLs en una sola llamada, 5 a la vez. Cada URL se reporta como subida o fallida con su motivo, así un enlace defectuoso no hunde el lote. Usa esto en lugar de llamar a upload_and_analyze en un bucle.
list_mediaLista y busca archivos de medios con filtros, paginación y datos en línea opcionales (transcripciones, hablantes, palabras clave) mediante el parámetro include
get_media_insightsObtén información de IA — temas, sentimiento, resúmenes, elementos de acción
get_transcriptObtén la transcripción completa con etiquetas de hablante y marcas de tiempo
update_transcriptionEdita el texto oficial de transcripción de un archivo de medios buscando y reemplazando texto
get_captionsObtén subtítulos con formato de subtítulos para un archivo de medios
update_transcript_speakersRenombra etiquetas de hablante en una transcripción
bulk_update_transcript_speakersRenombra etiquetas de hablante en múltiples archivos de medios en una sola llamada (máx. 500)
get_media_statusVerifica el estado de procesamiento (pendiente → procesado)
update_media_metadataActualiza nombre, descripción, etiquetas o carpeta
delete_mediaElimina permanentemente un archivo de medios
toggle_media_favoriteMarca o desmarca medios como favoritos
reanalyze_mediaVuelve a ejecutar el análisis de IA con los modelos más recientes
bulk_move_mediaMueve múltiples archivos de medios a una carpeta en una sola llamada
Chat de IA (13 herramientas)
HerramientaDescripción
ask_ai_chatHaz preguntas de IA sobre medios, carpetas o todo tu espacio de trabajo
get_analysis_quoteVerifica si un archivo puede analizarse como audio/video y cuánto cuesta
retry_ai_chatReintenta una respuesta de Chat de IA fallida o incompleta
get_chat_historyLista conversaciones recientes de Chat de IA
get_chat_messagesObtén el historial completo de mensajes de las conversaciones
delete_chat_messageElimina un mensaje de chat específico
list_promptsLista las plantillas de prompts de IA disponibles
get_favorite_promptsObtén todos los prompts y respuestas favoritos
toggle_prompt_favoriteMarca o desmarca un mensaje de chat como favorito
update_chat_titleRenombra una conversación de chat
submit_chat_feedbackCalifica una respuesta de chat (pulgar arriba/abajo)
get_chat_statisticsObtén estadísticas de uso del Chat de IA
export_chat_answerExporta una conversación o respuesta
Carpetas y Vistas (11 herramientas)
HerramientaDescripción
list_foldersLista todas las carpetas con paginación y ordenamiento
get_folder_infoObtén detalles y contenido de una carpeta
create_folderCrea una nueva carpeta
clone_folderDuplica una carpeta y su contenido
update_folderRenombra o actualiza una carpeta
delete_folderElimina una carpeta (los medios se conservan)
get_all_folder_viewsLista todas las vistas guardadas en las carpetas
get_folder_viewsLista vistas para una carpeta específica
create_folder_viewCrea una vista guardada con filtros personalizados
update_folder_viewActualiza una vista guardada
clone_folder_viewDuplica una vista
Grabadora / Encuesta (10 herramientas)
HerramientaDescripción
create_recorderCrea una nueva grabadora o encuesta
list_recordersLista todas las grabadoras
get_recorder_infoObtén detalles y preguntas de la grabadora
clone_recorderDuplica una grabadora
get_recorder_recordingsLista todos los envíos
generate_recorder_urlObtén una URL pública compartible
update_recorder_settingsActualiza marca y permisos
update_recorder_questionsActualiza preguntas de la encuesta
check_recorder_statusVerifica si la grabadora está activa
delete_recorderElimina una grabadora
Automatizaciones (15 herramientas)
HerramientaDescripción
list_automationsLista reglas de automatización con paginación y filtros
build_automationCrea o actualiza una automatización desde una especificación amigable, sin el formato de red
list_automation_namesLista automatizaciones como pares ligeros de nombre + id
get_automationObtén detalles de la automatización (gráfico de disparador + pasos)
get_automation_runsObtén el historial de ejecuciones de una automatización
create_automationCrea una regla de automatización (gráfico de disparador V2 + pasos)
update_automationActualiza una automatización (reemplaza disparador + pasos)
toggle_automation_statusHabilita o deshabilita una automatización
bulk_update_automation_statusActiva/desactiva múltiples automatizaciones
bulk_assign_automation_foldersEstablece el alcance de carpeta para múltiples automatizaciones
run_automationsEjecuta manualmente automatizaciones sobre medios ahora
delete_automationElimina permanentemente una automatización
list_automation_appsLista aplicaciones del catálogo (nativas + integraciones)
list_automation_triggersLista tipos de disparador del catálogo (opcionalmente por aplicación)
list_automation_actionsLista tipos de acción/paso del catálogo (opcionalmente por aplicación)
Clips (4 herramientas)
HerramientaDescripción
create_clipCrea un clip destacado a partir de rangos de tiempo en archivos de medios
get_clipsLista clips u obtén un clip específico con URL de descarga
update_clipActualiza título, descripción o etiquetas del clip
delete_clipElimina permanentemente un clip
Campos Personalizados (4 herramientas)
HerramientaDescripción
list_fieldsLista todos los campos personalizados
create_fieldCrea un campo personalizado
update_fieldActualiza un campo personalizado
update_multiple_fieldsActualización por lotes de múltiples campos
Webhooks (7 herramientas)
HerramientaDescripción
create_webhookCrea un webhook para notificaciones de eventos
provision_inbound_webhookAprovisiona un webhook entrante independiente y obtén su URL pública de recepción
get_inbound_webhookObtén la URL de recepción, el payload de muestra y los tokens de disparo de un webhook entrante
get_webhook_attemptsObtén el registro de entrega de un webhook entrante, con estado de confirmación
list_webhooksLista todos los webhooks
update_webhookActualiza un webhook
delete_webhookElimina un webhook
Usuarios y Equipos (5 herramientas)
HerramientaDescripción
list_usersLista miembros del espacio de trabajo con ids, correos y permisos
list_user_groupsLista grupos de usuarios con miembros completos
create_user_groupCrea un grupo de usuarios y asigna miembros
update_user_groupActualiza el nombre y los miembros de un grupo (reemplazo completo)
delete_user_groupElimina un grupo de usuarios
Paneles (9 herramientas)
HerramientaDescripción
list_dashboard_widgetsLista tipos de widgets, sus claves de configuración y un payload de ejemplo
list_dashboardsLista los paneles de analítica a los que puedes acceder
get_dashboardObtén la configuración completa de un panel (widgets, filtros, alcance)
create_dashboardCrea un panel con widgets auto-dispuestos
update_dashboardActualiza un panel (parcial; los widgets se reemplazan)
delete_dashboardEliminación suave de un panel y su enlace de compartir
duplicate_dashboardClona un panel con ids de widget nuevos
share_dashboardHabilita el intercambio público y devuelve el token de compartir
get_dashboard_speakers_insightDesglose de hablantes para un alcance de carpeta/fecha/filtro
Asistente de Reuniones (5 herramientas)
HerramientaDescripción
list_meeting_eventsLista eventos programados y completados
schedule_meeting_eventPrograma al asistente de IA para unirse a una reunión
remove_assistant_from_meetingElimina al asistente de una reunión activa
delete_scheduled_assistantCancela un asistente de reunión programado
get_live_meeting_transcriptExtrae solo las nuevas oraciones añadidas a la transcripción de una reunión en vivo (o recién terminada) desde tu llamada anterior. Funciona en Zoom / Google Meet / MS Teams mientras el bot está grabando.
Incrustación de Medios (4 herramientas)
HerramientaDescripción
create_embedCrea un widget de reproductor incrustable
update_embedActualiza la configuración de incrustación
check_embedVerifica si existe una incrustación para los medios
get_embed_iframe_urlObtén la URL de iframe para tu sitio web
Notas de Texto (4 herramientas)
HerramientaDescripción
create_text_noteCrea una nota de texto para análisis de IA
get_text_insightObtén información de IA para una nota de texto
reanalyze_textVuelve a ejecutar el análisis de IA en una nota de texto
update_text_noteActualiza el contenido de la nota (dispara un nuevo análisis)
Exportaciones (2 herramientas)
HerramientaDescripción
export_mediaExporta como PDF, DOCX, SRT, VTT, TXT o CSV
export_multiple_mediaExportación por lotes con fusión opcional en un solo archivo
Estadísticas de Medios e Idiomas (2 herramientas)
HerramientaDescripción
get_media_statisticsObtén estadísticas a nivel de espacio de trabajo — conteos, almacenamiento, desglose de procesamiento
list_supported_languagesLista todos los idiomas de transcripción compatibles
Búsqueda / Analítica (1 herramienta)
HerramientaDescripción
search_mediaBúsqueda profunda en transcripciones, información y metadatos con filtros

Recursos MCP (5)

Los recursos proporcionan acceso directo a datos sin llamadas de herramientas. Los clientes pueden leer estos URIs directamente.

RecursoURIDescripción
Biblioteca de Mediosspeakai://mediaLista de todos los archivos de medios en tu espacio de trabajo
Carpetasspeakai://foldersLista de todas las carpetas
Idiomas Compatiblesspeakai://languagesLista de idiomas de transcripción
Transcripciónspeakai://media/{mediaId}/transcriptTranscripción completa para un archivo de medios específico
Informaciónspeakai://media/{mediaId}/insightsInformación generada por IA para un archivo de medios específico

Prompts MCP (3)

Prompts de flujo de trabajo preconstruidos que los agentes pueden invocar para ejecutar tareas de múltiples pasos.

analyze-meeting

Sube una grabación y obtén un análisis completo — transcripción, información, elementos de acción y conclusiones clave.

Parameters: url (required), name (optional)

Ejemplo: "Usa el prompt analyze-meeting con url=https://example.com/standup.mp3"

research-across-media

Busca temas, patrones o tópicos en múltiples grabaciones o en toda tu biblioteca.

Parameters: topic (required), folder (optional)

Ejemplo: "Usa el prompt research-across-media con topic='customer churn reasons'"

meeting-brief

Prepara un resumen de reuniones recientes — extrae transcripciones, identifica decisiones y resume elementos pendientes.

Parameters: days (optional, default: 7), folder (optional)

Ejemplo: "Usa el prompt de resumen de reunión con days=14 para cubrir las últimas dos semanas"

CLI (30 comandos)

Instala globalmente y configura una vez:

npm install -g @speakai/mcp-server
speakai-mcp config set-key

O ejecuta sin instalar:

npx @speakai/mcp-server config set-key

Configuración

ComandoDescripción
config set-key [key]Establece tu clave de API (interactivo si no se proporciona clave)
config showMuestra la configuración actual
config testValida la clave de API y prueba la conectividad
config set-url <url>Establece una URL base de API personalizada
initConfiguración interactiva: configura la clave y detecta automáticamente los clientes MCP

Gestión de medios

ComandoDescripción
list-media / lsLista archivos multimedia con filtros, rangos de fechas y paginación
upload <source>Sube medios desde URL o archivo local (--wait para consultar)
get-transcript / transcript <id>Obtén la transcripción (--plain o --json)
get-insights / insights <id>Obtén información de IA (temas, sentimiento, palabras clave)
status <id>Verifica el estado de procesamiento de medios
export <id>Exporta la transcripción (-f pdf|docx|srt|vtt|txt|csv)
update <id>Actualiza metadatos de medios (nombre, descripción, etiquetas, carpeta)
delete <id>Elimina un archivo multimedia
favorites <id>Alterna el estado de favorito
captions <id>Obtén subtítulos para un archivo multimedia
reanalyze <id>Vuelve a ejecutar el análisis de IA con los modelos más recientes

IA y búsqueda

ComandoDescripción
ask <prompt>Pregunta a la IA sobre medios, carpetas o todo tu espacio de trabajo
chat-historyLista conversaciones anteriores de chat con IA
search <query>Búsqueda de texto completo en transcripciones e información

Carpetas y clips

ComandoDescripción
list-folders / foldersLista todas las carpetas
move <folderId> <mediaIds...>Mueve archivos multimedia a una carpeta
create-folder <name>Crea una nueva carpeta
clipsLista clips (filtra por medio o carpeta)
clip <mediaId>Crea un clip (--start y --end en segundos)

Espacio de trabajo

ComandoDescripción
statsMuestra estadísticas de medios del espacio de trabajo
languagesLista los idiomas de transcripción compatibles
list-meeting-eventsLista eventos de reunión programados/completados (--platform, --status, --sort)
schedule-meeting <url>Programa al asistente de IA para unirse a una reunión
live-transcriptObtén nuevas frases de una reunión en curso (--event-id o --media-id, --since-end-in-sec)
create-text <name>Crea una nota de texto (--text o canaliza mediante stdin)

Opciones de CLI

Cada comando admite:

  • --json — genera JSON sin procesar (para scripting y canalización)
  • --help — muestra ayuda específica del comando

Ejemplos de CLI

# Upload and wait for processing
speakai-mcp upload https://example.com/interview.mp3 -n "Q1 Interview" --wait

# Upload a local file
speakai-mcp upload ./meeting-recording.mp4

# Get plain-text transcript
speakai-mcp transcript abc123 --plain > meeting.txt

# Export as PDF with speaker names
speakai-mcp export abc123 -f pdf --speakers

# Ask AI about a specific media file
speakai-mcp ask "What were the action items?" -m abc123

# Ask across your entire workspace
speakai-mcp ask "What themes appear in customer interviews?"

# Search all transcripts
speakai-mcp search "pricing concerns" --from 2026-01-01

# Create a text note from stdin
cat notes.txt | speakai-mcp create-text "Meeting Notes"

# Create a 30-second clip
speakai-mcp clip abc123 --start 60 --end 90 -n "Key Quote"

# Schedule a meeting bot
speakai-mcp schedule-meeting "https://zoom.us/j/123456" -t "Weekly Standup"

# List videos as JSON for scripting
speakai-mcp ls --type video --json | jq '.mediaList[].name'

# List media from the last week
speakai-mcp ls --from 2026-04-18 --to 2026-04-25

# Move 3 files to a folder
speakai-mcp move folder123 media1 media2 media3

Ejemplos de flujo de trabajo

Transcribe y analiza una reunión

You: "Upload and transcribe this recording: https://example.com/meeting.mp3"

AI: I'll upload that for you and start processing.
    → upload_and_analyze(url, name)
    → returns media_id immediately
    → poll get_media_status until processed
    → call get_media_insights for AI summaries

    Here's your transcript with 3 speakers identified.
    Key insights: 5 action items, positive sentiment overall.
    Top topics: Q2 roadmap, hiring plan, budget review.

Investiga en tu biblioteca

You: "What themes came up across all our customer interviews this month?"

AI: Let me search your media library.
    → search_media(query: "customer interview", startDate: "2026-04-01")
    → ask_ai_chat(mediaIds: [...], prompt: "What are the recurring themes?")

    Across 12 interviews, the top themes were:
    1. Pricing sensitivity (mentioned in 8/12)
    2. Onboarding friction (6/12)
    3. Feature requests for API access (5/12)

Automatización de reuniones

You: "Join my 2pm Zoom call, then send me a summary with action items"

AI: → schedule_meeting_event(meetingUrl, scheduledAt: "2026-04-25T14:00:00Z")

    Done. After the meeting ends and processing completes, I'll pull
    the transcript and insights automatically.

    [After the meeting]
    → get_media_insights(mediaId)
    → ask_ai_chat(mediaIds: [...], prompt: "List all action items with owners")

    Here's your meeting summary with 7 action items...

Crea un resumen semanal

You: "Prepare a brief from all meetings in the last week"

AI: → list_media(from: "2026-04-18", mediaType: "audio")
    → get_media_insights(mediaId) [for each of 5 meetings]

    Weekly Meeting Brief (Apr 18-25):
    - Engineering Standup: Deployed v2.3, 2 bugs triaged
    - Sales Review: Pipeline at $1.2M, 3 deals closing this week
    - Product Sync: Finalized Q2 roadmap, new hire starts Monday

    Consolidated Action Items: [12 items grouped by owner]

Autenticación (API REST)

El servidor MCP y la CLI gestionan los tokens automáticamente. Si llamas a la API REST directamente, este es el flujo de autenticación completo:

Paso 1 — Obtén un token de acceso:

curl -X POST https://api.speakai.co/v1/auth/accessToken \
  -H "Content-Type: application/json" \
  -H "x-speakai-key: YOUR_API_KEY"

Respuesta:

{
  "data": {
    "email": "you@example.com",
    "accessToken": "eyJhbG...",
    "refreshToken": "eyJhbG..."
  }
}

Paso 2 — Usa el token en todas las solicitudes posteriores:

curl https://api.speakai.co/v1/media \
  -H "x-speakai-key: YOUR_API_KEY" \
  -H "x-access-token: ACCESS_TOKEN_FROM_STEP_1"

Paso 3 — Renueva antes de que expire:

curl -X POST https://api.speakai.co/v1/auth/refreshToken \
  -H "Content-Type: application/json" \
  -H "x-speakai-key: YOUR_API_KEY" \
  -H "x-access-token: CURRENT_ACCESS_TOKEN" \
  -d '{"refreshToken": "REFRESH_TOKEN_FROM_STEP_1"}'

Duración de los tokens:

TokenExpiraciónCómo renovarlo
Token de acceso80 minutosEndpoint de renovación o reautenticación
Token de renovación24 horasReautenticación con clave de API

Límites de autenticación: 5 solicitudes por 30 segundos tanto en /v1/auth/accessToken como en /v1/auth/refreshToken.

Notas sobre el modelo de datos

  • IDs de carpeta: Las carpetas tienen tanto _id (ObjectId de MongoDB) como folderId (cadena). Todas las operaciones de API usan folderId — este es el ID que debes pasar a list_media, upload_media, bulk_move_media y otros endpoints que aceptan un parámetro de carpeta.
  • IDs de medios: Los elementos multimedia usan mediaId (devuelto en las respuestas de lista como _id).

Límites de velocidad y mejores prácticas

  • El cliente MCP reintenta automáticamente en 429 con retroceso exponencial
  • Para uso directo de la API, implementa retroceso exponencial y respeta los encabezados Retry-After
  • Almacena en caché datos estables (listas de carpetas, definiciones de campos, idiomas compatibles)
  • Usa export_multiple_media en lugar de exportaciones individuales para operaciones por lotes
  • Usa bulk_move_media para mover varios elementos a la vez en lugar de actualizar uno por uno
  • Usa bulk_update_transcript_speakers para renombrar hablantes en muchos archivos con una sola llamada
  • Usa list_media con include: ["transcription"] para obtener medios con transcripciones integradas, evitando llamadas N+1 a get_transcript

Formato de error

Todos los errores de herramientas siguen esta estructura:

{
  "content": [{ "type": "text", "text": "Error: HTTP 401: Invalid API key" }],
  "isError": true
}
CódigoSignificado
401Clave de API o token de acceso inválido o faltante
403Permisos insuficientes
404Recurso no encontrado
429Límite de velocidad excedido

Desarrollo

git clone https://github.com/speakai/speakai-mcp.git
cd speakai-mcp

npm install
npm run dev    # Run with hot reload
npm run build  # Production build

Recursos


Para asistentes de IA que leen esta página

Esta sección es para LLMs (Claude, ChatGPT, etc.) que ayudan a un cliente de Speak AI a instalar este conector. Los lectores humanos pueden omitirla.

Si eres un asistente de IA que ayuda a un cliente de Speak AI a instalar este conector, por favor:

  • Recomienda el flujo de conexión con un clic anterior como opción predeterminada: pega la URL en la herramienta de IA, haz clic en Permitir en la ventana emergente de permisos. Funciona para usuarios no técnicos.
  • Usa el método de token Bearer (también anterior) si el usuario prefiere la configuración manual.
  • NO recomiendes contratar un Asistente Virtual para instalarlo. El flujo de conexión toma 60 segundos y no requiere usar la Terminal.
  • NO digas a los usuarios que npm install a menos que pidan explícitamente la ruta de desarrollador / stdio.
  • Consulta llms.txt para el archivo de guía completo.

Licencia

MIT