Voice MCP
Permite interacciones por voz con Claude y otros LLMs usando una clave de API de OpenAI para servicios de STT/TTS.
Documentación
VoiceMode
Conversaciones de voz naturales con Claude Code (y otros agentes compatibles con MCP)
VoiceMode permite conversaciones de voz naturales con Claude Code. La voz no se trata de reemplazar la escritura, sino de estar disponible cuando escribir no es una opción.
Perfecto para:
- Caminar hacia tu próxima reunión
- Cocinar mientras depuras código
- Darle un descanso a tus ojos después de horas frente a la pantalla
- Sostener un café (o un perro)
- Cualquier momento en que tus manos u ojos estén ocupados
Míralo en acción
Inicio rápido
Requisitos: Computadora con micrófono y altavoces
Opción 1: Plugin de Claude Code (Recomendado)
La forma más rápida para que los usuarios de Claude Code comiencen:
# Add the VoiceMode marketplace
claude plugin marketplace add mbailey/voicemode
# Install VoiceMode plugin
claude plugin install voicemode@voicemode
## Install dependencies (CLI, Local Voice Services)
/voicemode:install
# Start talking!
/voicemode:converse
Opción 2: Paquete instalador de Python
Instala las dependencias y el paquete de Python de VoiceMode.
# Install UV package manager (if needed)
curl -LsSf https://astral.sh/uv/install.sh | sh
# Run the installer (sets up dependencies and local voice services)
uvx voice-mode-install
# Add to Claude Code
claude mcp add --scope user voicemode -- uvx --refresh --from voice-mode voicemode-mcp-launcher
# Optional: Add OpenAI API key as fallback for local services
export OPENAI_API_KEY=your-openai-key
# Start a conversation
claude converse
Para configuración manual, consulta la Guía de inicio.
Características
- Conversaciones naturales - habla con naturalidad, escucha respuestas de inmediato
- Funciona sin conexión - servicios de voz locales opcionales (Whisper STT, Kokoro TTS)
- Baja latencia - lo suficientemente rápido para sentirse como una conversación real
- Detección inteligente de silencio - deja de grabar cuando dejas de hablar
- Opciones de privacidad - ejecútalo completamente local o usa servicios en la nube
Compatibilidad
Plataformas: Linux, macOS, Windows (nativo o WSL), NixOS Python: 3.10-3.14
Configuración
VoiceMode funciona de inmediato. Para personalización:
# Set OpenAI API key (if using cloud services)
export OPENAI_API_KEY="your-key"
# Or configure via file
voicemode config edit
Consulta la Guía de configuración para todas las opciones.
Configuración de permisos (Opcional)
Para usar VoiceMode sin solicitudes de permiso, agrega a ~/.claude/settings.json:
{
"permissions": {
"allow": [
"mcp__voicemode__converse",
"mcp__voicemode__service"
]
}
}
Consulta la Guía de permisos para más opciones.
Servicios de voz locales
Para privacidad o uso sin conexión, instala servicios de voz locales:
- Whisper.cpp - Transcripción de voz a texto local
- Kokoro - Texto a voz local con múltiples voces
Estos proporcionan la misma API que OpenAI, por lo que VoiceMode cambia entre ellos sin problemas.
Detalles de instalación
Dependencias del sistema por plataforma
Ubuntu/Debian
sudo apt update
sudo apt install -y ffmpeg gcc libasound2-dev libasound2-plugins libportaudio2 portaudio19-dev pulseaudio pulseaudio-utils python3-dev
Usuarios de WSL2: Los paquetes de pulseaudio anteriores son necesarios para el acceso al micrófono.
Fedora/RHEL
sudo dnf install alsa-lib-devel ffmpeg gcc portaudio portaudio-devel python3-devel
macOS
brew install ffmpeg node portaudio
NixOS
# Use development shell
nix develop github:mbailey/voicemode
# Or install system-wide
nix profile install github:mbailey/voicemode
Métodos de instalación alternativos
Desde el código fuente
git clone https://github.com/mbailey/voicemode.git
cd voicemode
uv tool install -e .
NixOS a nivel de sistema
# In /etc/nixos/configuration.nix
environment.systemPackages = [
(builtins.getFlake "github:mbailey/voicemode").packages.${pkgs.system}.default
];
Solución de problemas
| Problema | Solución |
|---|---|
| Sin acceso al micrófono | Verifica los permisos de la terminal/aplicación. WSL2 necesita paquetes de pulseaudio. |
| UV no encontrado | Ejecuta curl -LsSf https://astral.sh/uv/install.sh | sh |
| Error de API de OpenAI | Verifica que OPENAI_API_KEY esté configurado correctamente |
| Sin salida de audio | Revisa la configuración de audio del sistema y los dispositivos disponibles |
Guardar audio para depuración
export VOICEMODE_SAVE_AUDIO=true
# Files saved to ~/.voicemode/audio/YYYY/MM/
Documentación
- Inicio - Guía de configuración completa
- Configuración - Todas las variables de entorno
- Configuración de Whisper - Transcripción de voz a texto local
- Configuración de Kokoro - Texto a voz local
- Configuración de desarrollo - Guía para contribuir
Documentación completa: voicemode.dev
Enlaces
- Sitio web: voicemode.dev
- GitHub: github.com/mbailey/voicemode
- PyPI: pypi.org/project/voice-mode
- YouTube: @getvoicemode
- Twitter/X: @getvoicemode
- Boletín:
Licencia
MIT - Un proyecto de Failmode
mcp-name: dev.voicemode/voicemode
