Voice MCP
Permite interações por voz com Claude e outros LLMs usando uma chave de API da OpenAI para serviços de STT/TTS.
Documentação
VoiceMode
Conversas de voz naturais com Claude Code (e outros agentes compatíveis com MCP)
O VoiceMode permite conversas de voz naturais com Claude Code. Voz não é sobre substituir a digitação — é sobre estar disponível quando digitar não é possível.
Perfeito para:
- Caminhando para sua próxima reunião
- Cozinhando enquanto depura
- Dando um descanso aos seus olhos após horas de tela
- Segurando um café (ou um cachorro)
- Qualquer momento em que suas mãos ou olhos estejam ocupados
Veja em Ação
Início Rápido
Requisitos: Computador com microfone e alto-falantes
Opção 1: Plugin Claude Code (Recomendado)
A maneira mais rápida para usuários de Claude Code começarem:
# Add the VoiceMode marketplace
claude plugin marketplace add mbailey/voicemode
# Install VoiceMode plugin
claude plugin install voicemode@voicemode
## Install dependencies (CLI, Local Voice Services)
/voicemode:install
# Start talking!
/voicemode:converse
Opção 2: Pacote instalador Python
Instala dependências e o pacote Python do VoiceMode.
# Install UV package manager (if needed)
curl -LsSf https://astral.sh/uv/install.sh | sh
# Run the installer (sets up dependencies and local voice services)
uvx voice-mode-install
# Add to Claude Code
claude mcp add --scope user voicemode -- uvx --refresh --from voice-mode voicemode-mcp-launcher
# Optional: Add OpenAI API key as fallback for local services
export OPENAI_API_KEY=your-openai-key
# Start a conversation
claude converse
Para configuração manual, veja o Guia de Introdução.
Recursos
- Conversas naturais — fale naturalmente, ouça respostas imediatamente
- Funciona offline — serviços de voz locais opcionais (Whisper STT, Kokoro TTS)
- Baixa latência — rápido o suficiente para parecer uma conversa real
- Detecção inteligente de silêncio — para de gravar quando você para de falar
- Opções de privacidade — execute totalmente localmente ou use serviços em nuvem
Compatibilidade
Plataformas: Linux, macOS, Windows (nativo ou WSL), NixOS Python: 3.10-3.14
Configuração
O VoiceMode funciona imediatamente. Para personalização:
# Set OpenAI API key (if using cloud services)
export OPENAI_API_KEY="your-key"
# Or configure via file
voicemode config edit
Veja o Guia de Configuração para todas as opções.
Configuração de Permissões (Opcional)
Para usar o VoiceMode sem prompts de permissão, adicione a ~/.claude/settings.json:
{
"permissions": {
"allow": [
"mcp__voicemode__converse",
"mcp__voicemode__service"
]
}
}
Veja o Guia de Permissões para mais opções.
Serviços de Voz Locais
Para privacidade ou uso offline, instale serviços de fala locais:
- Whisper.cpp — Transcrição de fala para texto local
- Kokoro — Texto para fala local com múltiplas vozes
Eles fornecem a mesma API que a OpenAI, então o VoiceMode alterna perfeitamente entre eles.
Detalhes de Instalação
Dependências do Sistema por Plataforma
Ubuntu/Debian
sudo apt update
sudo apt install -y ffmpeg gcc libasound2-dev libasound2-plugins libportaudio2 portaudio19-dev pulseaudio pulseaudio-utils python3-dev
Usuários WSL2: Os pacotes pulseaudio acima são necessários para acesso ao microfone.
Fedora/RHEL
sudo dnf install alsa-lib-devel ffmpeg gcc portaudio portaudio-devel python3-devel
macOS
brew install ffmpeg node portaudio
NixOS
# Use development shell
nix develop github:mbailey/voicemode
# Or install system-wide
nix profile install github:mbailey/voicemode
Métodos Alternativos de Instalação
A partir do código-fonte
git clone https://github.com/mbailey/voicemode.git
cd voicemode
uv tool install -e .
NixOS em todo o sistema
# In /etc/nixos/configuration.nix
environment.systemPackages = [
(builtins.getFlake "github:mbailey/voicemode").packages.${pkgs.system}.default
];
Solução de Problemas
| Problema | Solução |
|---|---|
| Sem acesso ao microfone | Verifique as permissões do terminal/aplicativo. WSL2 precisa dos pacotes pulseaudio. |
| UV não encontrado | Execute curl -LsSf https://astral.sh/uv/install.sh | sh |
| Erro na API OpenAI | Verifique se OPENAI_API_KEY está definido corretamente |
| Sem saída de áudio | Verifique as configurações de áudio do sistema e os dispositivos disponíveis |
Salvar Áudio para Depuração
export VOICEMODE_SAVE_AUDIO=true
# Files saved to ~/.voicemode/audio/YYYY/MM/
Documentação
- Introdução — Guia completo de configuração
- Configuração — Todas as variáveis de ambiente
- Configuração do Whisper — Transcrição de fala para texto local
- Configuração do Kokoro — Texto para fala local
- Configuração de Desenvolvimento — Guia de contribuição
Documentação completa: voicemode.dev
Links
- Site: voicemode.dev
- GitHub: github.com/mbailey/voicemode
- PyPI: pypi.org/project/voice-mode
- YouTube: @getvoicemode
- Twitter/X: @getvoicemode
- Newsletter:
Licença
MIT — Um projeto Failmode
mcp-name: dev.voicemode/voicemode
