ask-gemini-mcp
Servidor MCP que permite que assistentes de IA interajam com o Google Gemini CLI
Documentação
Ask LLM
Dê ao seu assistente de codificação com IA uma segunda opinião — de um modelo diferente.
Claude Code, Codex CLI, Cursor, Claude Desktop ou qualquer um dos 40+ clientes MCP pode chamar Codex, Claude, Grok, Antigravity, Ollama ou Gemini para revisar um diff, debater um plano ou encontrar o bug que o primeiro modelo não viu. MCP padrão; sem hacks de prompt.
Início Rápido · Escolha um revisor · Plugin Claude Code · Documentação · Pacotes
You: ask codex to review src/auth.ts for security issues
Codex: ⚠ verifyToken() compares tokens with === — not timing-safe (line 42)
⚠ the session cookie is missing a SameSite attribute
Claude: Good catches — applying both fixes to src/auth.ts.
Um prompt. Um segundo modelo revisa de forma independente; seu assistente aplica a correção. Sem copiar e colar entre ferramentas.
Por que uma segunda opinião?
Sua IA principal é confiante, mas confiança não é o mesmo que precisão. Um segundo modelo, sem interesse na primeira resposta, encontra o que ela deixou passar.
| Você quer… | Ask LLM faz |
|---|---|
| Revisar um diff | Um modelo diferente analisa suas alterações e aponta problemas que sua IA principal não viu |
| Debater um plano | Envie uma proposta de arquitetura para crítica, alternativas e análise de trade-offs |
| Obter uma segunda opinião sobre código | Outro modelo revisa uma abordagem de forma independente antes de você se comprometer com ela |
| Ler mais do que cabe | Gemini e Antigravity processam repositórios inteiros em uma única chamada (1M+ tokens) |
| Manter tudo local | Roteie revisões pelo Ollama quando nada puder sair da sua máquina |
| Comparar modelos lado a lado | multi-llm envia um prompt para vários provedores em paralelo |
Início Rápido
Pré-requisitos: Node.js 24+ (o LTS atual), em Linux ou macOS, e pelo menos uma CLI de provedor instalada e autenticada (veja Configuração do provedor).
npm install -g @ask-llm/mcp
Claude Code
ask-llm setup --host claude
A configuração mostra uma prévia do registro no escopo do usuário e pede confirmação antes de aplicar. Depois, tente: ask codex to review my last commit. Execute ask-llm doctor se algo parecer errado. Veja compatibilidade de comandos para -y, remoção e outros hosts.
Avançado: instale pacotes de provedores separados
claude mcp add --scope user codex -- npx -y @ask-llm/codex-mcp
claude mcp add --scope user grok -e XAI_API_KEY="$XAI_API_KEY" -- npx -y @ask-llm/grok-mcp
claude mcp add --scope user antigravity -- npx -y @ask-llm/antigravity-mcp
claude mcp add --scope user ollama -- npx -y @ask-llm/ollama-mcp
claude mcp add --scope user gemini -- npx -y @ask-llm/gemini-mcp
Cursor
Após a instalação global acima, execute ask-llm setup --host cursor. Ele mostra uma prévia da alteração no escopo do usuário em ~/.cursor/mcp.json e pede confirmação antes de gravar. Reinicie o Cursor Agent para carregar o servidor. Para instalação no escopo do projeto ou manual, veja o guia do host Cursor.
Codex CLI
# ~/.codex/config.toml
[mcp_servers.ask-llm]
command = "npx"
args = ["-y", "@ask-llm/mcp"]
Quer que o Codex consulte especificamente o Claude? codex mcp add claude -- npx -y @ask-llm/claude-mcp
Claude Desktop
Após a instalação global acima, execute ask-llm setup --host claude-desktop. Ele mostra uma prévia da alteração no escopo do usuário em claude_desktop_config.json e pede confirmação antes de gravar. Reinicie o Claude Desktop para carregar o servidor. Veja compatibilidade de comandos para remoção, backups e formatos que exigem configuração manual.
OpenCode
Após a instalação global acima, execute ask-llm setup --host opencode. A configuração altera apenas um JSON simples opencode.json; para JSONC, ele imprime a entrada para adicionar manualmente. O registro do OpenCode tem cobertura de testes e aguarda verificação em um host instalado.
Pi
O Pi não tem cliente MCP integrado, então ele instala o pacote do host, que registra ferramentas nativas ask-* além das habilidades compartilhadas:
pi install npm:@ask-llm/plugin
Depois use /skill:codex-review, /skill:multi-review, /skill:compare, /skill:brainstorm ou apenas descreva o que você quer. Veja o guia do host Pi para detalhes sobre confiança, transferência de dados e compatibilidade.
Qualquer outro cliente MCP (STDIO)
{ "command": "npx", "args": ["-y", "@ask-llm/mcp"] }
Troque @ask-llm/mcp por @ask-llm/codex-mcp, @ask-llm/claude-mcp, @ask-llm/grok-mcp, @ask-llm/antigravity-mcp, @ask-llm/ollama-mcp ou @ask-llm/gemini-mcp para instalar um único provedor.
Escolha seu revisor
O servidor unificado @ask-llm/mcp é a instalação recomendada: um registro, todos os provedores que você tem e fan-out paralelo via multi-llm. Cada provedor também está disponível separadamente.
| Provedor | Melhor para | Modelo (padrão → fallback) | Requer |
|---|---|---|---|
| Codex | Raciocínio de código, revisões direcionadas, crítica de arquitetura | gpt-6-astra → gpt-5.6-terra | Conta OpenAI/Codex |
| Claude | Uma opinião independente do Claude a partir do Codex ou outro host que não seja Claude | opus (Opus 5.5) → sonnet | CLI do Claude Code; ferramentas de workspace somente leitura |
| Grok | Crítica do Grok 4.7 via API xAI ou CLI oficial do Grok | grok-4.7, raciocínio high (sem fallback) | XAI_API_KEY ou CLI do Grok; um harness explícito por chamada |
| Antigravity | Segunda opinião com assinatura; leituras de contexto grande | gemini-3.1-pro → gemini-3.8-flash (--effort high) | Google AI Pro/Ultra; CLI agy. Experimental, one-shot; execução MCP exige opt-in sem isolamento |
| Ollama | Revisão privada, offline e sem custo | qwen3.8:27b (sem fallback automático) | Ollama rodando localmente |
| Gemini | Leitura de repositórios inteiros (1M+ tokens) | gemini-3.1-pro-preview → gemini-3.8-flash | Assento Gemini empresarial (veja nota) |
A CLI do Gemini é exclusiva para empresas desde 2026-06-18. O Google restringiu a CLI do Gemini a assentos Gemini Code Assist Standard/Enterprise; contas gratuitas, Google AI Pro e Ultra perderam o acesso.
@ask-llm/gemini-mcpainda instala, mas contas não empresariais recebem orientação acionável em vez de saída. Em um plano de assinatura, use Antigravity (o sucessor sancionado do Google, coberto por AI Pro/Ultra), Codex, Claude ou Ollama. Anúncio
Os fallbacks são acionados apenas sob condições documentadas de cada provedor (cota para Gemini/Codex, sobrecarga para Claude, limite de taxa para Antigravity). Grok e Ollama nunca substituem um modelo: o Grok envia o ID do catálogo do harness exatamente como está, e o Ollama retorna um erro claro de ollama pull se o modelo solicitado não estiver local. Detalhes completos em Seleção de Modelo.
O plugin Ask LLM (Claude Code, Cursor Agent, Pi)
O MCP dá ao seu assistente as ferramentas. O pacote canônico @ask-llm/mcp também é dono dos fluxos de trabalho: revisões por comando de barra com pipeline de validação, brainstorming com vários modelos e revisão contínua em pares com opt-in. @ask-llm/plugin continua sendo uma ponte dependente para instalações existentes.
/plugin marketplace add Lykhoyda/ask-llm
/plugin install ask-llm@ask-llm-plugins
| Comando | O que faz |
|---|---|
/multi-review | Revisão paralela Antigravity + Codex com pipeline de validação em 4 fases e destaque de consenso |
/codex-review · /gemini-review · /ollama-review · /antigravity-review | Revisões de provedor único com filtro de confiança |
/sol-review | Revisão GPT-6 Sol com modelo fixo via Codex |
/grok-review | Revisão Grok medida via xAI com atribuição exata de modelo e sem fallback |
/fable-review | Revisão isolada e somente leitura que solicita o modelo nativo Fable e divulga limites de verificação em tempo de execução |
/brainstorm | Claude Opus pesquisa seus arquivos reais em paralelo com provedores externos e depois sintetiza, ponderando achados verificados com mais peso. Também suporta um painel exato sem Gemini com Grok + GPT-6 Sol roteado pelo Cursor Agent |
/compare | Respostas lado a lado brutas de vários provedores, sem síntese |
codex-pair | Revisão contínua com opt-in em gpt-6-sol com esforço médio: Codex verifica cada Edit/Write/MultiEdit quando um marcador .codex-pair/context.md está presente |
Os agentes de revisão seguem um pipeline de 4 fases inspirado no plugin de revisão de código da Anthropic: coleta de contexto, construção de prompt com exclusões explícitas de falsos positivos, síntese e validação no nível da fonte de cada achado.
Matriz de suporte a hosts
@ask-llm/mcp é dono dos assets canônicos do host e do corpus de habilidades; @ask-llm/plugin é uma ponte de compatibilidade dependente. Claude Code carrega seus agentes e hooks do marketplace; Cursor Agent carrega as habilidades adaptadas /codex-pair e /grok-pair via Agent Skills além de mcp.json (agent --plugin-dir ./packages/llm-mcp; veja o guia do host Cursor Agent); Pi carrega ferramentas nativas explícitas, adaptadores de habilidades portáteis e uma extensão fina de ciclo de vida.
| Capacidade | Claude Code | Cursor Agent | Host Codex CLI | Pi |
|---|---|---|---|---|
| Transporte do provedor | MCP | MCP (mcp.json, unificado ask-llm apenas) | MCP | ferramentas nativas Ask LLM (sem MCP integrado) |
| Habilidades de revisão/comparação/brainstorm | sim | Agent Skills | apenas ferramentas | /skill:<name> + linguagem natural |
| Contextos de revisor isolados / Fable | sim | não; fable-review excluído | não | não; fable-review excluído |
| codex-pair | hooks | sessão persistente sob demanda | não | extensão de ciclo de vida |
/grok-pair | sim (rota explícita Cursor/xAI/CLI) | rotas diretas xAI/CLI via ask-llm unificado fixado (ou ask-grok instalado pelo usuário) | não | excluído |
| Portão de parada HIGH bloqueante | opt-in | não | não | não; exibido sem bloqueio |
| Pareamento assíncrono em impressão one-shot | n/d | habilidade sob demanda | não | sem suporte |
Especificidades do Pi: codex-pair exige o marcador do repositório, confiança do projeto Pi e consentimento interativo de propriedade do usuário via /codex-pair; um marcador commitado sozinho nunca autoriza transferência de fonte ou custo. Pi exibe achados sem bloqueio e não reivindica o portão de parada bloqueante do Claude nem paridade de impressão one-shot. fable-review é exclusivo do Claude Code. A autenticação da CLI do provedor é separada do login do modelo host do Pi. Atualize ou remova com pi update npm:@ask-llm/plugin / pi remove npm:@ask-llm/plugin.
Veja a documentação do plugin para hooks, agentes e configuração.
Ferramentas MCP
| Ferramenta | Pacote | Finalidade |
|---|---|---|
ask-llm | @ask-llm/mcp | Orquestrador unificado: escolha um provedor por chamada ou distribua para todos os provedores instalados |
multi-llm | @ask-llm/mcp | Envie um prompt para vários provedores em paralelo; retorna respostas por provedor e uso em uma única chamada |
ask-codex | @ask-llm/codex-mcp | CLI do Codex. GPT-6 Astra com fallback para Terra. Omita sessionId para uso efêmero, ou passe sessionId: "" primeiro para persistir e retomar |
ask-claude | @ask-llm/claude-mcp | CLI do Claude Code. opus (Opus 5.5) com fallback para Sonnet; sessões nativas; acesso somente leitura ao workspace via Read/Glob/Grep |
ask-grok | @ask-llm/grok-mcp | Prompt único do Grok através de xai-api explícito (padrão) ou grok-cli; ID exato do modelo do harness; sem fallback de harness/modelo |
ask-cursor-agent | @ask-llm/mcp | Harness do Cursor Agent neutro em relação a modelo: provedor separado (claude, codex, gemini, grok) + modelo exato do catálogo do Cursor verificado contra essa família; modo somente leitura; sem alterações de força/confiança/gastos ou fallback |
ask-antigravity | @ask-llm/antigravity-mcp | Google Antigravity (agy) para uma segunda opinião baseada em assinatura. Experimental; uso único |
ask-ollama | @ask-llm/ollama-mcp | Ollama local. Totalmente privado, custo zero. Repetição de conversa no lado do servidor via sessionId |
ask-gemini | @ask-llm/gemini-mcp | CLI do Gemini com sintaxe de arquivo @. Contexto de token de 1M+. Saída progressiva ao vivo via stream-json |
ask-gemini-edit | @ask-llm/gemini-mcp | Blocos de edição de código estruturados OLD/NEW do Gemini |
fetch-chunk | @ask-llm/gemini-mcp | Recuperar trechos de respostas grandes em cache |
get-usage-stats | all | Totais de token por sessão, contagens de fallback, detalhamentos por provedor/modelo. Somente em memória |
diagnose | @ask-llm/mcp | Autodiagnóstico: versão do Node, resolução de PATH, presença e versões da CLI do provedor. Somente leitura |
ping | all | Teste de conexão |
Ferramentas ask-* com capacidade de sessão aceitam um sessionId opcional e retornam um AskResponse estruturado (provedor, resposta, modelo, sessionId, uso) via MCP outputSchema junto com o texto legível. O Codex exige sessionId: "" na primeira chamada para um thread retomável. O orquestrador também expõe usage://current-session como um Recurso MCP para snapshots JSON ao vivo.
O que dizer
ask codex to review the changes in src/auth.ts for security issues
ask claude for an independent opinion on this architecture (from Codex or another non-Claude client)
ask antigravity to debate the plan in docs/design.md
ask ollama to explain src/config.ts (runs locally, nothing leaves your machine)
ask gemini to summarize @. the current directory (1M+ context; @ syntax is Gemini-only)
use multi-llm to compare what codex and grok think about this approach
Mais padrões em Como Perguntar e Sessões Multi-Turno.
CLI
O binário @ask-llm/mcp (ask-llm-mcp) inicia o servidor MCP quando executado sem argumentos. Com argumentos, é uma CLI. Para registro de host (ask-llm setup, ask-llm remove) e diagnósticos de host, use o comando separado ask-llm; veja compatibilidade de comandos.
# Diagnose your setup: Node version, PATH, provider CLI versions, env vars
npx @ask-llm/mcp doctor # human-readable
npx @ask-llm/mcp doctor --json # full JSON, exit 1 on error
npx @ask-llm/mcp doctor --format toon # bounded, versioned agent-facing TOON pilot
npx @ask-llm/mcp doctor --format toon --full # full TOON escape hatch
# Interactive multi-provider REPL: switch providers, persist sessions, watch usage live
npx @ask-llm/mcp repl
O REPL mantém uma sessão por provedor (/provider codex, /new, /sessions, /usage) e herda todo o comportamento do executor: fallback de cota, saída stream-json para Gemini, retomada de sessão nativa.
Configuração do provedor
Instale e autentique os provedores que deseja consultar. O servidor unificado detecta o que está presente.
| Provedor | Configuração |
|---|---|
| CLI do Codex | Instale e faça login |
| CLI do Claude Code | Instale e faça login (para Codex ou outros clientes que consultam Claude) |
| API xAI / CLI do Grok | Defina XAI_API_KEY para o harness medido padrão, ou instale e autentique o Grok Build oficial e fixe harness: "grok-cli" por solicitação (ou defina ASK_GROK_HARNESS=grok-cli). Sem failover entre harnesses |
| CLI do Cursor | Harness opcional neutro em relação a modelo. Autentique e escolha um ID exato de agent --list-models |
CLI do Antigravity (agy) | Versão >= 1.1.5, login feito uma vez (Google AI Pro/Ultra). Verifique com agy --version |
| Ollama | Executando localmente com um modelo baixado: ollama pull qwen3.8:27b |
| CLI do Gemini | npm install -g @google/gemini-cli && gemini login. Restrito a empresas desde 2026-06-18 |
Pacotes
| Pacote | O que é | Versão | Downloads |
|---|---|---|---|
@ask-llm/mcp | Pacote canônico: servidor MCP unificado, executores de provedor e ativos de host do Claude Code, Cursor Agent e Pi | ||
@ask-llm/plugin | Ponte dependente para instalações existentes de plugin e Pi | ||
@ask-llm/codex-mcp | Servidor MCP somente Codex | ||
@ask-llm/claude-mcp | Servidor MCP somente Claude | ||
@ask-llm/grok-mcp | Servidor MCP somente Grok | ||
@ask-llm/antigravity-mcp | Servidor MCP somente Antigravity | ||
@ask-llm/ollama-mcp | Servidor MCP somente Ollama | ||
@ask-llm/gemini-mcp | Servidor MCP somente Gemini |
Migrando dos nomes de pacotes antigos
Todos os pacotes MCP públicos agora vivem na organização npm @ask-llm. Os nomes antigos estão obsoletos, mas os nomes dos executáveis não mudaram: atualize o argumento do pacote na sua configuração MCP e comandos como ask-codex-mcp e ask-llm-mcp doctor continuam funcionando após uma instalação global.
| Pacote antigo | Use em vez disso |
|---|---|
ask-llm-mcp | @ask-llm/mcp |
ask-codex-mcp | @ask-llm/codex-mcp |
@anton-lykhoyda/ask-claude-mcp | @ask-llm/claude-mcp |
ask-antigravity-mcp | @ask-llm/antigravity-mcp |
ask-ollama-mcp | @ask-llm/ollama-mcp |
ask-gemini-mcp | @ask-llm/gemini-mcp |
O guia de instalação tem o mapeamento completo de pacote para executável.
Documentação
- Site de documentação: lykhoyda.github.io/ask-llm — Começando, Como Funciona, Solução de Problemas
- Para agentes de IA: llms.txt · llms-full.txt
Contribuindo
Contribuições são bem-vindas. Comece com as issues abertas e CONTRIBUTING.md.
Licença
MIT. Veja LICENSE.
Aviso legal: Ask LLM é uma ferramenta não oficial de terceiros e não é afiliada, endossada ou patrocinada pela Anthropic, Google, OpenAI ou xAI.