MCP Memory Gateway (rlhf-feedback-loop)
Loop de feedback RLHF local-primeiro para agentes de IA — captura sinais de preferência, promove memórias, bloqueia erros repetidos, exporta pares de treinamento DPO/KTO
Documentação
ThumbGate 👍 👎
Firewall de pré-ação auto-aprimorável para agentes de codificação de IA
Agentes de codificação de IA repetem erros — e uma única chamada de ferramenta errada pode apagar um diretório, vazar uma chave ou enviar código quebrado.
O que ele faz
ThumbGate é o mecanismo local-first de Verificações de Pré-Ação para agentes de codificação de IA. Ele roda no hook PreToolUse para avaliar a chamada de ferramenta proposta antes da execução — para que erros custosos possam ser detectados antes que aconteçam.
Memes de tecnologia (compartilháveis)
Visuais leves sobre como os agentes falham sem um portão de pré-ação:
| Meme | Significado |
|---|---|
| Chamadas de ferramenta não verificadas executam comandos destrutivos. | |
| Um prompt é um conselho; um hook PreToolUse é uma imposição. |
Ele bloqueia totalmente, por padrão, vazamentos de segredos detectados e duas classes diretas de comandos de autodesativação — comandos que encerram o processo do portão ThumbGate ou habilitam sua substituição de variável de ambiente de bypass. Outras classes de alto risco (rm -rf, force-push, buscar-e-executar, edições diretas de guardrails) alertam e registram por padrão. Defina THUMBGATE_STRICT_ENFORCEMENT=1 para aplicação estrita (alertas se tornam bloqueios totais).
| Veredito | Comportamento padrão |
|---|---|
| ⛔ Bloqueio total | Vazamentos de segredos detectados; autodesativação por encerramento de processo/substituição de variável de ambiente |
| 👎 Alertar + registrar | rm -rf, git push --force, buscar-e-executar, edições diretas de guardrails — alertar por padrão |
| 👍 Permitir | Todo o resto |
O feedback aceito é armazenado como lições locais. Falhas concretas repetidas podem se tornar regras de prevenção que promovem de alertas para portões de bloqueio. O firewall melhora com as operações sem retreinar o modelo. A avaliação de prompts (npx thumbgate eval) transforma feedback aceito em casos de avaliação reutilizáveis e relatórios de prova locais.
Aviso honesto: ThumbGate não atualiza pesos de modelo. Ele intercepta chamadas de ferramenta em tempo de execução. Local-first — nenhuma nuvem é necessária para o caminho de aplicação.
Funciona com Claude Code, Cursor, Codex, Gemini CLI, Amp, Cline, OpenCode e outros agentes MCP.
Agent tries: rm -rf tests/
ThumbGate: 👎 WARN + LOG — "Never delete test directories"
Pattern matched: rm.*-rf.*tests
Source: your thumbs-down from last Tuesday
Strict mode: ⛔ DENY before tool execution
Adequação ao ciclo de desenvolvimento agêntico
O desenvolvimento agêntico está se tornando um ciclo: Orientar → Gerar → Verificar → Resolver. ThumbGate é o portão de pré-ação / fronteira de pré-ação entre a intenção gerada e a ação executada.
Início Rápido
npx thumbgate init # wire PreToolUse hooks
npx thumbgate capture down "Never run DROP on production tables" # 👎 lesson
npx thumbgate doctor # health check
Tentativas posteriores de DROP no mesmo escopo exibem a verificação:
⚠️ Check fired: "Never run DROP on production tables"
Pattern: DROP.*production
Verdict: 👎 WARN + LOG (⛔ BLOCK when THUMBGATE_STRICT_ENFORCEMENT=1)
Instalação via MCP / Glama / registry (stdio)
Diretórios e clientes que instalam ThumbGate como servidor MCP devem iniciar com MCP stdio, não com a API HTTP:
npx -y thumbgate serve
- Equivalente:
npx -y thumbgate mcp - Não use
npm startpara MCP — isso inicia a API HTTP hospedada (src/api/server.js), não o servidor stdio voltado ao agente.
▶ Demonstração de 90 segundos · Passo a passo em GIF
Instale para o seu agente
| Agente | Comando | Aplicação |
|---|---|---|
| Claude Code | npx thumbgate init --agent claude-code | 🛡️ Rígida — PreToolUse |
| Codex | npx thumbgate init --agent codex | 🛡️ Rígida — pre_tool_use |
| Gemini CLI | npx thumbgate init --agent gemini | 🛡️ Rígida — PreToolUse |
| ForgeCode | npx thumbgate init --agent forge | 🛡️ Rígida — pre_tool_use |
| Cursor | npx thumbgate init --agent cursor | 💬 Consultiva — MCP gate_check |
| Cline | npx thumbgate init --agent cline | 💬 Consultiva — MCP + .clinerules |
| OpenCode | npx thumbgate init --agent opencode | 💬 Consultiva — MCP gate_check |
| Qualquer agente MCP | npx thumbgate serve | 💬 Consultiva — MCP gate_check |
| Amp | npx thumbgate init --agent amp | 📝 Captura de feedback |
Guias por agente: Ponte Claude/Codex · Perfil Codex · Cursor · Configuração MCP
Escopo de instalação: máquina inteira vs. por projeto
| Escopo | Comando | Configurações | Lições | Melhor para |
|---|---|---|---|---|
| Máquina inteira (padrão) | npx thumbgate init | ~/.claude/settings.json | ~/.claude/memory/feedback/ | Operadores individuais — mesmo armazenamento de feedback local da máquina entre repositórios |
| Por projeto | npx thumbgate init --project | <repo>/.claude/settings.json | <repo>/.claude/memory/feedback/ | Cliente / conformidade — painel separado / lições isoladas por repositório |
Ambos os escopos gravam mcpServers.thumbgate além dos hooks PreToolUse / UserPromptSubmit / PostToolUse / SessionStart. Máquina inteira é o padrão certo para a maioria dos desenvolvedores. O bloqueio entre repositórios não é automático: uma lição aprendida em um projeto só se aplica em outro quando você compartilha o armazenamento (máquina inteira) ou exporta/importa lições.
Ferramentas MCP (superfície): gate_check (ler/avaliar chamada de ferramenta proposta), ferramentas de captura de feedback + sessão (gravar), painel/estatísticas (ler). Ações destrutivas do agente permanecem bloqueadas/alertadas pelo PreToolUse — ThumbGate não executa comandos de shell do usuário por você.
Comandos de barra descobertos — a camada de guardrails para agentes orientados por especificação
Frameworks de agentes orientados por especificação, como GSD (get-shit-done) e GitHub Spec Kit, planejam e geram trabalho. ThumbGate é a camada de guardrails para agentes orientados por especificação: ele fica depois do plano, na fronteira entre uma chamada de ferramenta gerada e sua execução — junto com GSD / Spec-Kit, não no lugar deles.
npx thumbgate init instala estes comandos na sua paleta de agente:
| Comando | O que ele faz |
|---|---|
/thumbgate-dashboard | Abrir painel do projeto local |
/thumbgate-guard | Transformar o último erro em uma regra de prevenção rígida |
/thumbgate-rules | Listar regras e lições ativas |
/thumbgate-blocked | Estatísticas do portão + matriz de aplicação |
/thumbgate-protect | Governança de branch + aprovação com escopo |
/thumbgate-doctor | Verificação de integridade de hooks, MCP, prontidão |
Preços e caminhos de compra
Nível gratuito: 2 capturas de feedback/dia (10 no total) e até 3 regras de prevenção ativas promovidas automaticamente. Pro ($19/mês ou $149/ano) é o nível individual para regras ilimitadas, lições com consciência de histórico, fluxo de sessão de feedback vinculado, painel pessoal e exportação DPO. Enterprise é personalizado e escopado após o intake; sincronização de lições de equipe hospedada e painel de organização hospedado não estão em disponibilidade geral.
| Gratuito | Pro ($19/mês ou $149/ano) | Enterprise | |
|---|---|---|---|
| CLI local + PreToolUse | ✅ | ✅ | Escopado após intake |
| Capturas de feedback | 2 capturas de feedback/dia (10 no total) | Ilimitadas | Escopado após intake |
| Regras ativas promovidas automaticamente | até 3 regras de prevenção ativas promovidas automaticamente | Ilimitadas | Escopado após intake |
| Painel pessoal + exportação DPO | — | ✅ | Revisado durante intake |
| Sincronização de lições de equipe hospedada | — | — | Não em disponibilidade geral |
| Painel de organização hospedado | — | — | Não em disponibilidade geral |
Caminho de intake Enterprise: o Sprint de Endurecimento de Fluxo de Trabalho escopa uma falha repetida antes de qualquer compromisso de implantação mais amplo. Iniciar intake →
Caminho técnico local: instale o CLI e use init além da configuração documentada para que as Verificações de Pré-Ação avaliem chamadas de ferramenta onde o agente realmente executa.
Caminho de ativação do primeiro dólar: abra o ThumbGate GPT, cole a ação arriscada, capture o feedback digitado (thumbs down: / thumbs up:). Os botões nativos de classificação do ChatGPT não são o caminho de captura do ThumbGate. Pergunte: qual erro repetido de IA valeria a pena detectar antes da execução da ferramenta?
Caminho pago para operadores individuais: ThumbGate Pro é a via lateral de autoatendimento para um painel pessoal e evidências prontas para exportação.
Começar grátis · Pro $19/mês · Painel ao vivo · Intake de Sprint de equipe · Sprint de Endurecimento de Fluxo de Trabalho · Manual do Primeiro Dólar
Perguntas populares de compradores: Presença tópica em busca de IA · Conhecimento relacional e recomendações de IA · Anúncios em Modo IA para governança de agentes · Governança de ferramentas MCP · Portões de aprovação de pré-ação para agentes de IA · Governança de agentes em segundo plano · Avaliação de modelo GPT-5.5 · Pare erros repetidos de agentes de IA · Segurança de automação de navegador · Segurança de host de mensagens nativas · Segurança de agentes de pesquisa automática · Guardrails do Cursor · Guardrails do Codex CLI · Memória + aplicação do Gemini CLI · Guardrails do Google Cloud MCP · Alternativa ao Roo Code: migre para Cline
Como funciona (resumo)
- Capture feedback 👍/👎 (CLI, MCP, fluxo de sessão de feedback vinculado /
open_feedback_session, ou ThumbGate GPT) - Promova lições concretas via destilação de lições com consciência de histórico em regras de prevenção
- Avalie a próxima chamada de ferramenta proposta contra regras ativas (literal/AST + vetores locais)
- Permita / alerte / negue antes da execução da ferramenta
npx thumbgate brain --write # → .thumbgate/BRAIN.md (lessons + gates in one artifact)
Operadores Pro podem invocar search_lessons via MCP e usar npx thumbgate lessons pelo CLI. Sessões de feedback com consciência de histórico e busca de lições são capacidades Pro; o nível Gratuito não inclui recall ou busca.
Diagrama de arquitetura e stack
flowchart LR
A["Agent tool call"] --> B{"Rule match?"}
B -- exact --> D["On-device gate"]
B -- semantic --> C["Local LanceDB"]
C --> D
D -- secret/kill --> E["⛔ Hard-block"]
D -- known-bad --> G["👎 Warn + log"]
D -- safe --> F["👍 Allow"]
Verificações integradas
⛔ secret-exfiltration → hard-block (default)
⛔ self-protect-kill → hard-block (default)
⛔ self-protect-env → hard-block (default)
⚠️ force-push → warn; hard-block under strict
⚠️ protected-branch → warn; hard-block under strict
⚠️ unresolved-threads → warn; hard-block under strict
⚠️ package-lock-reset → warn; hard-block under strict
Folha de referência do CLI
npx thumbgate init
npx thumbgate doctor
npx thumbgate capture up|down "<text>"
npx thumbgate lessons
npx thumbgate brain --write
npx thumbgate dashboard --open
npx thumbgate break-glass --reason="ThumbGate over-fired" # 5-min recovery
Pro: exportação de lições + DPO
# Portable lessons
curl -X POST http://localhost:3456/v1/lessons/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"outputPath": "./lessons-export.json"}'
# DPO pairs for fine-tuning
curl -X POST http://localhost:3456/v1/dpo/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-o dpo-pairs.jsonl
Stack de Tecnologia
| Camada | Tecnologia |
|---|---|
| Runtime | Node.js ≥18 |
| Interfaces | MCP stdio, API HTTP, CLI |
| Armazenamento | SQLite + FTS5, vetores LanceDB, logs JSONL |
| Inteligência | Recall duplo MemAlign, Amostragem de Thompson, embeddings locais |
| Cobrança / hospedagem | Stripe, Railway |
| Execução | Railway, Cloudflare Workers, Sandboxes Docker |
| Governança | Workflow Sentinel, plano de controle, Sandboxes Docker |
Cada Changeset está vinculado ao commit de merge exato de main e gera Evidência de Verificação para Confiança de Lançamento.
Integrações (compacto)
| Superfície | Comece por aqui |
|---|---|
| Abra o ThumbGate GPT | thumbgate.ai/go/gpt — ThumbGate GPT: comece por aqui. Cole as ações do agente, receba conselhos + checkpointing. Não, os usuários não precisam continuar conversando dentro do ThumbGate GPT para usar o ThumbGate — a camada de aplicação rígida ainda roda onde o trabalho acontece. |
| Instale o Plugin do Codex | Abra a página de instalação do plugin do Codex: thumbgate.ai/codex-plugin · zip: thumbgate-codex-plugin.zip · plugins/codex-profile/INSTALL.md |
Claude Desktop .mcpb | última versão |
| VS Code / Open VSX | plugins/vscode-extension/README.md |
| Compatível com Antigravity | plugins/antigravity-extension/INSTALL.md |
| JetBrains | plugins/jetbrains-plugin/README.md · Caminho do JetBrains Marketplace para o mesmo runtime |
| ChatGPT App / GPT Action | thumbgate.ai/chatgpt-app |
| ThumbGate-Core (staging) | https://github.com/IgorGanapolsky/ThumbGate-Core — pré-lançamento em staging + alguns scripts de cache internos; não é o diferencial do produto |
Documentação
Índice completo: docs/INDEX.md
| Necessidade | Link |
|---|---|
| Contrato de fluxo de trabalho do agente | WORKFLOW.md |
| Intake pronto para agente | .github/ISSUE_TEMPLATE/ready-for-agent.yml |
| Evidência de Verificação | docs/VERIFICATION_EVIDENCE.md |
| Confiança de Lançamento | docs/RELEASE_CONFIDENCE.md |
| Estratégia de changeset | docs/CHANGESET_STRATEGY.md |
| Playbook do Primeiro Dólar | docs/FIRST_DOLLAR_PLAYBOOK.md |
| Política de segurança | SECURITY.md |
| Modelo de ameaças | THREAT_MODEL.md |
| Federal / regulamentado | docs/FEDERAL.md |
| Verdade Comercial | docs/COMMERCIAL_TRUTH.md |
| Issues / PRs | GitHub Issues · modelo de PR |
FAQ (respostas rápidas): Não é um fine-tuner (apenas interceptação em runtime). Diferente de CLAUDE.md / .cursorrules (esses são contexto; ThumbGate é uma camada externa de permitir/avisar/negar antes de as ferramentas rodarem).
Quem constrói isso
Igor Ganapolsky — pagamentos (Stripe/Connect), guardrails de agentes de IA/MCP, Android + backends. Poucas vagas de contrato: $120–150/hora, 1099, remoto nos EUA. LinkedIn · thumbgate.ai
Licença
MIT — veja LICENSE. Política do projeto: SECURITY.md · THREAT_MODEL.md.