MCP Memory Gateway (rlhf-feedback-loop)
Loop de feedback RLHF local-primeiro para agentes de IA — captura sinais de preferência, promove memórias, bloqueia erros repetidos, exporta pares de treinamento DPO/KTO
Documentação
ThumbGate 👍 👎
ThumbGate é o firewall pré-ação auto-aprimorável para agentes de codificação de IA
Agentes de codificação de IA repetem erros — e uma única chamada de ferramenta errada pode apagar um diretório, vazar uma chave ou enviar código quebrado.
O que ele faz
ThumbGate é o mecanismo local-first de Verificações Pré-Ação para agentes de codificação de IA. Ele roda no hook PreToolUse para avaliar a chamada de ferramenta proposta antes da execução — para que erros custosos possam ser detectados antes que aconteçam.
O crescimento de estrelas do ThumbGate no GitHub é medido com o endpoint GET /repos/{owner}/{repo}/stargazers/history seguro para privacidade do GitHub (contagens semanais, sem identidades de quem deu estrela). Execute npm run stars:history -- --fixture tests/fixtures/github-star-history.json --json para a prova local. Estrelas não são instalações npm e não são receita. A Action ao vivo do GitHub Marketplace é ThumbGate Agent Governance (uses: IgorGanapolsky/ThumbGate@v1).
Uso acima de contagem de estrelas. Avalie o ThumbGate pelo caminho de instalação e pelos badges de uso ao vivo acima (npx thumbgate init, Marketplace uses:, downloads semanais npm, clones do GitHub), não por o repositório ter vinte estrelas ou vinte mil. Nenhum pitch deck é necessário. Não cultivamos badges de perfil do GitHub (sem merge YOLO de main protegidos, sem teatro de fechamento de Issue em 5 minutos, sem Co-authored-by falsos). Galaxy Brain precisa de respostas aceitas reais em Discussions Q&A. npm run github:achievements -- --fixture tests/fixtures/github-achievements.json --json inventaria o que já foi conquistado versus o que recusamos cultivar.
Para quem é
ThumbGate é para operadores cujos agentes de codificação de IA podem vazar um segredo ou destruir um checkout antes que um humano veja a chamada de ferramenta (Claude Code, Cursor, Codex, Gemini CLI, MCP). A descoberta deve alcançar esses operadores — não uma campanha de estrelas.
ThumbGate não é um pacote de estrelas do GitHub, não é engajamento falso e não substitui instalações npm ou PRs mesclados. Engajamento real é npx thumbgate init e um hook PreToolUse que realmente dispara.
Memes técnicos (compartilháveis)
Visuais leves sobre como agentes falham sem um portão pré-ação:
| Meme | Significado |
|---|---|
| Chamadas de ferramenta não verificadas executam comandos destrutivos. | |
| Um prompt é conselho; um hook PreToolUse é aplicação. |
Ele bloqueia duramente vazamentos de segredos detectados e duas classes diretas de comandos de autodesativação por padrão — comandos que encerram o processo do portão ThumbGate ou habilitam sua sobreposição de ambiente de bypass. Outras classes de alto risco (rm -rf, force-push, fetch-and-run, edições diretas de guardrails) avisam e registram por padrão. Defina THUMBGATE_STRICT_ENFORCEMENT=1 para aplicação estrita (avisos viram bloqueios duros).
| Veredito | Comportamento padrão |
|---|---|
| ⛔ Bloqueio duro | Vazamentos de segredos detectados; autodesativação por kill de processo/sobreposição de ambiente |
| 👎 Aviso + registro | rm -rf, git push --force, fetch-and-run, edições diretas de guardrails — avisam por padrão |
| 👍 Permitir | Todo o resto |
Feedback aceito é armazenado como lições locais. Falhas concretas repetidas podem se tornar regras de prevenção que promovem de avisos para portões de bloqueio. O firewall melhora com as operações sem retreinar o modelo. Avaliação de prompt (npx thumbgate eval) transforma feedback aceito em casos de avaliação reutilizáveis e relatórios de prova locais.
Aviso honesto: ThumbGate não atualiza pesos de modelo. Ele intercepta chamadas de ferramenta em tempo de execução. Local-first — nenhuma nuvem é necessária para o caminho de aplicação.
Funciona com Claude Code, Cursor, Codex, Gemini CLI, Amp, Cline, OpenCode e outros agentes MCP.
Agent tries: rm -rf tests/
ThumbGate: 👎 WARN + LOG — "Never delete test directories"
Pattern matched: rm.*-rf.*tests
Source: your thumbs-down from last Tuesday
Strict mode: ⛔ DENY before tool execution
Adequação ao ciclo de desenvolvimento agentico
O desenvolvimento agentico está se tornando um loop: Guiar → Gerar → Verificar → Resolver. ThumbGate é o portão pré-ação / fronteira pré-ação entre a intenção gerada e a ação executada.
Início Rápido
Quer um passo a passo em fases com uma etapa de verificação em cada estágio? Siga o Guia de Configuração Progressiva.
Conexão progressiva — prove o cano antes de ativar a correspondência. Dashboard vazio é sucesso.
npx thumbgate init # Phase 1: hooks only
npx thumbgate doctor # verify: exits 0 only when PreToolUse hook is wired (hidden metric = hook install, not gate count)
npx thumbgate dashboard --open # Phase 2: open local HTML; empty stats are OK
npx thumbgate capture --feedback=down --context="Never run DROP on production tables" --what-went-wrong="agent proposed DROP" --what-to-change="require review for DROP"
Tentativas posteriores de DROP no mesmo escopo exibem a verificação:
⚠️ Check fired: "Never run DROP on production tables"
Pattern: DROP.*production
Verdict: 👎 WARN + LOG (⛔ BLOCK when THUMBGATE_STRICT_ENFORCEMENT=1)
Configs numeradas: config/progressive/. Guia: conexão progressiva.
Instalação MCP / Glama / registro (stdio)
Diretórios e clientes que instalam ThumbGate como servidor MCP devem iniciar stdio MCP, não a API HTTP:
npx -y thumbgate serve
- Equivalente:
npx -y thumbgate mcp - Não use
npm startpara MCP — isso inicia a API HTTP hospedada (src/api/server.js), não o servidor stdio voltado ao agente.
▶ Demonstração de 90 segundos · Passo a passo em GIF
Instale para seu agente
| Agente | Comando | Aplicação |
|---|---|---|
| Claude Code | npx thumbgate init --agent claude-code | 🛡️ Dura — PreToolUse |
| Codex | npx thumbgate init --agent codex | 🛡️ Dura — pre_tool_use |
| Gemini CLI | npx thumbgate init --agent gemini | 🛡️ Dura — PreToolUse |
| ForgeCode | npx thumbgate init --agent forge | 🛡️ Dura — pre_tool_use |
| Cursor | npx thumbgate init --agent cursor | 💬 Consultiva — MCP gate_check |
| Cline | npx thumbgate init --agent cline | 💬 Consultiva — MCP + .clinerules |
| OpenCode | npx thumbgate init --agent opencode | 💬 Consultiva — MCP gate_check |
| Qualquer agente MCP | npx thumbgate serve | 💬 Consultiva — MCP gate_check |
| Amp | npx thumbgate init --agent amp | 📝 Captura de feedback |
| GitHub Actions | uses: IgorGanapolsky/ThumbGate@v1 | 🩺 Action do Marketplace — doctor / inventário de IA no CI |
Guias por agente: ponte Claude/Codex · perfil Codex · Cursor · configuração MCP
Escopo de instalação: máquina inteira vs por projeto
| Escopo | Comando | Configurações | Lições | Melhor para |
|---|---|---|---|---|
| Máquina inteira (padrão) | npx thumbgate init | ~/.claude/settings.json | ~/.claude/memory/feedback/ | Operadores solo — mesmo armazenamento de feedback local à máquina entre repositórios |
| Por projeto | npx thumbgate init --project | <repo>/.claude/settings.json | <repo>/.claude/memory/feedback/ | Cliente / conformidade — dashboard separado / lições isoladas por repositório |
Ambos os escopos escrevem mcpServers.thumbgate além dos hooks PreToolUse / UserPromptSubmit / PostToolUse / SessionStart. Máquina inteira é o padrão certo para a maioria dos desenvolvedores. Bloqueio entre repositórios não é automático: uma lição aprendida em um projeto só se aplica em outro quando você compartilha o armazenamento (máquina inteira) ou exporta/importa lições.
Ferramentas MCP (superfície): gate_check (ler/avaliar chamada de ferramenta proposta), ferramentas de captura de feedback + sessão (escrita), dashboard/estatísticas (leitura). Ações destrutivas do agente permanecem bloqueadas/avisadas pelo PreToolUse — ThumbGate não executa comandos de shell do usuário por você.
Slash-commands descobríveis — a camada de guardrail para agentes orientados a especificação
Frameworks de agentes orientados a especificação como GSD (get-shit-done) e GitHub Spec Kit planejam e geram trabalho. ThumbGate é a camada de guardrail para agentes orientados a especificação: ele fica depois do plano, na fronteira entre uma chamada de ferramenta gerada e sua execução — junto com GSD / Spec-Kit, não no lugar deles.
npx thumbgate init instala estes na paleta do seu agente:
| Comando | O que faz |
|---|---|
/thumbgate-dashboard | Abre o dashboard local do projeto |
/thumbgate-guard | Transforma o último erro em regra dura de prevenção |
/thumbgate-rules | Lista regras ativas e lições |
/thumbgate-blocked | Estatísticas do portão + matriz de aplicação |
/thumbgate-protect | Governança de branch + aprovação com escopo |
/thumbgate-doctor | Verificação de saúde de hooks, MCP, prontidão |
Preços e caminhos de compra
Nível gratuito: 2 capturas de feedback/dia (10 no total) e até 3 regras de prevenção auto-promovidas ativas. Pro ($19/mês ou $149/ano) é o nível individual para regras ilimitadas, lições com consciência de histórico, fluxo de sessão de feedback vinculado, dashboard pessoal e exportação DPO. Enterprise é personalizado e escopado após intake; sincronização de lições de equipe hospedada e dashboard de organização hospedado não estão em disponibilidade geral.
| Gratuito | Pro ($19/mês ou $149/ano) | Enterprise | |
|---|---|---|---|
| CLI local + PreToolUse | ✅ | ✅ | Escopado após intake |
| Capturas de feedback | 2 capturas de feedback/dia (10 no total) | Ilimitadas | Escopado após intake |
| Regras auto-promovidas ativas | até 3 regras de prevenção auto-promovidas ativas | Ilimitadas | Escopado após intake |
| Dashboard pessoal + exportação DPO | — | ✅ | Revisado durante intake |
| Sincronização de lições de equipe hospedada | — | — | Não em disponibilidade geral |
| Dashboard de organização hospedado | — | — | Não em disponibilidade geral |
Caminho de intake Enterprise: o Workflow Hardening Sprint escopa uma falha repetida antes de qualquer compromisso de rollout mais amplo. Iniciar intake →
Caminho técnico local: instale o CLI e use init além da configuração documentada para que as Verificações Pré-Ação avaliem chamadas de ferramenta onde o agente realmente executa.
Caminho de ativação do primeiro dólar: abra o ThumbGate GPT, cole a ação arriscada, capture feedback digitado (thumbs down: / thumbs up:). Os botões nativos de avaliação do ChatGPT não são o caminho de captura do ThumbGate. Pergunte: qual erro repetido de IA valeria a pena capturar antes da ferramenta executar?
Caminho pago para operadores individuais: ThumbGate Pro é a via lateral self-serve para um dashboard pessoal e evidências prontas para exportação.
Começar grátis · Pro $19/mês · Dashboard ao vivo · Intake de Sprint de equipe · Workflow Hardening Sprint · Playbook do Primeiro Dólar
Perguntas populares de compradores: Presença tópica em busca de IA · Conhecimento relacional e recomendações de IA · Anúncios em AI Mode para governança de agentes · Governança de ferramentas MCP · Portões de aprovação pré-ação para agentes de IA · Governança de agentes em segundo plano · Avaliação de modelo GPT-5.5 · Pare erros repetidos de agentes de IA · Segurança de automação de navegador · Segurança de host de mensageria nativa · Segurança de agentes de autopesquisa · Guardrails do Cursor · Guardrails do Codex CLI · Memória + aplicação do Gemini CLI · Guardrails do Google Cloud MCP · Alternativa ao Roo Code: migre para Cline
Como funciona (resumo)
- Capture feedback 👍/👎 (CLI, MCP, fluxo de sessão de feedback vinculado /
open_feedback_session, ou ThumbGate GPT) - Promova lições concretas via destilação de lições com consciência de histórico em regras de prevenção
- Avalie a próxima chamada de ferramenta proposta contra regras ativas (literal/AST + vetores locais)
- Permita / avise / negue antes da ferramenta executar
npx thumbgate brain --write # → .thumbgate/BRAIN.md (lessons + gates in one artifact)
Operadores Pro podem invocar search_lessons via MCP e usar npx thumbgate lessons pelo CLI. Sessões de feedback com consciência de histórico e busca de lições são capacidades Pro; Gratuito não inclui recall ou busca.
Diagrama de arquitetura e stack
flowchart LR
A["Agent tool call"] --> B{"Rule match?"}
B -- exact --> D["On-device gate"]
B -- semantic --> C["Local LanceDB"]
C --> D
D -- secret/kill --> E["⛔ Hard-block"]
D -- known-bad --> G["👎 Warn + log"]
D -- safe --> F["👍 Allow"]
Verificações integradas
⛔ secret-exfiltration → hard-block (default)
⛔ self-protect-kill → hard-block (default)
⛔ self-protect-env → hard-block (default)
⚠️ force-push → warn; hard-block under strict
⚠️ protected-branch → warn; hard-block under strict
⚠️ unresolved-threads → warn; hard-block under strict
⚠️ package-lock-reset → warn; hard-block under strict
Folha de referência da CLI
npx thumbgate init
npx thumbgate doctor
npx thumbgate capture up|down "<text>"
npx thumbgate lessons
npx thumbgate brain --write
npx thumbgate dashboard --open
npx thumbgate break-glass --reason="ThumbGate over-fired" # 5-min recovery
Pro: lição + exportação DPO
# Portable lessons
curl -X POST http://localhost:3456/v1/lessons/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"outputPath": "./lessons-export.json"}'
# DPO pairs for fine-tuning
curl -X POST http://localhost:3456/v1/dpo/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-o dpo-pairs.jsonl
Pilha de tecnologia
| Camada | Tecnologia |
|---|---|
| Runtime | Node.js ≥18 |
| Interfaces | MCP stdio, API HTTP, CLI |
| Armazenamento | SQLite + FTS5, vetores LanceDB, logs JSONL |
| Inteligência | MemAlign recall duplo, Amostragem de Thompson, embeddings locais |
| Cobrança / hospedagem | Stripe, Railway |
| Execução | Railway, Cloudflare Workers, Sandboxes Docker |
| Governança | Workflow Sentinel, plano de controle, Sandboxes Docker |
Cada Changeset está vinculado ao commit de merge main exato e gera Evidência de Verificação para Confiança de Lançamento.
Integrações (compacto)
| Superfície | Comece aqui |
|---|---|
| Open ThumbGate GPT | thumbgate.ai/go/gpt — ThumbGate GPT: comece aqui. Cole ações de agentes, receba conselhos e checkpointing. Não, os usuários não precisam continuar conversando dentro do ThumbGate GPT para usar o ThumbGate — a camada de aplicação rígida ainda roda onde o trabalho acontece. |
| Instalar Plugin Codex | Abra a página de instalação do plugin Codex: thumbgate.ai/codex-plugin · zip: thumbgate-codex-plugin.zip · plugins/codex-profile/INSTALL.md |
Claude Desktop .mcpb | última versão |
| VS Code / Open VSX | plugins/vscode-extension/README.md |
| Compatível com Antigravity | plugins/antigravity-extension/INSTALL.md |
| JetBrains | plugins/jetbrains-plugin/README.md · Caminho do JetBrains Marketplace para o mesmo runtime |
| ChatGPT App / GPT Action | thumbgate.ai/chatgpt-app |
| ThumbGate-Core (staging) | https://github.com/IgorGanapolsky/ThumbGate-Core — staging de pré-lançamento + alguns scripts de cache internos; não é o diferencial do produto |
Documentação
Índice completo: docs/INDEX.md
| Necessidade | Link |
|---|---|
| Contrato de fluxo de trabalho do agente | WORKFLOW.md |
| Triagem pronta para agente | .github/ISSUE_TEMPLATE/ready-for-agent.yml |
| Evidência de Verificação | docs/VERIFICATION_EVIDENCE.md |
| Confiança de Lançamento | docs/RELEASE_CONFIDENCE.md |
| Estratégia de Changeset | docs/CHANGESET_STRATEGY.md |
| Playbook do Primeiro Dólar | docs/FIRST_DOLLAR_PLAYBOOK.md |
| Política de segurança | SECURITY.md |
| Modelo de ameaças | THREAT_MODEL.md |
| Federal / regulamentado | docs/FEDERAL.md |
| Verdade Comercial | docs/COMMERCIAL_TRUTH.md |
| Issues / PRs | GitHub Issues · modelo de PR |
FAQ (respostas curtas): Não é um ajustador fino (apenas interceptação em runtime). Diferente de CLAUDE.md / .cursorrules (esses são contexto; ThumbGate é uma camada externa de permitir/avisar/negar antes de as ferramentas rodarem).
Quem constrói isso
Igor Ganapolsky — pagamentos (Stripe/Connect), guardrails de agentes de IA/MCP, Android + backends. Poucas vagas de contrato: $120–150/h, 1099, remoto EUA. LinkedIn · thumbgate.ai
Licença
MIT — veja LICENSE. Política do projeto: SECURITY.md · THREAT_MODEL.md.