MCP Memory Gateway (rlhf-feedback-loop)

Loop de feedback RLHF local-primeiro para agentes de IA — captura sinais de preferência, promove memórias, bloqueia erros repetidos, exporta pares de treinamento DPO/KTO

Documentação

ThumbGate 👍 👎

ThumbGate Infrastructure Firewall with Thumbs Up and Thumbs Down

ThumbGate é o firewall pré-ação auto-aprimorável para agentes de codificação de IA
Agentes de codificação de IA repetem erros — e uma única chamada de ferramenta errada pode apagar um diretório, vazar uma chave ou enviar código quebrado.

MCP Toplist CI npm version npm weekly downloads GitHub stars GitHub Marketplace: ThumbGate Agent Governance License: MIT

Quick Start Watch Demo Try GPT Pro Tier


O que ele faz

ThumbGate é o mecanismo local-first de Verificações Pré-Ação para agentes de codificação de IA. Ele roda no hook PreToolUse para avaliar a chamada de ferramenta proposta antes da execução — para que erros custosos possam ser detectados antes que aconteçam.

O crescimento de estrelas do ThumbGate no GitHub é medido com o endpoint GET /repos/{owner}/{repo}/stargazers/history seguro para privacidade do GitHub (contagens semanais, sem identidades de quem deu estrela). Execute npm run stars:history -- --fixture tests/fixtures/github-star-history.json --json para a prova local. Estrelas não são instalações npm e não são receita. A Action ao vivo do GitHub Marketplace é ThumbGate Agent Governance (uses: IgorGanapolsky/ThumbGate@v1).

Uso acima de contagem de estrelas. Avalie o ThumbGate pelo caminho de instalação e pelos badges de uso ao vivo acima (npx thumbgate init, Marketplace uses:, downloads semanais npm, clones do GitHub), não por o repositório ter vinte estrelas ou vinte mil. Nenhum pitch deck é necessário. Não cultivamos badges de perfil do GitHub (sem merge YOLO de main protegidos, sem teatro de fechamento de Issue em 5 minutos, sem Co-authored-by falsos). Galaxy Brain precisa de respostas aceitas reais em Discussions Q&A. npm run github:achievements -- --fixture tests/fixtures/github-achievements.json --json inventaria o que já foi conquistado versus o que recusamos cultivar.

Para quem é

ThumbGate é para operadores cujos agentes de codificação de IA podem vazar um segredo ou destruir um checkout antes que um humano veja a chamada de ferramenta (Claude Code, Cursor, Codex, Gemini CLI, MCP). A descoberta deve alcançar esses operadores — não uma campanha de estrelas.

ThumbGate não é um pacote de estrelas do GitHub, não é engajamento falso e não substitui instalações npm ou PRs mesclados. Engajamento real é npx thumbgate init e um hook PreToolUse que realmente dispara.

Memes técnicos (compartilháveis)

Visuais leves sobre como agentes falham sem um portão pré-ação:

MemeSignificado
Agent destroys prod without a gateChamadas de ferramenta não verificadas executam comandos destrutivos.
Prompt vs PreToolUse hookUm prompt é conselho; um hook PreToolUse é aplicação.

Ele bloqueia duramente vazamentos de segredos detectados e duas classes diretas de comandos de autodesativação por padrão — comandos que encerram o processo do portão ThumbGate ou habilitam sua sobreposição de ambiente de bypass. Outras classes de alto risco (rm -rf, force-push, fetch-and-run, edições diretas de guardrails) avisam e registram por padrão. Defina THUMBGATE_STRICT_ENFORCEMENT=1 para aplicação estrita (avisos viram bloqueios duros).

VereditoComportamento padrão
⛔ Bloqueio duroVazamentos de segredos detectados; autodesativação por kill de processo/sobreposição de ambiente
👎 Aviso + registrorm -rf, git push --force, fetch-and-run, edições diretas de guardrails — avisam por padrão
👍 PermitirTodo o resto

Feedback aceito é armazenado como lições locais. Falhas concretas repetidas podem se tornar regras de prevenção que promovem de avisos para portões de bloqueio. O firewall melhora com as operações sem retreinar o modelo. Avaliação de prompt (npx thumbgate eval) transforma feedback aceito em casos de avaliação reutilizáveis e relatórios de prova locais.

Aviso honesto: ThumbGate não atualiza pesos de modelo. Ele intercepta chamadas de ferramenta em tempo de execução. Local-first — nenhuma nuvem é necessária para o caminho de aplicação.

Funciona com Claude Code, Cursor, Codex, Gemini CLI, Amp, Cline, OpenCode e outros agentes MCP.

AI Agent without ThumbGate vs Agent guarded by ThumbGate

  Agent tries:   rm -rf tests/
  ThumbGate:     👎 WARN + LOG — "Never delete test directories"
                 Pattern matched: rm.*-rf.*tests
                 Source: your thumbs-down from last Tuesday
                 Strict mode: ⛔ DENY before tool execution

Adequação ao ciclo de desenvolvimento agentico

O desenvolvimento agentico está se tornando um loop: Guiar → Gerar → Verificar → Resolver. ThumbGate é o portão pré-ação / fronteira pré-ação entre a intenção gerada e a ação executada.


Início Rápido

Quer um passo a passo em fases com uma etapa de verificação em cada estágio? Siga o Guia de Configuração Progressiva.

Conexão progressiva — prove o cano antes de ativar a correspondência. Dashboard vazio é sucesso.

npx thumbgate init          # Phase 1: hooks only
npx thumbgate doctor        # verify: exits 0 only when PreToolUse hook is wired (hidden metric = hook install, not gate count)
npx thumbgate dashboard --open  # Phase 2: open local HTML; empty stats are OK
npx thumbgate capture --feedback=down --context="Never run DROP on production tables" --what-went-wrong="agent proposed DROP" --what-to-change="require review for DROP"

Tentativas posteriores de DROP no mesmo escopo exibem a verificação:

⚠️ Check fired: "Never run DROP on production tables"
   Pattern: DROP.*production
   Verdict: 👎 WARN + LOG   (⛔ BLOCK when THUMBGATE_STRICT_ENFORCEMENT=1)

Configs numeradas: config/progressive/. Guia: conexão progressiva.

Instalação MCP / Glama / registro (stdio)

Diretórios e clientes que instalam ThumbGate como servidor MCP devem iniciar stdio MCP, não a API HTTP:

npx -y thumbgate serve
  • Equivalente: npx -y thumbgate mcp
  • Não use npm start para MCP — isso inicia a API HTTP hospedada (src/api/server.js), não o servidor stdio voltado ao agente.

▶ Demonstração de 90 segundos · Passo a passo em GIF


Instale para seu agente

AgenteComandoAplicação
Claude Codenpx thumbgate init --agent claude-code🛡️ Dura — PreToolUse
Codexnpx thumbgate init --agent codex🛡️ Dura — pre_tool_use
Gemini CLInpx thumbgate init --agent gemini🛡️ Dura — PreToolUse
ForgeCodenpx thumbgate init --agent forge🛡️ Dura — pre_tool_use
Cursornpx thumbgate init --agent cursor💬 Consultiva — MCP gate_check
Clinenpx thumbgate init --agent cline💬 Consultiva — MCP + .clinerules
OpenCodenpx thumbgate init --agent opencode💬 Consultiva — MCP gate_check
Qualquer agente MCPnpx thumbgate serve💬 Consultiva — MCP gate_check
Ampnpx thumbgate init --agent amp📝 Captura de feedback
GitHub Actionsuses: IgorGanapolsky/ThumbGate@v1🩺 Action do Marketplace — doctor / inventário de IA no CI

Guias por agente: ponte Claude/Codex · perfil Codex · Cursor · configuração MCP

Escopo de instalação: máquina inteira vs por projeto

EscopoComandoConfiguraçõesLiçõesMelhor para
Máquina inteira (padrão)npx thumbgate init~/.claude/settings.json~/.claude/memory/feedback/Operadores solo — mesmo armazenamento de feedback local à máquina entre repositórios
Por projetonpx thumbgate init --project<repo>/.claude/settings.json<repo>/.claude/memory/feedback/Cliente / conformidade — dashboard separado / lições isoladas por repositório

Ambos os escopos escrevem mcpServers.thumbgate além dos hooks PreToolUse / UserPromptSubmit / PostToolUse / SessionStart. Máquina inteira é o padrão certo para a maioria dos desenvolvedores. Bloqueio entre repositórios não é automático: uma lição aprendida em um projeto só se aplica em outro quando você compartilha o armazenamento (máquina inteira) ou exporta/importa lições.

Ferramentas MCP (superfície): gate_check (ler/avaliar chamada de ferramenta proposta), ferramentas de captura de feedback + sessão (escrita), dashboard/estatísticas (leitura). Ações destrutivas do agente permanecem bloqueadas/avisadas pelo PreToolUse — ThumbGate não executa comandos de shell do usuário por você.


Slash-commands descobríveis — a camada de guardrail para agentes orientados a especificação

Frameworks de agentes orientados a especificação como GSD (get-shit-done) e GitHub Spec Kit planejam e geram trabalho. ThumbGate é a camada de guardrail para agentes orientados a especificação: ele fica depois do plano, na fronteira entre uma chamada de ferramenta gerada e sua execução — junto com GSD / Spec-Kit, não no lugar deles.

npx thumbgate init instala estes na paleta do seu agente:

ComandoO que faz
/thumbgate-dashboardAbre o dashboard local do projeto
/thumbgate-guardTransforma o último erro em regra dura de prevenção
/thumbgate-rulesLista regras ativas e lições
/thumbgate-blockedEstatísticas do portão + matriz de aplicação
/thumbgate-protectGovernança de branch + aprovação com escopo
/thumbgate-doctorVerificação de saúde de hooks, MCP, prontidão

Preços e caminhos de compra

Nível gratuito: 2 capturas de feedback/dia (10 no total) e até 3 regras de prevenção auto-promovidas ativas. Pro ($19/mês ou $149/ano) é o nível individual para regras ilimitadas, lições com consciência de histórico, fluxo de sessão de feedback vinculado, dashboard pessoal e exportação DPO. Enterprise é personalizado e escopado após intake; sincronização de lições de equipe hospedada e dashboard de organização hospedado não estão em disponibilidade geral.

GratuitoPro ($19/mês ou $149/ano)Enterprise
CLI local + PreToolUse✅✅Escopado após intake
Capturas de feedback2 capturas de feedback/dia (10 no total)IlimitadasEscopado após intake
Regras auto-promovidas ativasaté 3 regras de prevenção auto-promovidas ativasIlimitadasEscopado após intake
Dashboard pessoal + exportação DPO—✅Revisado durante intake
Sincronização de lições de equipe hospedada——Não em disponibilidade geral
Dashboard de organização hospedado——Não em disponibilidade geral

Caminho de intake Enterprise: o Workflow Hardening Sprint escopa uma falha repetida antes de qualquer compromisso de rollout mais amplo. Iniciar intake →

Caminho técnico local: instale o CLI e use init além da configuração documentada para que as Verificações Pré-Ação avaliem chamadas de ferramenta onde o agente realmente executa.

Caminho de ativação do primeiro dólar: abra o ThumbGate GPT, cole a ação arriscada, capture feedback digitado (thumbs down: / thumbs up:). Os botões nativos de avaliação do ChatGPT não são o caminho de captura do ThumbGate. Pergunte: qual erro repetido de IA valeria a pena capturar antes da ferramenta executar?

Caminho pago para operadores individuais: ThumbGate Pro é a via lateral self-serve para um dashboard pessoal e evidências prontas para exportação.

Começar grátis · Pro $19/mês · Dashboard ao vivo · Intake de Sprint de equipe · Workflow Hardening Sprint · Playbook do Primeiro Dólar

Perguntas populares de compradores: Presença tópica em busca de IA · Conhecimento relacional e recomendações de IA · Anúncios em AI Mode para governança de agentes · Governança de ferramentas MCP · Portões de aprovação pré-ação para agentes de IA · Governança de agentes em segundo plano · Avaliação de modelo GPT-5.5 · Pare erros repetidos de agentes de IA · Segurança de automação de navegador · Segurança de host de mensageria nativa · Segurança de agentes de autopesquisa · Guardrails do Cursor · Guardrails do Codex CLI · Memória + aplicação do Gemini CLI · Guardrails do Google Cloud MCP · Alternativa ao Roo Code: migre para Cline


Como funciona (resumo)

  1. Capture feedback 👍/👎 (CLI, MCP, fluxo de sessão de feedback vinculado / open_feedback_session, ou ThumbGate GPT)
  2. Promova lições concretas via destilação de lições com consciência de histórico em regras de prevenção
  3. Avalie a próxima chamada de ferramenta proposta contra regras ativas (literal/AST + vetores locais)
  4. Permita / avise / negue antes da ferramenta executar
npx thumbgate brain --write   # → .thumbgate/BRAIN.md (lessons + gates in one artifact)

Operadores Pro podem invocar search_lessons via MCP e usar npx thumbgate lessons pelo CLI. Sessões de feedback com consciência de histórico e busca de lições são capacidades Pro; Gratuito não inclui recall ou busca.

Diagrama de arquitetura e stack

ThumbGate Architecture

flowchart LR
    A["Agent tool call"] --> B{"Rule match?"}
    B -- exact --> D["On-device gate"]
    B -- semantic --> C["Local LanceDB"]
    C --> D
    D -- secret/kill --> E["⛔ Hard-block"]
    D -- known-bad --> G["👎 Warn + log"]
    D -- safe --> F["👍 Allow"]
Verificações integradas
⛔ secret-exfiltration → hard-block (default)
⛔ self-protect-kill   → hard-block (default)
⛔ self-protect-env    → hard-block (default)
⚠️ force-push          → warn; hard-block under strict
⚠️ protected-branch    → warn; hard-block under strict
⚠️ unresolved-threads  → warn; hard-block under strict
⚠️ package-lock-reset  → warn; hard-block under strict
Folha de referência da CLI
npx thumbgate init
npx thumbgate doctor
npx thumbgate capture up|down "<text>"
npx thumbgate lessons
npx thumbgate brain --write
npx thumbgate dashboard --open
npx thumbgate break-glass --reason="ThumbGate over-fired"   # 5-min recovery
Pro: lição + exportação DPO
# Portable lessons
curl -X POST http://localhost:3456/v1/lessons/export \
  -H "Authorization: Bearer $THUMBGATE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"outputPath": "./lessons-export.json"}'

# DPO pairs for fine-tuning
curl -X POST http://localhost:3456/v1/dpo/export \
  -H "Authorization: Bearer $THUMBGATE_API_KEY" \
  -o dpo-pairs.jsonl

Pilha de tecnologia

CamadaTecnologia
RuntimeNode.js ≥18
InterfacesMCP stdio, API HTTP, CLI
ArmazenamentoSQLite + FTS5, vetores LanceDB, logs JSONL
InteligênciaMemAlign recall duplo, Amostragem de Thompson, embeddings locais
Cobrança / hospedagemStripe, Railway
ExecuçãoRailway, Cloudflare Workers, Sandboxes Docker
GovernançaWorkflow Sentinel, plano de controle, Sandboxes Docker

Cada Changeset está vinculado ao commit de merge main exato e gera Evidência de Verificação para Confiança de Lançamento.


Integrações (compacto)

SuperfícieComece aqui
Open ThumbGate GPTthumbgate.ai/go/gpt — ThumbGate GPT: comece aqui. Cole ações de agentes, receba conselhos e checkpointing. Não, os usuários não precisam continuar conversando dentro do ThumbGate GPT para usar o ThumbGate — a camada de aplicação rígida ainda roda onde o trabalho acontece.
Instalar Plugin CodexAbra a página de instalação do plugin Codex: thumbgate.ai/codex-plugin · zip: thumbgate-codex-plugin.zip · plugins/codex-profile/INSTALL.md
Claude Desktop .mcpbúltima versão
VS Code / Open VSXplugins/vscode-extension/README.md
Compatível com Antigravityplugins/antigravity-extension/INSTALL.md
JetBrainsplugins/jetbrains-plugin/README.md · Caminho do JetBrains Marketplace para o mesmo runtime
ChatGPT App / GPT Actionthumbgate.ai/chatgpt-app
ThumbGate-Core (staging)https://github.com/IgorGanapolsky/ThumbGate-Core — staging de pré-lançamento + alguns scripts de cache internos; não é o diferencial do produto

Documentação

Índice completo: docs/INDEX.md

NecessidadeLink
Contrato de fluxo de trabalho do agenteWORKFLOW.md
Triagem pronta para agente.github/ISSUE_TEMPLATE/ready-for-agent.yml
Evidência de Verificaçãodocs/VERIFICATION_EVIDENCE.md
Confiança de Lançamentodocs/RELEASE_CONFIDENCE.md
Estratégia de Changesetdocs/CHANGESET_STRATEGY.md
Playbook do Primeiro Dólardocs/FIRST_DOLLAR_PLAYBOOK.md
Política de segurançaSECURITY.md
Modelo de ameaçasTHREAT_MODEL.md
Federal / regulamentadodocs/FEDERAL.md
Verdade Comercialdocs/COMMERCIAL_TRUTH.md
Issues / PRsGitHub Issues · modelo de PR

FAQ (respostas curtas): Não é um ajustador fino (apenas interceptação em runtime). Diferente de CLAUDE.md / .cursorrules (esses são contexto; ThumbGate é uma camada externa de permitir/avisar/negar antes de as ferramentas rodarem).


Quem constrói isso

Igor Ganapolsky — pagamentos (Stripe/Connect), guardrails de agentes de IA/MCP, Android + backends. Poucas vagas de contrato: $120–150/h, 1099, remoto EUA. LinkedIn · thumbgate.ai

Licença

MIT — veja LICENSE. Política do projeto: SECURITY.md · THREAT_MODEL.md.