MCP Memory Gateway (rlhf-feedback-loop)

Loop de feedback RLHF local-primeiro para agentes de IA — captura sinais de preferência, promove memórias, bloqueia erros repetidos, exporta pares de treinamento DPO/KTO

Documentação

ThumbGate 👍 👎

ThumbGate Infrastructure Firewall with Thumbs Up and Thumbs Down

Firewall de pré-ação auto-aprimorável para agentes de codificação de IA
Agentes de codificação de IA repetem erros — e uma única chamada de ferramenta errada pode apagar um diretório, vazar uma chave ou enviar código quebrado.

MCP Toplist CI npm License: MIT

Quick Start Watch Demo Try GPT Pro Tier


O que ele faz

ThumbGate é o mecanismo local-first de Verificações de Pré-Ação para agentes de codificação de IA. Ele roda no hook PreToolUse para avaliar a chamada de ferramenta proposta antes da execução — para que erros custosos possam ser detectados antes que aconteçam.

Memes de tecnologia (compartilháveis)

Visuais leves sobre como os agentes falham sem um portão de pré-ação:

MemeSignificado
Agent destroys prod without a gateChamadas de ferramenta não verificadas executam comandos destrutivos.
Prompt vs PreToolUse hookUm prompt é um conselho; um hook PreToolUse é uma imposição.

Ele bloqueia totalmente, por padrão, vazamentos de segredos detectados e duas classes diretas de comandos de autodesativação — comandos que encerram o processo do portão ThumbGate ou habilitam sua substituição de variável de ambiente de bypass. Outras classes de alto risco (rm -rf, force-push, buscar-e-executar, edições diretas de guardrails) alertam e registram por padrão. Defina THUMBGATE_STRICT_ENFORCEMENT=1 para aplicação estrita (alertas se tornam bloqueios totais).

VereditoComportamento padrão
Bloqueio totalVazamentos de segredos detectados; autodesativação por encerramento de processo/substituição de variável de ambiente
👎 Alertar + registrarrm -rf, git push --force, buscar-e-executar, edições diretas de guardrails — alertar por padrão
👍 PermitirTodo o resto

O feedback aceito é armazenado como lições locais. Falhas concretas repetidas podem se tornar regras de prevenção que promovem de alertas para portões de bloqueio. O firewall melhora com as operações sem retreinar o modelo. A avaliação de prompts (npx thumbgate eval) transforma feedback aceito em casos de avaliação reutilizáveis e relatórios de prova locais.

Aviso honesto: ThumbGate não atualiza pesos de modelo. Ele intercepta chamadas de ferramenta em tempo de execução. Local-first — nenhuma nuvem é necessária para o caminho de aplicação.

Funciona com Claude Code, Cursor, Codex, Gemini CLI, Amp, Cline, OpenCode e outros agentes MCP.

AI Agent without ThumbGate vs Agent guarded by ThumbGate

  Agent tries:   rm -rf tests/
  ThumbGate:     👎 WARN + LOG — "Never delete test directories"
                 Pattern matched: rm.*-rf.*tests
                 Source: your thumbs-down from last Tuesday
                 Strict mode: ⛔ DENY before tool execution

Adequação ao ciclo de desenvolvimento agêntico

O desenvolvimento agêntico está se tornando um ciclo: Orientar → Gerar → Verificar → Resolver. ThumbGate é o portão de pré-ação / fronteira de pré-ação entre a intenção gerada e a ação executada.


Início Rápido

npx thumbgate init                                              # wire PreToolUse hooks
npx thumbgate capture down "Never run DROP on production tables"  # 👎 lesson
npx thumbgate doctor                                            # health check

Tentativas posteriores de DROP no mesmo escopo exibem a verificação:

⚠️ Check fired: "Never run DROP on production tables"
   Pattern: DROP.*production
   Verdict: 👎 WARN + LOG   (⛔ BLOCK when THUMBGATE_STRICT_ENFORCEMENT=1)

Instalação via MCP / Glama / registry (stdio)

Diretórios e clientes que instalam ThumbGate como servidor MCP devem iniciar com MCP stdio, não com a API HTTP:

npx -y thumbgate serve
  • Equivalente: npx -y thumbgate mcp
  • Não use npm start para MCP — isso inicia a API HTTP hospedada (src/api/server.js), não o servidor stdio voltado ao agente.

▶ Demonstração de 90 segundos · Passo a passo em GIF


Instale para o seu agente

AgenteComandoAplicação
Claude Codenpx thumbgate init --agent claude-code🛡️ Rígida — PreToolUse
Codexnpx thumbgate init --agent codex🛡️ Rígida — pre_tool_use
Gemini CLInpx thumbgate init --agent gemini🛡️ Rígida — PreToolUse
ForgeCodenpx thumbgate init --agent forge🛡️ Rígida — pre_tool_use
Cursornpx thumbgate init --agent cursor💬 Consultiva — MCP gate_check
Clinenpx thumbgate init --agent cline💬 Consultiva — MCP + .clinerules
OpenCodenpx thumbgate init --agent opencode💬 Consultiva — MCP gate_check
Qualquer agente MCPnpx thumbgate serve💬 Consultiva — MCP gate_check
Ampnpx thumbgate init --agent amp📝 Captura de feedback

Guias por agente: Ponte Claude/Codex · Perfil Codex · Cursor · Configuração MCP

Escopo de instalação: máquina inteira vs. por projeto

EscopoComandoConfiguraçõesLiçõesMelhor para
Máquina inteira (padrão)npx thumbgate init~/.claude/settings.json~/.claude/memory/feedback/Operadores individuais — mesmo armazenamento de feedback local da máquina entre repositórios
Por projetonpx thumbgate init --project<repo>/.claude/settings.json<repo>/.claude/memory/feedback/Cliente / conformidade — painel separado / lições isoladas por repositório

Ambos os escopos gravam mcpServers.thumbgate além dos hooks PreToolUse / UserPromptSubmit / PostToolUse / SessionStart. Máquina inteira é o padrão certo para a maioria dos desenvolvedores. O bloqueio entre repositórios não é automático: uma lição aprendida em um projeto só se aplica em outro quando você compartilha o armazenamento (máquina inteira) ou exporta/importa lições.

Ferramentas MCP (superfície): gate_check (ler/avaliar chamada de ferramenta proposta), ferramentas de captura de feedback + sessão (gravar), painel/estatísticas (ler). Ações destrutivas do agente permanecem bloqueadas/alertadas pelo PreToolUse — ThumbGate não executa comandos de shell do usuário por você.


Comandos de barra descobertos — a camada de guardrails para agentes orientados por especificação

Frameworks de agentes orientados por especificação, como GSD (get-shit-done) e GitHub Spec Kit, planejam e geram trabalho. ThumbGate é a camada de guardrails para agentes orientados por especificação: ele fica depois do plano, na fronteira entre uma chamada de ferramenta gerada e sua execução — junto com GSD / Spec-Kit, não no lugar deles.

npx thumbgate init instala estes comandos na sua paleta de agente:

ComandoO que ele faz
/thumbgate-dashboardAbrir painel do projeto local
/thumbgate-guardTransformar o último erro em uma regra de prevenção rígida
/thumbgate-rulesListar regras e lições ativas
/thumbgate-blockedEstatísticas do portão + matriz de aplicação
/thumbgate-protectGovernança de branch + aprovação com escopo
/thumbgate-doctorVerificação de integridade de hooks, MCP, prontidão

Preços e caminhos de compra

Nível gratuito: 2 capturas de feedback/dia (10 no total) e até 3 regras de prevenção ativas promovidas automaticamente. Pro ($19/mês ou $149/ano) é o nível individual para regras ilimitadas, lições com consciência de histórico, fluxo de sessão de feedback vinculado, painel pessoal e exportação DPO. Enterprise é personalizado e escopado após o intake; sincronização de lições de equipe hospedada e painel de organização hospedado não estão em disponibilidade geral.

GratuitoPro ($19/mês ou $149/ano)Enterprise
CLI local + PreToolUseEscopado após intake
Capturas de feedback2 capturas de feedback/dia (10 no total)IlimitadasEscopado após intake
Regras ativas promovidas automaticamenteaté 3 regras de prevenção ativas promovidas automaticamenteIlimitadasEscopado após intake
Painel pessoal + exportação DPORevisado durante intake
Sincronização de lições de equipe hospedadaNão em disponibilidade geral
Painel de organização hospedadoNão em disponibilidade geral

Caminho de intake Enterprise: o Sprint de Endurecimento de Fluxo de Trabalho escopa uma falha repetida antes de qualquer compromisso de implantação mais amplo. Iniciar intake →

Caminho técnico local: instale o CLI e use init além da configuração documentada para que as Verificações de Pré-Ação avaliem chamadas de ferramenta onde o agente realmente executa.

Caminho de ativação do primeiro dólar: abra o ThumbGate GPT, cole a ação arriscada, capture o feedback digitado (thumbs down: / thumbs up:). Os botões nativos de classificação do ChatGPT não são o caminho de captura do ThumbGate. Pergunte: qual erro repetido de IA valeria a pena detectar antes da execução da ferramenta?

Caminho pago para operadores individuais: ThumbGate Pro é a via lateral de autoatendimento para um painel pessoal e evidências prontas para exportação.

Começar grátis · Pro $19/mês · Painel ao vivo · Intake de Sprint de equipe · Sprint de Endurecimento de Fluxo de Trabalho · Manual do Primeiro Dólar

Perguntas populares de compradores: Presença tópica em busca de IA · Conhecimento relacional e recomendações de IA · Anúncios em Modo IA para governança de agentes · Governança de ferramentas MCP · Portões de aprovação de pré-ação para agentes de IA · Governança de agentes em segundo plano · Avaliação de modelo GPT-5.5 · Pare erros repetidos de agentes de IA · Segurança de automação de navegador · Segurança de host de mensagens nativas · Segurança de agentes de pesquisa automática · Guardrails do Cursor · Guardrails do Codex CLI · Memória + aplicação do Gemini CLI · Guardrails do Google Cloud MCP · Alternativa ao Roo Code: migre para Cline


Como funciona (resumo)

  1. Capture feedback 👍/👎 (CLI, MCP, fluxo de sessão de feedback vinculado / open_feedback_session, ou ThumbGate GPT)
  2. Promova lições concretas via destilação de lições com consciência de histórico em regras de prevenção
  3. Avalie a próxima chamada de ferramenta proposta contra regras ativas (literal/AST + vetores locais)
  4. Permita / alerte / negue antes da execução da ferramenta
npx thumbgate brain --write   # → .thumbgate/BRAIN.md (lessons + gates in one artifact)

Operadores Pro podem invocar search_lessons via MCP e usar npx thumbgate lessons pelo CLI. Sessões de feedback com consciência de histórico e busca de lições são capacidades Pro; o nível Gratuito não inclui recall ou busca.

Diagrama de arquitetura e stack

ThumbGate Architecture

flowchart LR
    A["Agent tool call"] --> B{"Rule match?"}
    B -- exact --> D["On-device gate"]
    B -- semantic --> C["Local LanceDB"]
    C --> D
    D -- secret/kill --> E["⛔ Hard-block"]
    D -- known-bad --> G["👎 Warn + log"]
    D -- safe --> F["👍 Allow"]
Verificações integradas
⛔ secret-exfiltration → hard-block (default)
⛔ self-protect-kill   → hard-block (default)
⛔ self-protect-env    → hard-block (default)
⚠️ force-push          → warn; hard-block under strict
⚠️ protected-branch    → warn; hard-block under strict
⚠️ unresolved-threads  → warn; hard-block under strict
⚠️ package-lock-reset  → warn; hard-block under strict
Folha de referência do CLI
npx thumbgate init
npx thumbgate doctor
npx thumbgate capture up|down "<text>"
npx thumbgate lessons
npx thumbgate brain --write
npx thumbgate dashboard --open
npx thumbgate break-glass --reason="ThumbGate over-fired"   # 5-min recovery
Pro: exportação de lições + DPO
# Portable lessons
curl -X POST http://localhost:3456/v1/lessons/export \
  -H "Authorization: Bearer $THUMBGATE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"outputPath": "./lessons-export.json"}'

# DPO pairs for fine-tuning
curl -X POST http://localhost:3456/v1/dpo/export \
  -H "Authorization: Bearer $THUMBGATE_API_KEY" \
  -o dpo-pairs.jsonl

Stack de Tecnologia

CamadaTecnologia
RuntimeNode.js ≥18
InterfacesMCP stdio, API HTTP, CLI
ArmazenamentoSQLite + FTS5, vetores LanceDB, logs JSONL
InteligênciaRecall duplo MemAlign, Amostragem de Thompson, embeddings locais
Cobrança / hospedagemStripe, Railway
ExecuçãoRailway, Cloudflare Workers, Sandboxes Docker
GovernançaWorkflow Sentinel, plano de controle, Sandboxes Docker

Cada Changeset está vinculado ao commit de merge exato de main e gera Evidência de Verificação para Confiança de Lançamento.


Integrações (compacto)

SuperfícieComece por aqui
Abra o ThumbGate GPTthumbgate.ai/go/gptThumbGate GPT: comece por aqui. Cole as ações do agente, receba conselhos + checkpointing. Não, os usuários não precisam continuar conversando dentro do ThumbGate GPT para usar o ThumbGate — a camada de aplicação rígida ainda roda onde o trabalho acontece.
Instale o Plugin do CodexAbra a página de instalação do plugin do Codex: thumbgate.ai/codex-plugin · zip: thumbgate-codex-plugin.zip · plugins/codex-profile/INSTALL.md
Claude Desktop .mcpbúltima versão
VS Code / Open VSXplugins/vscode-extension/README.md
Compatível com Antigravityplugins/antigravity-extension/INSTALL.md
JetBrainsplugins/jetbrains-plugin/README.md · Caminho do JetBrains Marketplace para o mesmo runtime
ChatGPT App / GPT Actionthumbgate.ai/chatgpt-app
ThumbGate-Core (staging)https://github.com/IgorGanapolsky/ThumbGate-Core — pré-lançamento em staging + alguns scripts de cache internos; não é o diferencial do produto

Documentação

Índice completo: docs/INDEX.md

NecessidadeLink
Contrato de fluxo de trabalho do agenteWORKFLOW.md
Intake pronto para agente.github/ISSUE_TEMPLATE/ready-for-agent.yml
Evidência de Verificaçãodocs/VERIFICATION_EVIDENCE.md
Confiança de Lançamentodocs/RELEASE_CONFIDENCE.md
Estratégia de changesetdocs/CHANGESET_STRATEGY.md
Playbook do Primeiro Dólardocs/FIRST_DOLLAR_PLAYBOOK.md
Política de segurançaSECURITY.md
Modelo de ameaçasTHREAT_MODEL.md
Federal / regulamentadodocs/FEDERAL.md
Verdade Comercialdocs/COMMERCIAL_TRUTH.md
Issues / PRsGitHub Issues · modelo de PR

FAQ (respostas rápidas): Não é um fine-tuner (apenas interceptação em runtime). Diferente de CLAUDE.md / .cursorrules (esses são contexto; ThumbGate é uma camada externa de permitir/avisar/negar antes de as ferramentas rodarem).


Quem constrói isso

Igor Ganapolsky — pagamentos (Stripe/Connect), guardrails de agentes de IA/MCP, Android + backends. Poucas vagas de contrato: $120–150/hora, 1099, remoto nos EUA. LinkedIn · thumbgate.ai

Licença

MIT — veja LICENSE. Política do projeto: SECURITY.md · THREAT_MODEL.md.