MCP Memory Gateway (rlhf-feedback-loop)
Bucle de retroalimentación RLHF local-primero para agentes de IA: captura señales de preferencia, promueve recuerdos, bloquea errores repetidos, exporta pares de entrenamiento DPO/KTO
Documentación
ThumbGate 👍 👎
ThumbGate es el firewall de pre-acción auto-mejorable para agentes de codificación de IA
Los agentes de codificación de IA repiten errores — y una sola llamada de herramienta incorrecta puede borrar un directorio, filtrar una clave, o enviar código roto.
Qué hace
ThumbGate es el motor de Verificaciones de Pre-Acción local-primero para agentes de codificación de IA. Se ejecuta en el hook PreToolUse para evaluar la llamada de herramienta propuesta antes de la ejecución — para que los errores costosos puedan detectarse antes de que ocurran.
El crecimiento de estrellas de ThumbGate en GitHub se mide con el endpoint GET /repos/{owner}/{repo}/stargazers/history de GitHub, seguro para la privacidad (conteos semanales, sin identidades de observadores). Ejecuta npm run stars:history -- --fixture tests/fixtures/github-star-history.json --json para la prueba local. Las estrellas no son instalaciones de npm ni ingresos. La Acción de GitHub Marketplace en vivo es ThumbGate Agent Governance (uses: IgorGanapolsky/ThumbGate@v1).
Uso sobre conteo de estrellas. Evalúa ThumbGate desde la ruta de instalación y las insignias de uso en vivo arriba (npx thumbgate init, Marketplace uses:, descargas semanales de npm, clones de GitHub), no por si el repositorio tiene veinte estrellas o veinte mil. No se requiere presentación de ventas. No cultivamos insignias de perfil de GitHub (sin merge YOLO de main protegidos, sin teatro de cierre de Issues en 5 minutos, sin Co-authored-by falsos). Galaxy Brain necesita respuestas aceptadas reales en Discussions Q&A. npm run github:achievements -- --fixture tests/fixtures/github-achievements.json --json inventaría lo que ya se ha ganado versus lo que nos negamos a cultivar.
Para quién es
ThumbGate es para operadores cuyos agentes de codificación de IA pueden filtrar un secreto o destruir un checkout antes de que un humano vea la llamada de herramienta (Claude Code, Cursor, Codex, Gemini CLI, MCP). El descubrimiento debería llegar a esos operadores — no a una campaña de estrellas.
ThumbGate no es un paquete de estrellas de GitHub, no es participación falsa, y no es un sustituto de instalaciones de npm o PRs fusionados. La participación real es npx thumbgate init y un hook PreToolUse que realmente se activa.
Memes técnicos (compartibles)
Visuales ligeros sobre cómo fallan los agentes sin una puerta de pre-acción:
| Meme | Significado |
|---|---|
| Las llamadas de herramienta sin verificar envían comandos destructivos. | |
| Un prompt es consejo; un hook PreToolUse es aplicación. |
Bloquea de forma dura las fugas de secretos detectadas y dos clases directas de comandos de auto-deshabilitación por defecto — comandos que terminan el proceso de la puerta ThumbGate o habilitan su anulación de entorno de bypass. Otras clases de alto riesgo (rm -rf, force-push, fetch-and-run, ediciones directas de guardarraíles) advierten y registran por defecto. Configura THUMBGATE_STRICT_ENFORCEMENT=1 para aplicación estricta (las advertencias se convierten en denegaciones duras).
| Veredicto | Comportamiento por defecto |
|---|---|
| ⛔ Bloqueo duro | Fugas de secretos detectadas; auto-deshabilitación por kill de proceso/anulación de entorno |
| 👎 Advertir + registrar | rm -rf, git push --force, fetch-and-run, ediciones directas de guardarraíles — advertir por defecto |
| 👍 Permitir | Todo lo demás |
La retroalimentación aceptada se almacena como lecciones locales. Los fallos concretos repetidos pueden convertirse en reglas de prevención que promueven de advertencias a puertas de bloqueo. El firewall mejora desde las operaciones sin reentrenar el modelo. La evaluación de prompts (npx thumbgate eval) convierte la retroalimentación aceptada en casos de evaluación reutilizables e informes de prueba locales.
Aviso honesto: ThumbGate no actualiza los pesos del modelo. Intercepta llamadas de herramienta en tiempo de ejecución. Local-primero — no se requiere nube para la ruta de aplicación.
Funciona con Claude Code, Cursor, Codex, Gemini CLI, Amp, Cline, OpenCode, y otros agentes MCP.
Agent tries: rm -rf tests/
ThumbGate: 👎 WARN + LOG — "Never delete test directories"
Pattern matched: rm.*-rf.*tests
Source: your thumbs-down from last Tuesday
Strict mode: ⛔ DENY before tool execution
Ajuste al ciclo de desarrollo agéntico
El desarrollo agéntico se está convirtiendo en un bucle: Guiar → Generar → Verificar → Resolver. ThumbGate es la puerta de pre-acción / límite de pre-acción entre la intención generada y la acción ejecutada.
Inicio rápido
¿Quieres un recorrido por fases con un paso de verificación en cada etapa? Sigue la Guía de Configuración Progresiva.
Cableado progresivo — prueba la tubería antes de activar la coincidencia. El panel vacío es éxito.
npx thumbgate init # Phase 1: hooks only
npx thumbgate doctor # verify: exits 0 only when PreToolUse hook is wired (hidden metric = hook install, not gate count)
npx thumbgate dashboard --open # Phase 2: open local HTML; empty stats are OK
npx thumbgate capture --feedback=down --context="Never run DROP on production tables" --what-went-wrong="agent proposed DROP" --what-to-change="require review for DROP"
Los intentos posteriores de DROP en el mismo ámbito muestran la verificación:
⚠️ Check fired: "Never run DROP on production tables"
Pattern: DROP.*production
Verdict: 👎 WARN + LOG (⛔ BLOCK when THUMBGATE_STRICT_ENFORCEMENT=1)
Configuraciones numeradas: config/progressive/. Guía: cableado progresivo.
Instalación MCP / Glama / registro (stdio)
Los directorios y clientes que instalan ThumbGate como servidor MCP deben iniciar MCP stdio, no la API HTTP:
npx -y thumbgate serve
- Equivalente:
npx -y thumbgate mcp - No uses
npm startpara MCP — eso lanza la API HTTP alojada (src/api/server.js), no el servidor stdio orientado al agente.
▶ Demo de 90 segundos · Recorrido en GIF
Instala para tu agente
| Agente | Comando | Aplicación |
|---|---|---|
| Claude Code | npx thumbgate init --agent claude-code | 🛡️ Dura — PreToolUse |
| Codex | npx thumbgate init --agent codex | 🛡️ Dura — pre_tool_use |
| Gemini CLI | npx thumbgate init --agent gemini | 🛡️ Dura — PreToolUse |
| ForgeCode | npx thumbgate init --agent forge | 🛡️ Dura — pre_tool_use |
| Cursor | npx thumbgate init --agent cursor | 💬 Consultiva — MCP gate_check |
| Cline | npx thumbgate init --agent cline | 💬 Consultiva — MCP + .clinerules |
| OpenCode | npx thumbgate init --agent opencode | 💬 Consultiva — MCP gate_check |
| Cualquier agente MCP | npx thumbgate serve | 💬 Consultiva — MCP gate_check |
| Amp | npx thumbgate init --agent amp | 📝 Captura de retroalimentación |
| GitHub Actions | uses: IgorGanapolsky/ThumbGate@v1 | 🩺 Acción de Marketplace — doctor / inventario de IA en CI |
Guías por agente: Puente Claude/Codex · Perfil de Codex · Cursor · Configuración MCP
Alcance de instalación: a nivel de máquina vs por proyecto
| Alcance | Comando | Configuración | Lecciones | Mejor para |
|---|---|---|---|---|
| A nivel de máquina (por defecto) | npx thumbgate init | ~/.claude/settings.json | ~/.claude/memory/feedback/ | Operadores individuales — mismo almacén de retroalimentación local de máquina entre repos |
| Por proyecto | npx thumbgate init --project | <repo>/.claude/settings.json | <repo>/.claude/memory/feedback/ | Cliente / cumplimiento — panel separado / lecciones aisladas por repo |
Ambos alcances escriben mcpServers.thumbgate más hooks PreToolUse / UserPromptSubmit / PostToolUse / SessionStart. A nivel de máquina es el valor por defecto correcto para la mayoría de desarrolladores. El bloqueo entre repos no es automático: una lección aprendida en un proyecto solo se aplica en otro lugar cuando compartes el almacén (a nivel de máquina) o exportas/importas lecciones.
Herramientas MCP (superficie): gate_check (leer/evaluar llamada de herramienta propuesta), herramientas de captura de retroalimentación + sesión (escritura), panel/estadísticas (lectura). Las acciones destructivas del agente permanecen bloqueadas/advertidas por PreToolUse — ThumbGate no ejecuta comandos de shell del usuario por ti.
Comandos slash descubribles — la capa de guardarraíles para agentes guiados por especificaciones
Los frameworks de agentes guiados por especificaciones como GSD (get-shit-done) y GitHub Spec Kit planifican y generan trabajo. ThumbGate es la capa de guardarraíles para agentes guiados por especificaciones: se sitúa después del plan, en el límite entre una llamada de herramienta generada y su ejecución — junto a GSD / Spec-Kit, no en lugar de ellos.
npx thumbgate init instala estos en tu paleta de agente:
| Comando | Qué hace |
|---|---|
/thumbgate-dashboard | Abrir panel de proyecto local |
/thumbgate-guard | Convertir el último error en una regla de prevención dura |
/thumbgate-rules | Listar reglas y lecciones activas |
/thumbgate-blocked | Estadísticas de la puerta + matriz de aplicación |
/thumbgate-protect | Gobernanza de ramas + aprobación con alcance |
/thumbgate-doctor | Verificación de salud de hooks, MCP, preparación |
Precios y rutas de comprador
Nivel gratuito: 2 capturas de retroalimentación/día (10 en total) y hasta 3 reglas de prevención auto-promovidas activas. Pro ($19/mes o $149/año) es el nivel individual para reglas ilimitadas, lecciones conscientes del historial, flujo de sesión de retroalimentación vinculada, panel personal y exportación DPO. Enterprise es personalizado y con alcance después de la admisión; la sincronización de lecciones de equipo alojada y un panel de organización alojado no están disponibles de forma general.
| Gratis | Pro ($19/mes o $149/año) | Enterprise | |
|---|---|---|---|
| CLI local + PreToolUse | ✅ | ✅ | Con alcance después de la admisión |
| Capturas de retroalimentación | 2 capturas de retroalimentación/día (10 en total) | Ilimitadas | Con alcance después de la admisión |
| Reglas auto-promovidas activas | hasta 3 reglas de prevención auto-promovidas activas | Ilimitadas | Con alcance después de la admisión |
| Panel personal + exportación DPO | — | ✅ | Revisado durante la admisión |
| Sincronización de lecciones de equipo alojada | — | — | No disponible de forma general |
| Panel de organización alojado | — | — | No disponible de forma general |
Ruta de admisión Enterprise: el Sprint de Endurecimiento de Flujo de Trabajo define el alcance de un fallo repetido antes de cualquier compromiso de despliegue más amplio. Iniciar admisión →
Ruta técnica local: instala el CLI y usa init más la configuración documentada para que las Verificaciones de Pre-Acción evalúen llamadas de herramienta donde el agente realmente se ejecuta.
Ruta de activación del primer dólar: abre el ThumbGate GPT, pega la acción riesgosa, captura retroalimentación escrita (thumbs down: / thumbs up:). Los botones nativos de calificación de ChatGPT no son la ruta de captura de ThumbGate. Pregunta: ¿qué error repetido de IA valdría la pena detectar antes de que la herramienta se ejecute?
Ruta de pago para operadores individuales: ThumbGate Pro es el carril lateral de autoservicio para un panel personal y evidencia lista para exportar.
Comenzar gratis · Pro $19/mes · Panel en vivo · Admisión de Sprint de equipo · Sprint de Endurecimiento de Flujo de Trabajo · Manual del Primer Dólar
Preguntas populares de compradores: Presencia temática en búsqueda de IA · Conocimiento relacional y recomendaciones de IA · Anuncios en modo IA para gobernanza de agentes · Gobernanza de herramientas MCP · Puertas de aprobación de pre-acción para agentes de IA · Gobernanza de agentes en segundo plano · Evaluación del modelo GPT-5.5 · Detener errores repetidos de agentes de IA · Seguridad de automatización de navegador · Seguridad del host de mensajería nativa · Seguridad de agentes de autoinvestigación · Guardarraíles de Cursor · Guardarraíles de Codex CLI · Memoria + aplicación de Gemini CLI · Guardarraíles de Google Cloud MCP · Alternativa a Roo Code: migrar a Cline
Cómo funciona (resumen)
- Captura retroalimentación 👍/👎 (CLI, MCP, flujo de sesión de retroalimentación vinculada /
open_feedback_session, o ThumbGate GPT) - Promueve lecciones concretas mediante destilación de lecciones consciente del historial en reglas de prevención
- Evalúa la siguiente llamada de herramienta propuesta contra reglas activas (literal/AST + vectores locales)
- Permite / advierte / deniega antes de que la herramienta se ejecute
npx thumbgate brain --write # → .thumbgate/BRAIN.md (lessons + gates in one artifact)
Los operadores Pro pueden invocar search_lessons a través de MCP y usar npx thumbgate lessons desde el CLI. Las sesiones de retroalimentación conscientes del historial y la búsqueda de lecciones son capacidades Pro; Gratis no incluye recuperación ni búsqueda.
Diagrama de arquitectura y stack
flowchart LR
A["Agent tool call"] --> B{"Rule match?"}
B -- exact --> D["On-device gate"]
B -- semantic --> C["Local LanceDB"]
C --> D
D -- secret/kill --> E["⛔ Hard-block"]
D -- known-bad --> G["👎 Warn + log"]
D -- safe --> F["👍 Allow"]
Verificaciones integradas
⛔ secret-exfiltration → hard-block (default)
⛔ self-protect-kill → hard-block (default)
⛔ self-protect-env → hard-block (default)
⚠️ force-push → warn; hard-block under strict
⚠️ protected-branch → warn; hard-block under strict
⚠️ unresolved-threads → warn; hard-block under strict
⚠️ package-lock-reset → warn; hard-block under strict
Hoja de referencia de CLI
npx thumbgate init
npx thumbgate doctor
npx thumbgate capture up|down "<text>"
npx thumbgate lessons
npx thumbgate brain --write
npx thumbgate dashboard --open
npx thumbgate break-glass --reason="ThumbGate over-fired" # 5-min recovery
Pro: lección + exportación DPO
# Portable lessons
curl -X POST http://localhost:3456/v1/lessons/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"outputPath": "./lessons-export.json"}'
# DPO pairs for fine-tuning
curl -X POST http://localhost:3456/v1/dpo/export \
-H "Authorization: Bearer $THUMBGATE_API_KEY" \
-o dpo-pairs.jsonl
Pila tecnológica
| Capa | Tecnología |
|---|---|
| Runtime | Node.js ≥18 |
| Interfaces | MCP stdio, API HTTP, CLI |
| Almacenamiento | SQLite + FTS5, vectores LanceDB, registros JSONL |
| Inteligencia | MemAlign doble recuperación, muestreo Thompson, embeddings locales |
| Facturación / hosting | Stripe, Railway |
| Ejecución | Railway, Cloudflare Workers, sandboxes Docker |
| Gobernanza | Workflow Sentinel, plano de control, sandboxes Docker |
Cada Changeset está vinculado al commit de fusión exacto main y genera Evidencia de Verificación para la Confianza de Lanzamiento.
Integraciones (compacto)
| Superficie | Comience aquí |
|---|---|
| Open ThumbGate GPT | thumbgate.ai/go/gpt — ThumbGate GPT: comience aquí. Pegue acciones de agentes, obtenga consejos y puntos de control. No, los usuarios no tienen que seguir chateando dentro del ThumbGate GPT para usar ThumbGate — la capa de aplicación de reglas estricta sigue funcionando donde ocurre el trabajo. |
| Instalar el plugin de Codex | Abra la página de instalación del plugin de Codex: thumbgate.ai/codex-plugin · zip: thumbgate-codex-plugin.zip · plugins/codex-profile/INSTALL.md |
Claude Desktop .mcpb | última versión |
| VS Code / Open VSX | plugins/vscode-extension/README.md |
| Compatible con Antigravity | plugins/antigravity-extension/INSTALL.md |
| JetBrains | plugins/jetbrains-plugin/README.md · ruta de JetBrains Marketplace para el mismo runtime |
| ChatGPT App / GPT Action | thumbgate.ai/chatgpt-app |
| ThumbGate-Core (staging) | https://github.com/IgorGanapolsky/ThumbGate-Core — staging previo al lanzamiento y algunos scripts de caché internos; no es la ventaja competitiva del producto |
Documentación
Índice completo: docs/INDEX.md
| Necesidad | Enlace |
|---|---|
| Contrato de flujo de trabajo de agentes | WORKFLOW.md |
| Recepción lista para agentes | .github/ISSUE_TEMPLATE/ready-for-agent.yml |
| Evidencia de Verificación | docs/VERIFICATION_EVIDENCE.md |
| Confianza de Lanzamiento | docs/RELEASE_CONFIDENCE.md |
| Estrategia de Changeset | docs/CHANGESET_STRATEGY.md |
| Manual del Primer Dólar | docs/FIRST_DOLLAR_PLAYBOOK.md |
| Política de seguridad | SECURITY.md |
| Modelo de amenazas | THREAT_MODEL.md |
| Federal / regulado | docs/FEDERAL.md |
| Verdad Comercial | docs/COMMERCIAL_TRUTH.md |
| Problemas / PRs | GitHub Issues · plantilla de PR |
FAQ (respuestas breves): No es un ajustador fino (solo interceptación en runtime). Diferente de CLAUDE.md / .cursorrules (esos son contexto; ThumbGate es una capa externa de permitir/advertir/denegar antes de que se ejecuten las herramientas).
Quién construye esto
Igor Ganapolsky — pagos (Stripe/Connect), salvaguardas de agentes de IA/MCP, Android y backends. Pocas vacantes por contrato: $120–150/hora, 1099, remoto EE. UU.. LinkedIn · thumbgate.ai
Licencia
MIT — consulte LICENSE. Política del proyecto: SECURITY.md · THREAT_MODEL.md.