Wyrm
Memoria persistente para agentes de IA a través de MCP: almacenamiento local primero, aprendizaje negativo de fallos pasados y recuperación híbrida, publicado en npm como wyrm-mcp.
Documentación
Memoria persistente para agentes de IA, a través de MCP.
Verdades fundamentales, fallos registrados que bloquean repeticiones, causalidad de decisiones y recuperación híbrida.
Una memoria SQLite estructurada en tu máquina. Sin nube, sin LLM separado.
Sitio web · Inicio rápido · Discusiones · Registro de cambios
Qué es
La mayoría de las sesiones de codificación con IA empiezan desde cero. Wyrm le da al agente una memoria que persiste entre sesiones. Guarda las decisiones, convenciones, trabajo pendiente y callejones sin salida de tu proyecto en una base de datos estructurada en tu propia máquina, y se los devuelve al modelo al inicio de la siguiente sesión. Un agente conectado a Wyrm recuerda lo que se decidió la semana pasada en lugar de volver a deducirlo, y se le puede impedir repetir un enfoque que ya falló.
Habla el Protocolo de Contexto de Modelos (MCP), por lo que se integra en Claude, Cursor, Copilot, Windsurf y Codex sin código de conexión adicional.
Inicio rápido
npm install -g wyrm-mcp # install
wyrm-setup # wire it into your AI clients, then restart them
Si
npm install -gfalla con EACCES, el prefijo global de npm es un directorio en el que no puedes escribir (a menudo/usr). Instala bajo un prefijo que te pertenezca y pon subinen tu PATH:npm install -g --prefix ~/.npm-global wyrm-mcp, luegoexport PATH="$HOME/.npm-global/bin:$PATH".wyrm updateactualiza más tarde esa misma instalación.
En npm v12+, npm deniega los scripts de instalación de dependencias por defecto, lo que omite la compilación nativa de
better-sqlite3— la instalación tiene éxito perowyrmluego falla con "Could not locate the bindings file". Instala con la compilación en la lista de permitidos en su lugar:npm install -g wyrm-mcp --allow-scripts=wyrm-mcp,better-sqlite3,onnxruntime-node,protobufjs(wyrm updateya hace esto por ti). Consulta TROUBLESHOOTING.md.
Luego, desde tu cliente, pídele que llame a wyrm_capabilities para confirmar la conexión. El ciclo diario son cuatro pasos que el agente ejecuta por sí solo una vez que se establece el hábito:
prime → load the project's truths, quests, and dead-ends at session start
recall → retrieve what you know before re-deriving it
check → before retrying an approach, ask if it already failed
capture → store durable facts, lessons, and tasks as you go
Medido, no afirmado
Cada número que publica Wyrm proviene de un benchmark comprometido con la fuente, reproducible con tus propios datos. El cortafuegos de aprendizaje negativo y la mejora de recuperación son los dos que más importan, y ambos se cubren a continuación.
El recibo del cortafuegos
El recibo es la prueba medida de una afirmación: cuando un fallo está registrado, el cortafuegos bloquea la repetición, permanece en silencio ante acciones novedosas y elimina el bloqueo una vez que la fuente anclada se desvía, de forma determinista y sin modelo en el bucle. En wyrm-mcp 9.1.2, medido el 2026-09-12, el benchmark determinista puntúa recall 100% (32/32) en repeticiones de la misma acción y reformuladas con precisión 100% (0 bloqueos falsos de 16), y en el A/B ciego con agente la tasa de fallos repetidos cae del 38.9% (14/36) al 8.3% (3/36), una reducción relativa del 78.6% con un IC bootstrap del 95% de 45.5% a 100% (n=36 por brazo). El método, la tabla por escenario y los dos límites que conllevan los números están en docs/firewall-receipt.md; el recibo determinista se regenera en cada push en CI como el artefacto firewall-receipt-node22.x (workflow).
El cortafuegos de fallos en veinte segundos: un fallo está registrado, el agente propone el mismo despliegue, y el hook PreToolUse lo rechaza con el motivo registrado antes de que se ejecute el comando. Una variante con una bandera añadida recibe un aviso, no un bloqueo, que es el límite honesto de la coincidencia determinista. Cada línea del clip es salida real del hook.

Por qué Wyrm
Recuerda lo que falló, no solo lo que funcionó
La mayoría de las herramientas de memoria almacenan éxitos. Wyrm también registra callejones sin salida y bloquea la repetición. Registras un enfoque fallido con wyrm_failure_record, y un wyrm_failure_check posterior lo saca a la superficie antes de que el agente vuelva a caer en él. En una sesión, eso deja de re-litigar problemas resueltos; en una flota de agentes, el callejón sin salida de un trabajador advierte al resto, una vez.
Recuperación que encuentra cosas por significado, no solo por palabras clave
wyrm_recall ejecuta búsqueda por palabras clave (FTS5) y búsqueda semántica sobre un índice vectorial, las fusiona y las reordena. Es híbrido por defecto, sin configuración requerida, sin cuenta y sin llamada alojada: un pequeño modelo de incrustación local se descarga automáticamente la primera vez que ejecutas wyrm-setup. También pondera la actualidad, las señales temporales y la reutilización confirmada, de modo que la memoria que encaja con el momento se clasifica primero. En un benchmark LoCoMo de conjunto real comprometido en el repositorio, el piso determinista sin LLM es recall@5 52.4% / recall@10 59.9%, y el modelo local incluido lo eleva a recall@5 60.0% / recall@10 72.0% (en línea con la referencia local-híbrida publicada de 60.3% / 72.2%, ver BENCHMARKS.md). Para máxima precisión, wyrm upgrade se mueve a recuperación alojada NVIDIA NIM (abajo).
Local primero, y honesto sobre el tráfico saliente
Por defecto, ningún dato de memoria sale de tu máquina. La base de datos es un único archivo SQLite en ~/.wyrm/wyrm.db. Las únicas llamadas salientes por defecto son una consulta diaria de versión de npm y, en instalaciones con clave de licencia, una consulta firmada de lista de revocación — ambas desactivadas con WYRM_NO_VERSION_CHECK=1 y WYRM_LICENSE_REFRESH=0 respectivamente; la descarga única del modelo del nivel gratuito es una consulta simple que no envía nada. docs/EGRESS.md en el repositorio enumera cada destino, y si encuentras una llamada saliente que no está en esa tabla, es un error que vale la pena reportar. Cuando optas por una ruta de incrustación alojada, Wyrm informa exactamente qué salió y a dónde, en un recibo de determinismo y en su endpoint de salud. La afirmación de privacidad es verificable desde el runtime, no solo desde los documentos.
Cada escritura deja un recibo
Cada escritura de memoria devuelve un recibo estructurado que dice qué le pasó: almacenada, en cola para revisión, fusionada, aliasada o descartada, y por qué. Los recibos también se registran en un libro mayor, de modo que wyrm digest --writes reconstruye las escrituras de un día sin conexión y wyrm_stats muestra los resultados y la profundidad de la cola de revisión. Puedes auditar lo que el agente realmente comprometió a la memoria, no solo confiar en que lo hizo.
Construido para un agente o una flota
Cada memoria se atribuye al agente y a la ejecución que la produjo, de modo que un enjambre de agentes puede compartir un bus de memoria responsable, con los fallos mantenidos privados para tu cuenta por defecto. Un flujo de eventos en vivo mantiene los dispositivos sincronizados.
La entrada no confiable se mantiene fuera del resumen de contexto
Cada artefacto está etiquetado con su origen: tú, un agente, una importación o una fuente no confiable. El contenido en el carril no confiable se retiene categóricamente de los resúmenes de contexto que lee el modelo, sea lo que sea, y el contenido importado está controlado por detector y marcado. La cuarentena de la superficie de resumen se endureció contra un red-team completo de garak de 622 payloads reales de jailbreak: cero escapes del carril no confiable por construcción, y el detector marcó el 80.7% del resto con cero falsos positivos en prosa benigna. Ese red-team se ejecuta como puerta de CI.
Recuperación NVIDIA NIM (opcional)
Los vectores locales están activados por defecto. NIM es el siguiente paso, para incrustaciones y reordenamiento, cuando la precisión vale una llamada alojada. En el benchmark de recuperación LoCoMo comprometido en el repositorio (2 conversaciones, k=10, medido en septiembre de 2026), el modelo de incrustación NIM por defecto nvidia/nemotron-3-embed-1b alcanzó recall@1 39.9% y recall@10 76.7%; añadiendo el reordenador NIM (nvidia/llama-nemotron-rerank-vl-1b-v2) elevó recall@1 al 55.5% en las mismas 301 preguntas, a aproximadamente un segundo extra por consulta. Las cifras publicadas aquí anteriormente se midieron en modelos que NVIDIA retiró el 25 de agosto de 2026 y se han retirado. Es una opción explícita, desactivada por defecto, y el tráfico saliente se divulga en cada llamada.
La ruta guiada es wyrm upgrade: una clave API gratuita, entrada de clave enmascarada, una llamada en vivo para validar la clave antes de que se escriba nada, y un reindexado único opcional de memorias existentes en el nuevo nivel. Para configurarlo manualmente en su lugar:
export WYRM_VECTOR_PROVIDER=nim
export WYRM_RERANK_PROVIDER=nim
export NVIDIA_API_KEY=nvapi-...
Ghost Protocol (Pvt) Ltd es miembro de NVIDIA Inception.
Funciona con
Claude (Code, escritorio, web) · Cursor · GitHub Copilot · Windsurf · Codex, y cualquier cliente compatible con MCP.
Requisitos
Node.js 22 o más reciente. La recuperación semántica está activada por defecto mediante un pequeño modelo local incluido (wyrm-setup lo descarga, sin necesidad de cuenta); wyrm upgrade añade recuperación alojada NVIDIA NIM para máxima precisión. ¿Ya usas Ollama para esto? Las configuraciones existentes siguen funcionando sin cambios.
Precios
Wyrm es gratis para siempre — la memoria local, el cortafuegos, la recuperación, todo. Los planes de pago añaden sincronización en la nube entre dispositivos, instantáneas cifradas, memoria de equipo compartida y soporte:
- Pro — $29/mes · sincronización en la nube, instantáneas cifradas, análisis, soporte prioritario
- Team — $199/mes · memoria de equipo compartida, hasta 25 asientos, panel de administración
- Enterprise — $499/mes · asientos ilimitados, SSO/SAML, SLA personalizado, opción local
Planes y pago autogestionado: account.ghosts.lk/pricing. Personalizado o local, escribe a ryan@ghosts.lk.
Comunidad y comentarios
Wyrm no envía telemetría, así que la forma en que aprendemos qué funciona es que nos lo cuentes.
wyrm feedbackdesde tu terminal abre un informe prellenado. Añade--bug,--ideao--question.- Discusiones para preguntas, ideas y cómo va.
- Problemas para errores y solicitudes concretas.
- Correo electrónico ryan@ghosts.lk.
Si Wyrm se ha ganado un lugar en tu flujo de trabajo, una estrella ayuda a que otros lo encuentren.
Licencia
Wyrm es software propietario, gratuito bajo la licencia Wyrm y los Términos de Servicio. Este repositorio es el hogar público de los documentos, el registro de cambios y la comunidad. La fuente no se publica aquí. Para una licencia comercial (incrustar Wyrm en un producto cerrado o ejecutarlo como servicio gestionado), contacta con ryan@ghosts.lk.
Construido por Ghost Protocol · Colombo, Sri Lanka
NVIDIA, el logotipo de NVIDIA y NVIDIA Inception son marcas comerciales y/o marcas registradas de NVIDIA Corporation.