Mnemory
Un sistema de memoria autogestionado, seguro y rico en funciones para agentes y asistentes de IA. Proporciona extracción inteligente de hechos y deduplicación, con un almacén de artefactos para contenido detallado.
Documentación
mnemory
Dale a tus agentes de IA una memoria persistente. mnemory es un servidor MCP autoalojado que añade personalización y memoria a largo plazo a cualquier asistente de IA: Claude Code, ChatGPT, Open WebUI, Cursor, o cualquier cliente compatible con MCP.
Plug and play. Conecta mnemory y tu agente comienza inmediatamente a recordar preferencias, hechos, decisiones y contexto del usuario entre conversaciones. Sin necesidad de cambios en el system prompt.
Autoalojado y seguro. Tus datos permanecen en tu infraestructura. Sin dependencias en la nube, sin acceso de terceros a tus recuerdos.
Inteligente. Utiliza un pipeline LLM unificado para extracción de hechos, deduplicación y resolución de contradicciones en una sola llamada. Los recuerdos son semánticamente buscables, categorizados automáticamente y expiran naturalmente cuando dejan de ser relevantes.
Características
- Cero configuración —
uvx mnemory, conecta tu cliente MCP, listo. Funciona directamente con cualquier API compatible con OpenAI. - Extracción inteligente — Una sola llamada LLM extrae hechos, clasifica metadatos y deduplica contra recuerdos existentes.
- Resolución de contradicciones — "Conduzco un Skoda" + más tarde "Compré un Tesla" = actualización automática, no un duplicado.
- Memoria de dos niveles — Resúmenes rápidos y buscables en un vector store + almacenamiento detallado de artefactos (informes, código, investigación) recuperado bajo demanda.
- Búsqueda impulsada por IA — Búsqueda semántica multi-consulta con conciencia temporal. Pregunta "¿Qué decidí la semana pasada sobre la base de datos?" y encuentra los recuerdos correctos.
- Comprobaciones de salud de la memoria — Verificador de coherencia de tres fases integrado (fsck) que detecta duplicados, contradicciones, problemas de calidad e inyección de prompts. Se ejecuta manualmente o con programación y corrección automática.
- Soporte para 10+ clientes — Claude Code, ChatGPT, Open WebUI, OpenClaw, Cursor, Windsurf, Cline, OpenCode y más. Plugins nativos disponibles para recuerdo/recordatorio automático.
- Interfaz de gestión integrada — Panel de control, búsqueda semántica, explorador de recuerdos con CRUD completo, visualización de grafo de relaciones e interfaz de comprobación de salud. Sin herramientas adicionales.
- Listo para producción — Qdrant para vectores, S3/MinIO para artefactos, autenticación con API key o Cognis JWT, aislamiento por usuario, HTTP sin estado amigable con Kubernetes.
- Seguro por defecto — Autenticación con API key o Cognis JWT con vinculación de identidad a nivel de sesión, aislamiento de memoria por usuario, salvaguardas anti-inyección en prompts de extracción.
- API REST + MCP — Interfaz dual con el mismo backend. 16 herramientas MCP + API REST completa con especificación OpenAPI. Construye plugins, integraciones o úsalo directamente.
- Monitorización Prometheus — Endpoint
/metricsintegrado con contadores de operación y medidores de memoria. Incluye panel de Grafana predefinido.
Inicio rápido
mnemory necesita una clave de API compatible con OpenAI para LLM y embeddings. Recoge OPENAI_API_KEY de tu entorno automáticamente.
uvx mnemory
Eso es todo. mnemory arranca en http://localhost:8050/mcp, almacena datos en ~/.mnemory/.
Ahora conecta tu cliente — para Claude Code, añade a tu configuración de MCP:
{
"mcpServers": {
"mnemory": {
"type": "streamable-http",
"url": "http://localhost:8050/mcp",
"headers": {
"X-Agent-Id": "claude-code"
}
}
}
}
Inicia una nueva conversación. La memoria funciona automáticamente.
También disponible mediante Docker, pip, o configuración de producción con Qdrant + S3. Consulta la guía de inicio rápido completa para más clientes y opciones.
Capturas de pantalla
Panel con desglose de memoria por tipo, categoría y rol
Búsqueda semántica y búsqueda con IA y filtros
Visualización del grafo de relaciones de memoria
Consulta todas las capturas de pantalla y características de la interfaz, incluyendo explorador de memoria, comprobaciones de salud y gestión de artefactos.
Clientes compatibles
mnemory funciona con cualquier cliente compatible con MCP. Algunos clientes también tienen plugins dedicados para recuerdo/recordatorio automático.
| Cliente | MCP | Plugin | Guía de configuración |
|---|---|---|---|
| Claude Code | Sí | Sí (hooks) | Guía |
| ChatGPT | Sí (conector MCP) | -- | Guía |
| Claude Desktop | Sí | -- | Guía |
| Hermes Agent | Sí | Sí (plugin) | Guía |
| Open WebUI | Sí | Sí (filtro) | Guía |
| OpenCode | Sí | Sí (plugin) | Guía |
| OpenClaw | Sí | Sí (plugin) | Guía |
| Cursor | Sí | -- | Guía |
| Windsurf | Sí | -- | Guía |
| Cline | Sí | -- | Guía |
| Continue.dev | Sí | -- | Guía |
| Codex CLI | Sí | -- | Guía |
MCP = funciona mediante el Protocolo de Contexto de Modelo (llamadas a herramientas dirigidas por LLM). Plugin = integración dedicada con recuerdo/recordatorio automático (sin necesidad de llamadas a herramientas LLM).
Cómo funciona
Almacenamiento: Compartes información de forma natural. mnemory extrae hechos individuales, los clasifica (tipo, categoría, importancia), comprueba duplicados y contradicciones con recuerdos existentes, y los almacena como vectores buscables — todo en una sola llamada LLM.
Búsqueda: Haz una pregunta y mnemory genera múltiples consultas de búsqueda que cubren diferentes ángulos y asociaciones, las ejecuta en paralelo y reordena los resultados por relevancia. Con conciencia temporal — "¿qué decidí la semana pasada?" simplemente funciona.
Recuerdo: Al inicio de la conversación, tu agente carga recuerdos fijos (hechos clave, preferencias, identidad) además del contexto reciente. Durante la conversación, los recuerdos relevantes se encuentran automáticamente según el tema tratado.
Mantenimiento: Los recuerdos tienen TTL configurable — el contexto expira en 7 días, los recuerdos episódicos en 90. Los recuerdos de acceso frecuente permanecen activos (refuerzo). El verificador de salud integrado detecta y corrige duplicados, contradicciones y problemas de calidad.
Aprende más en la documentación de arquitectura.
Benchmark
Evaluado en el benchmark LoCoMo — 10 diálogos de múltiples sesiones con 1540 preguntas de QA en 4 categorías:
| Sistema | single_hop | multi_hop | temporal | open_domain | General |
|---|---|---|---|---|---|
| mnemory | 63.1 | 53.1 | 74.8 | 78.2 | 73.2 |
| mnemory (gpt-oss-120b) | 66.3 | 59.4 | 68.5 | 73.8 | 70.5 |
| Memobase | 70.9 | 52.1 | 85.0 | 77.2 | 75.8 |
| Mem0-Graph | 65.7 | 47.2 | 58.1 | 75.7 | 68.4 |
| Mem0 | 67.1 | 51.2 | 55.5 | 72.9 | 66.9 |
| Zep | 61.7 | 41.4 | 49.3 | 76.6 | 66.0 |
| LangMem | 62.2 | 47.9 | 23.4 | 71.1 | 58.1 |
Configuración: gpt-5-mini para extracción, text-embedding-3-small para vectores. gpt-oss-120b mediante Groq es una alternativa de bajo coste con ~5x menor coste y calidad comparable. Consulta la documentación de configuración para opciones de modelos y benchmarks/ para reproducción.
Documentación
| Documento | Descripción |
|---|---|
| Inicio rápido | Ponte en marcha en 5 minutos con cualquier cliente |
| Configuración | Todas las variables de entorno — LLM, almacenamiento, servidor, comportamiento de la memoria |
| Modelo de memoria | Tipos, categorías, importancia, TTL, roles, alcance, subagentes |
| Herramientas MCP | 16 herramientas MCP — CRUD de memoria, búsqueda, artefactos |
| API REST | API REST completa, pipeline fsck, endpoints de recuerdo/recordatorio |
| Arquitectura | Diagrama del sistema, flujos detallados de almacenamiento/búsqueda/recuerdo |
| Interfaz de gestión | Capturas de pantalla, características, acceso, desarrollo de la interfaz |
| Monitorización | Métricas Prometheus, panel de Grafana |
| Despliegue | Configuración de producción, Docker, autenticación, Kubernetes |
| Desarrollo | Compilar, probar, linting, contribuir |
| Guías de cliente | Instrucciones de configuración por cliente (10 clientes) |
| Prompts del sistema | Plantillas para agentes de personalidad y configuraciones personalizadas |
Licencia
Apache 2.0