Mnemory

Um sistema de memória auto-hospedado, seguro e rico em recursos para agentes e assistentes de IA. Fornece extração inteligente de fatos e deduplicação, com um repositório de artefatos para conteúdo detalhado.

Documentação

mnemory banner

mnemory

Dê aos seus agentes de IA memória persistente. mnemory é um servidor MCP auto-hospedado que adiciona personalização e memória de longo prazo a qualquer assistente de IA — Claude Code, ChatGPT, Open WebUI, Cursor, ou qualquer cliente compatível com MCP.

Plug and play. Conecte o mnemory e seu agente imediatamente começa a lembrar preferências do usuário, fatos, decisões e contexto entre conversas. Nenhuma alteração no system prompt é necessária.

Auto-hospedado e seguro. Seus dados permanecem na sua infraestrutura. Sem dependências de nuvem, sem acesso de terceiros às suas memórias.

Inteligente. Usa um pipeline unificado de LLM para extração de fatos, deduplicação e resolução de contradições em uma única chamada. As memórias são pesquisáveis semanticamente, categorizadas automaticamente e expiram naturalmente quando não são mais relevantes.

Recursos

  • Zero configuração — uvx mnemory, conecte seu cliente MCP, pronto. Funciona imediatamente com qualquer API compatível com OpenAI.
  • Extração inteligente — Uma única chamada de LLM extrai fatos, classifica metadados e deduplica contra memórias existentes.
  • Resolução de contradições — "Eu dirijo um Skoda" + depois "Eu comprei um Tesla" = atualização automática, não uma duplicata.
  • Memória em dois níveis — Resumos pesquisáveis rápidos em um armazenamento vetorial + armazenamento detalhado de artefatos (relatórios, código, pesquisa) recuperados sob demanda.
  • Busca com IA — Busca semântica multi-consulta com consciência temporal. Pergunte "O que eu decidi na semana passada sobre o banco de dados?" e ele encontra as memórias certas.
  • Verificações de saúde da memória — Verificador de consistência integrado em três fases (fsck) detecta duplicatas, contradições, problemas de qualidade e injeção de prompt. Execute manualmente ou em agendamento com correção automática.
  • Suporte a 10+ clientes — Claude Code, ChatGPT, Open WebUI, OpenClaw, Cursor, Windsurf, Cline, OpenCode e mais. Plugins nativos disponíveis para recall/remember automáticos.
  • Interface de gerenciamento integrada — Painel, busca semântica, navegador de memórias com CRUD completo, visualização de grafo de relacionamentos e interface de verificação de saúde. Nenhuma ferramenta extra necessária.
  • Pronto para produção — Qdrant para vetores, S3/MinIO para artefatos, autenticação por chave de API ou JWT Cognis, isolamento por usuário, HTTP stateless compatível com Kubernetes.
  • Seguro por padrão — Autenticação por chave de API ou JWT Cognis com vínculo de identidade em nível de sessão, isolamento de memória por usuário, salvaguardas anti-injeção nos prompts de extração.
  • API REST + MCP — Interface dupla com o mesmo backend. 16 ferramentas MCP + API REST completa com especificação OpenAPI. Crie plugins, integrações ou use diretamente.
  • Monitoramento Prometheus — Endpoint /metrics integrado com contadores de operação e medidores de memória. Painel Grafana pré-construído incluído.

Início Rápido

O mnemory precisa de uma chave de API compatível com OpenAI para LLM e embeddings. Ele capta OPENAI_API_KEY do seu ambiente automaticamente.

uvx mnemory

Se uvx relatar No module named 'mcp.server.fastmcp', atualize o uv. Versões mais antigas do uv no Alpine podem ignorar a restrição de dependência MCP v1 do mnemory. Até atualizar o uv, execute:

uvx --with "mcp<2" mnemory

É isso. O mnemory inicia em http://localhost:8050/mcp, armazena dados em ~/.mnemory/.

Agora conecte seu cliente — para Claude Code, adicione à sua configuração MCP:

{
  "mcpServers": {
    "mnemory": {
      "type": "streamable-http",
      "url": "http://localhost:8050/mcp",
      "headers": {
        "X-Agent-Id": "claude-code"
      }
    }
  }
}

Inicie uma nova conversa. A memória funciona automaticamente.

Também disponível via Docker, pip, ou configuração de produção com Qdrant + S3. Veja o guia completo de início rápido para mais clientes e opções.

Capturas de Tela

Dashboard — memory totals, breakdowns, and operation counts
Painel com detalhamento de memórias por tipo, categoria e papel

Search — semantic and AI-powered search with filters
Busca semântica e busca com IA com filtros

Graph — D3.js force-directed memory relationship visualization
Visualização do grafo de relacionamentos de memória

Veja todas as capturas de tela e recursos da interface incluindo navegador de memórias, verificações de saúde e gerenciamento de artefatos.

Clientes Suportados

O mnemory funciona com qualquer cliente compatível com MCP. Alguns clientes também têm plugins dedicados para recall/remember automáticos.

ClienteMCPPluginGuia de Configuração
Claude CodeSimSim (hooks)Guia
ChatGPTSim (conector MCP)--Guia
Claude DesktopSim--Guia
Hermes AgentSimSim (plugin)Guia
Open WebUISimSim (filtro)Guia
OpenCodeSimSim (plugin)Guia
OpenClawSimSim (plugin)Guia
CursorSim--Guia
WindsurfSim--Guia
ClineSim--Guia
Continue.devSim--Guia
Codex CLISim--Guia

MCP = funciona via Model Context Protocol (chamadas de ferramentas orientadas por LLM). Plugin = integração dedicada com recall/remember automáticos (sem necessidade de chamadas de ferramentas por LLM).

Como Funciona

Armazenamento: Você compartilha informações naturalmente. O mnemory extrai fatos individuais, classifica-os (tipo, categoria, importância), verifica duplicatas e contradições contra memórias existentes e os armazena como vetores pesquisáveis — tudo em uma única chamada de LLM.

Busca: Faça uma pergunta e o mnemory gera múltiplas consultas de busca cobrindo diferentes ângulos e associações, executa-as em paralelo e reordena os resultados por relevância. Com consciência temporal — "o que eu decidi na semana passada?" simplesmente funciona.

Recall: No início da conversa, seu agente carrega memórias fixadas (fatos centrais, preferências, identidade) além do contexto recente. Durante a conversa, memórias relevantes são encontradas automaticamente com base no que você está discutindo.

Manutenção: As memórias têm TTL configurável — o contexto expira em 7 dias, memórias episódicas em 90. Memórias acessadas com frequência permanecem ativas (reforço). O verificador de saúde integrado detecta e corrige duplicatas, contradições e problemas de qualidade.

Saiba mais na documentação de arquitetura.

Benchmark

Avaliado no benchmark LoCoMo — 10 diálogos multi-sessão com 1540 perguntas de QA em 4 categorias:

Sistemasingle_hopmulti_hoptemporalopen_domainGeral
mnemory63.153.174.878.273.2
mnemory (gpt-oss-120b)66.359.468.573.870.5
Memobase70.952.185.077.275.8
Mem0-Graph65.747.258.175.768.4
Mem067.151.255.572.966.9
Zep61.741.449.376.666.0
LangMem62.247.923.471.158.1

Configuração: gpt-5-mini para extração, text-embedding-3-small para vetores. gpt-oss-120b via Groq é uma alternativa econômica a ~5x menor custo com qualidade comparável. Veja a documentação de configuração para opções de modelo e benchmarks/ para reprodução.

Documentação

DocumentoDescrição
Início RápidoComece em 5 minutos com qualquer cliente
ConfiguraçãoTodas as variáveis de ambiente — LLM, armazenamento, servidor, comportamento de memória
Modelo de MemóriaTipos, categorias, importância, TTL, papéis, escopo, sub-agentes
Ferramentas MCP16 ferramentas MCP — CRUD de memórias, busca, artefatos
API RESTAPI REST completa, pipeline fsck, endpoints de recall/remember
ArquiteturaDiagrama do sistema, fluxos detalhados para armazenamento/busca/recall
Interface de GerenciamentoCapturas de tela, recursos, acesso, desenvolvimento da interface
MonitoramentoMétricas Prometheus, painel Grafana
ImplantaçãoConfiguração de produção, Docker, autenticação, Kubernetes
DesenvolvimentoCompilação, testes, linting, contribuição
Guias de ClientesInstruções de configuração por cliente (10 clientes)
System PromptsModelos para agentes de personalidade e configurações personalizadas

Licença

Apache 2.0