Reelier

oficial

Agentes fazem afirmações. Reelier emite recibos — registre o fluxo de chamadas de ferramentas de um agente uma vez, reproduza-o deterministicamente com 0 tokens e compare execuções para detectar desvios.

O que você pode fazer com Reelier MCP?

  • Reproduzir habilidades gravadas de forma determinística — Peça para reelier run executar um .skill.md salvo com 0 tokens, somente leitura por padrão, para reexecução byte a byte idêntica.
  • Detectar desvios em execuções de agente — Use reelier diff para comparar uma reprodução com a original e sinalizar SAME ou DRIFTED por etapa, saindo com código 1 em qualquer alteração.
  • Bloquear PRs de atualização de dependências — Peça ao assistente para configurar um fluxo de CI que reproduza sua habilidade contra PRs do Dependabot/Renovate e falhe na etapa exata onde houve desvio.
  • Converter rastros existentes em habilidades — Compile um trace.jsonl ou um SKILL.md existente em uma habilidade reproduzível via reelier compile, com lacunas honestas listadas como perguntas em aberto.
  • Verificar recibos assinados offline — Execute reelier verify para recalcular cada afirmação na escada de um recibo enviado, mostrando quais degraus são comprovados e quais são lacunas honestas.
  • Inspecionar a cobertura do agente antes de gravar — Use reelier init --dry-run para verificar a cobertura de observação dos Caminhos A/B/C e os candidatos a reprodução sem gravar ou alterar nada.

Documentação

Reelier

Reelier

Deixe seus agentes escreverem. Guarde os recibos.

Seus agentes trabalharam a noite toda. Aqui está exatamente o que mudou.

Reelier registra a execução que funcionou, congela-a como uma habilidade reproduzível e a reproduz deterministicamente — cada execução retorna como um recibo: prova do que o agente fez e do que mudou por causa disso. Agentes fazem afirmações. Reelier escreve recibos.

npm version CI tests license Discord stars

Website · Docs · SPEC.md

Reelier: Dependabot bumps a dependency, Reelier replays your recorded agent run at 0 tokens and diffs it, catching the drift on the PR before you merge

▶ assista com som (27s)

Reelier MCP server on Glama


Recibos nos seus PRs de agentes — instale e pronto

PRs escritos por agentes (Dependabot, Claude, Codex, Cursor, …) recebem um comentário de recibo em segundos: autor, arquivos alterados, escopo declarado vs. o que realmente mudou, caminhos sensíveis sinalizados. Sem arquivo de workflow, sem CLI, sem configuração.

→ Instale o GitHub App de recibos do Reelier — gratuito em repositórios públicos, para sempre.

Recibo do Reelier — PR de agente Autor: dependabot[bot] · Arquivos alterados: 2 (+119 −41) Escopo declarado: nenhum (adicione .reelier/scope.yml para ativar a detecção de escrita inesperada) Caminhos sensíveis tocados: ⚠ 1 — package-lock.json Comprova escopo e mudança, não correção

Um recibo real dos próprios repositórios do Reelier — veja um ao vivo. Declare o escopo por agente em .reelier/scope.yml (ou um bloco reelier-scope no corpo do PR) e o recibo relata escritas inesperadas. O recibo comprova escopo e mudança, nunca correção ou segurança.


Por quê

Agentes de IA são não determinísticos — o mesmo prompt, um resultado diferente a cada execução — e eles afirmarão que fizeram o trabalho, tenham feito ou não. Reelier registra a execução que funcionou, reproduz deterministicamente e escreve um recibo assinado que comprova isso. Aponte-o para sua CI existente em um workflow — ele adiciona um recibo verificável, não substitui sua stack.

Medido em um benchmark real frente a frente, mesma tarefa, mesmos dados (método completo):

  • 1.000 / 1.000 reproduções byte-idênticas
  • Cada reprodução entrega um recibo assinado — prova do que foi executado e do que mudou, nunca uma afirmação
  • 0 chamadas de LLM na reprodução — reexecução determinística, não re-raciocínio

A reprodução determinística também é ~50× mais barata e ~59× mais rápida do que reexecutar o agente, no mesmo benchmark.

Instalação

npm i -g reelier && reelier init
# No Node install needed — same commands via Docker:
docker run --rm ghcr.io/seldonframe/reelier --help

reelier init [--dry-run] realiza uma inspeção local com checkpoint em todos os três caminhos do Reelier: Caminho A cobertura de observação, Caminho B candidatos a reprodução/congelamento, e Caminho C conexões e candidatos limitáveis/capazes de resultado/somente-sombra/não suportados. Ele não faz deploy, gate, despacho, upload, copia credenciais ou reescreve a configuração do host. --dry-run não escreve nada; o comando normal escreve apenas artefatos sanitizados abaixo de .reelier/init/.

Como plugin de agente

Ensine seu agente de codificação quando usar o Reelier. Os mesmos dois comandos, em qualquer host:

claude plugin marketplace add seldonframe/reelier
claude plugin install reelier@seldonframe
codex plugin marketplace add seldonframe/reelier
codex plugin add reelier@seldonframe

Isso instala duas Agent Skills e nada mais. reelier-replay ensina seu agente a congelar um trabalho de chamada de ferramenta repetível e reproduzi-lo com 0 tokens. reelier-write-safety cobre a limitação das escritas de um agente antes de concedê-las: o que o gravador vê, o que uma política recusa e o que um recibo comprova e não comprova. Ele não inclui servidores MCP, então não envolve, observa ou faz gate de nenhuma chamada de ferramenta por conta própria; o CLI reelier faz isso, e as skills o acionam via npx. Empacotado tanto no formato Agent Plugins v1.0.0 (plugin/agent-plugins/) quanto no formato Claude Code (plugin/claude/), gerado de uma única fonte por scripts/build-plugin-packages.mjs.

Verificado de ponta a ponta em codex-cli 0.147.0-alpha.1.2: ambos os formatos instalam, habilitam e a skill chega ao modelo. Outros hosts não foram testados, e o status por host é rastreado em docs/specs/agent-plugins-coverage-v1.md §4 em vez de ser afirmado aqui.

Como usar

reelier init --dry-run              # inspect Path A/B/C locally; write nothing
reelier init                        # persist resumable sanitized inspection artifacts
reelier run  <name>.skill.md        # replay deterministically — 0 tokens (read-only by default)
reelier diff <name>                 # SAME or DRIFTED, per step — exit 1 on drift
reelier push <name>.skill.md        # sync receipts to your ledger (opt-in)
reelier ci                          # write a workflow: drift-CI + PR receipts, one command
  1. Inspecione, depois registre ou congele. reelier init revela cobertura observada e candidatos locais sem alterar rotas. reelier mcp --wrap "<mcp server>" faz proxy de ferramentas ao vivo; reelier scan/from-session congela histórico suportado.
  2. Compile. reelier compile transforma um trace em um SKILL.md — 0 chamadas de LLM, asserções mínimas, lacunas honestas impressas como Perguntas em aberto.
  3. Reproduza. reelier run reproduz no Nível 0 — sem LLM, byte-idêntico, somente leitura por padrão (escritas precisam de --allow-writes).
  4. Compare. reelier diff relata SAME ou DRIFTED por etapa, com a asserção que falhou como o porquê — saída 1 em drift.
  5. Faça login. reelier login conecta esta máquina ao Reelier Cloud com um código de dispositivo no seu navegador — ou defina REELIER_CLOUD_URL/REELIER_CLOUD_KEY para CI e self-hosting.
  6. Envie. Cada execução é um recibo; reelier push opcionalmente sincroniza para um ledger para um link permanente e um selo de reprodução verificada incorporável.

Já tem uma Agent Skill? Converta-a — sua skill, menos o modelo:

reelier compile trace.jsonl --from-skill ./my-skill/SKILL.md

Três testes, uma skill

TesteComandoRespostas
Determinismoreelier run <skill.md>Isso ainda faz o que fazia?
Recuperaçãoreelier run <skill.md> --fail NSe isso quebrasse, a skill notaria e se curaria?
Driftreelier run <skill.md> --wrap "<your mcp server>"O mundo mudou sob esta skill?

Taxonomia devida à revisão de Mads Hansen do post de lançamento. Semântica completa para cada teste, incluindo injeção de recuperação e guardrails de manifesto: docs/REFERENCE.md.

Gate em PRs de bump do Dependabot / Renovate

Dependabot e Renovate abrem o PR e executam sua suíte de testes — mas nenhum sabe o que seu agente realmente faz em tempo de execução, então um bump de dependência que muda silenciosamente a forma de uma chamada de ferramenta (um campo renomeado, um novo padrão, um erro diferente) passa com testes unitários verdes. Este é o check que eles não executam.

Copie .github/workflows/reelier-bump-check.yml para seu repositório, aponte skill: para seus próprios arquivos .skill.md gravados, e ele irá: fazer gate para PRs de dependabot[bot]/renovate[bot] (ou um label dependencies), instalar a dependência com bump, reproduzir sua skill gravada ao vivo contra ela em --max-level 0 (0 tokens) e falhar o check na etapa exata que sofreu drift.

Isso testa dependências e comportamento de chamadas de ferramentas MCP — não testa upgrades de modelo; --max-level 0 nunca chama um LLM. Listagem completa e configuração: docs/marketplace-listing.md.

Prove

Um recibo enviado carrega uma escada de afirmações verificáveis de forma independente — não uma única "verificado" genérica. Dependendo do que você ativar, ele pode ser assinado, carimbado com timestamp, atestado por CI e carregar IDs de requisição do provedor verificáveis de forma cruzada. reelier verify recalcula cada afirmação offline, e uma afirmação que você não habilitou apenas aparece como uma lacuna honesta, nunca uma vergonha.

Veja um real: reelier.com/r/HWBdmGob9KeHRqXi-OEaRD0z.

Escada completa de 8 degraus, o que cada degrau comprova e não comprova: docs/REFERENCE.md.

Se suas skills são funcionários

Ciclo de vida do funcionárioEquivalente no Reelier
Transformar uma sessão em skillreelier from-session
Avaliação de desempenhoreelier run + reelier diff
Manutenção da frotareproduções agendadas + alertas de drift
O registrorecibos assinados

"Verificado" descreve o registro, nunca o agente — um recibo comprova o que foi executado e o que mudou, não que o agente era bom no seu trabalho.

Um contrato de trabalho não torna um funcionário bom — torna o que ele fez visível e limitado. O mesmo aqui: recibos comprovam escopo e mudança, nunca correção.

Para quem é

  • Dev solo / mantenedor de OSS — um teste de regressão real de novo; drift não pode passar silenciosamente.
  • Time enviando mudanças de agentes — "rodou limpo" vira um artefato de PR verificável, não uma afirmação.
  • Agência rodando agentes para clientes — prova de entrega assinada e com timestamp que o cliente pode verificar.
  • Comprador ou vendedor de marketplace — recibos corroborados são avaliações que não podem ser astroturfadas.
  • Ops voltado a auditoria — um rastro assinado e atestado por CI de cada escrita, incluindo chave de idempotência.

MIT, gratuito para sempre (versões ≤0.16.0 permanecem AGPL-3.0). Seus dados — skills, traces, execuções — são especificados em SPEC.md, então sair é copiar uma pasta.

Contribuindo: issues e PRs são bem-vindos — SPEC.md é a fonte da verdade para formatos; corrija o código, não a spec. npm test antes de um PR.

Se o Reelier te salvou de uma reexecução, dê uma estrela ⭐ — é assim que outros builders o encontram.