Reelier

offiziell

Agenten stellen Behauptungen auf. Reelier schreibt Quittungen – zeichne den Tool-Call-Workflow eines Agenten einmal auf, spiele ihn deterministisch mit 0 Tokens ab und vergleiche Durchläufe, um Abweichungen zu erkennen.

Was kann man mit Reelier MCP machen?

  • Aufgezeichnete Fähigkeiten deterministisch erneut abspielen — Bitte reelier run eine gespeicherte .skill.md mit 0 Tokens ausführen, standardmäßig schreibgeschützt, für byteidentische Wiederholung.
  • Drift in Agentenläufen erkennen — Verwenden Sie reelier diff, um eine Wiederholung mit dem Original zu vergleichen und pro Schritt SAME oder DRIFTED zu kennzeichnen; beenden mit Exit-Code 1 bei jeder Änderung.
  • Abhängigkeits-Upgrade-PRs absichern — Lassen Sie den Assistenten einen CI-Workflow einrichten, der Ihre Fähigkeit gegen Dependabot/Renovate-PRs abspielt und beim exakt abweichenden Schritt fehlschlägt.
  • Bestehende Traces in Fähigkeiten umwandeln — Kompilieren Sie eine trace.jsonl oder eine vorhandene SKILL.md über reelier compile in eine abspielbare Fähigkeit, mit ehrlich aufgeführten Lücken als offene Fragen.
  • Signierte Belege offline verifizieren — Führen Sie reelier verify aus, um jede Behauptung in der Leiter eines gepushten Belegs neu zu berechnen und anzuzeigen, welche Stufen bewiesen sind und welche ehrliche Lücken darstellen.
  • Agentenabdeckung vor der Aufzeichnung prüfen — Verwenden Sie reelier init --dry-run, um die Beobachtungsabdeckung von Pfad A/B/C und Wiedergabekandidaten zu prüfen, ohne etwas zu schreiben oder zu ändern.

Dokumentation

Reelier

Reelier

Lass deine Agenten schreiben. Behalte die Belege.

Deine Agenten haben die ganze Nacht gearbeitet. Hier ist genau, was sich geändert hat.

Reelier zeichnet den Lauf auf, der funktioniert hat, friert ihn als wiederverwendbare Fähigkeit ein und spielt ihn deterministisch ab – jeder Lauf kommt als Beleg zurück: ein Beweis dafür, was der Agent getan hat und was sich dadurch geändert hat. Agenten machen Behauptungen. Reelier schreibt Belege.

npm version CI tests license Discord stars

Website · Dokumentation · SPEC.md

Reelier: Dependabot bumps a dependency, Reelier replays your recorded agent run at 0 tokens and diffs it, catching the drift on the PR before you merge

▶ mit Ton ansehen (27s)

Reelier MCP server on Glama


Belege auf deinen Agent-PRs – installieren und fertig

Agent-verfasste PRs (Dependabot, Claude, Codex, Cursor, …) erhalten in Sekunden einen Beleg-Kommentar: Autor, geänderte Dateien, erklärter Umfang vs. tatsächliche Änderungen, sensible Pfade markiert. Keine Workflow-Datei, kein CLI, keine Konfiguration.

→ Installiere die Reelier-Belege-GitHub-App – kostenlos auf öffentlichen Repos, für immer.

Reelier-Beleg – Agent-PR Autor: dependabot[bot] · Geänderte Dateien: 2 (+119 −41) Erklärter Umfang: keiner (füge .reelier/scope.yml hinzu, um die Erkennung unerwarteter Schreibvorgänge zu aktivieren) Berührte sensible Pfade: ⚠ 1 – package-lock.json Beweist Umfang und Änderung, nicht Korrektheit

Ein echter Beleg aus Reeliers eigenen Repos – sieh dir einen live an. Erkläre den Umfang pro Agent in .reelier/scope.yml (oder einem reelier-scope-Block im PR-Text) und der Beleg meldet unerwartete Schreibvorgänge. Der Beleg beweist Umfang und Änderung, niemals Korrektheit oder Sicherheit.


Warum

KI-Agenten sind nicht deterministisch – derselbe Prompt, ein anderes Ergebnis bei jedem Lauf – und sie behaupten, die Arbeit erledigt zu haben, ob sie es taten oder nicht. Reelier zeichnet den Lauf auf, der funktioniert hat, spielt ihn deterministisch ab und schreibt einen signierten Beleg, der es beweist. Richte es in einem Workflow auf dein bestehendes CI aus – es fügt einen verifizierbaren Beleg hinzu, es ersetzt nicht deinen Stack.

Gemessen an einem echten direkten Benchmark, gleiche Aufgabe, gleiche Daten (vollständige Methode):

  • 1.000 / 1.000 Wiedergaben byte-identisch
  • Jede Wiedergabe liefert einen signierten Beleg – Beweis dafür, was lief und was sich änderte, niemals eine Behauptung
  • 0 LLM-Aufrufe bei der Wiedergabe – deterministische Neuausführung, kein erneutes Denken

Deterministische Wiedergabe ist außerdem ~50× günstiger und ~59× schneller als den Agenten erneut laufen zu lassen, im selben Benchmark.

Installation

npm i -g reelier && reelier init
# No Node install needed — same commands via Docker:
docker run --rm ghcr.io/seldonframe/reelier --help

reelier init [--dry-run] führt eine einmalige, checkpoint-basierte lokale Inspektion über alle drei Reelier-Pfade durch: Pfad A Beobachtungsabdeckung, Pfad B Wiedergabe-/Einfrier-Kandidaten und Pfad C begrenzbare/ergebnis-fähige/nur-Schatten/unterstützte Verbindungen und Kandidaten. Es stellt nichts bereit, gate-t nichts, versendet nichts, lädt nichts hoch, kopiert keine Anmeldedaten und schreibt keine Host-Konfiguration um. --dry-run schreibt nichts; der normale Befehl schreibt nur bereinigte Artefakte unterhalb von .reelier/init/.

Als Agent-Plugin

Bringe deinem Codier-Agenten bei, wann er zu Reelier greifen soll. Dieselben zwei Befehle, auf beiden Hosts:

claude plugin marketplace add seldonframe/reelier
claude plugin install reelier@seldonframe
codex plugin marketplace add seldonframe/reelier
codex plugin add reelier@seldonframe

Dies installiert zwei Agent-Fähigkeiten und sonst nichts. reelier-replay bringt deinem Agenten bei, einen wiederholbaren Tool-Aufruf-Job einzufrieren und mit 0 Tokens abzuspielen. reelier-write-safety behandelt die Begrenzung der Schreibvorgänge eines Agenten, bevor du sie gewährst: was der Rekorder sieht, was eine Richtlinie verweigert und was ein Beleg beweist und was nicht. Es liefert keine MCP-Server, also umhüllt, beobachtet oder gate-t es keinen Tool-Aufruf von sich aus; das reelier-CLI macht das, und die Fähigkeiten steuern es über npx. Verpackt sowohl im Agent-Plugins-Format v1.0.0 (plugin/agent-plugins/) als auch im Claude-Code-Format (plugin/claude/), generiert aus einer Quelle von scripts/build-plugin-packages.mjs.

Ende-zu-Ende verifiziert auf codex-cli 0.147.0-alpha.1.2: beide Formate installieren, aktivieren und die Fähigkeit erreicht das Modell. Andere Hosts sind ungetestet, und der Status pro Host wird in docs/specs/agent-plugins-coverage-v1.md §4 verfolgt, nicht hier behauptet.

So verwendest du es

reelier init --dry-run              # inspect Path A/B/C locally; write nothing
reelier init                        # persist resumable sanitized inspection artifacts
reelier run  <name>.skill.md        # replay deterministically — 0 tokens (read-only by default)
reelier diff <name>                 # SAME or DRIFTED, per step — exit 1 on drift
reelier push <name>.skill.md        # sync receipts to your ledger (opt-in)
reelier ci                          # write a workflow: drift-CI + PR receipts, one command
  1. Inspizieren, dann aufzeichnen oder einfrieren. reelier init zeigt beobachtete Abdeckung und lokale Kandidaten, ohne Routen zu ändern. reelier mcp --wrap "<mcp server>" proxyt Live-Tools; reelier scan/from-session friert unterstützte Verläufe ein.
  2. Kompilieren. reelier compile verwandelt eine Spur in eine SKILL.md – 0 LLM-Aufrufe, minimale Assertions, ehrliche Lücken als Offene Fragen gedruckt.
  3. Wiedergeben. reelier run spielt es auf Stufe 0 ab – kein LLM, byte-identisch, standardmäßig schreibgeschützt (Schreibvorgänge benötigen --allow-writes).
  4. Unterscheiden. reelier diff meldet SAME oder DRIFTED pro Schritt, mit der fehlgeschlagenen Assertion als Warum – Exit 1 bei Drift.
  5. Anmelden. reelier login verbindet diese Maschine mit Reelier Cloud mit einem Gerätecode in deinem Browser – oder setze REELIER_CLOUD_URL/REELIER_CLOUD_KEY für CI und Self-Hosting.
  6. Pushen. Jeder Lauf ist ein Beleg; reelier push synchronisiert ihn optional in ein Ledger für einen Permalink und ein einbettbares verifiziertes Wiedergabe-Abzeichen.

Hast du bereits eine Agent-Fähigkeit? Konvertiere sie – deine Fähigkeit, minus das Modell:

reelier compile trace.jsonl --from-skill ./my-skill/SKILL.md

Drei Tests, eine Fähigkeit

TestBefehlAntworten
Determinismusreelier run <skill.md>Macht das immer noch, was es tat?
Wiederherstellungreelier run <skill.md> --fail NWenn das kaputtginge, würde die Fähigkeit es bemerken und heilen?
Driftreelier run <skill.md> --wrap "<your mcp server>"Hat sich die Welt unter dieser Fähigkeit wegbewegt?

Taxonomie dank Mads Hansens Überprüfung des Startbeitrags. Vollständige Semantik für jeden Test, einschließlich Wiederherstellungs-Injektion und Manifest-Schutzmaßnahmen: docs/REFERENCE.md.

Gate für Dependabot / Renovate-Bump-PRs

Dependabot und Renovate öffnen den PR und führen deine Testsuite aus – aber keiner weiß, was dein Agent zur Laufzeit tatsächlich tut, also kommt ein Abhängigkeits-Bump, der stillschweigend die Form eines Tool-Aufrufs ändert (ein umbenanntes Feld, ein neuer Standard, ein anderer Fehler), mit grünen Unit-Tests durch. Das ist der Check, den sie nicht ausführen.

Kopiere .github/workflows/reelier-bump-check.yml in dein Repo, richte skill: auf deine eigenen aufgezeichneten .skill.md-Datei(en) aus, und es wird: auf PRs von dependabot[bot]/renovate[bot] (oder einem dependencies-Label) begrenzen, die aktualisierte Abhängigkeit installieren, deine aufgezeichnete Fähigkeit live dagegen bei --max-level 0 (0 Tokens) abspielen und den Check auf dem genauen Schritt fehlschlagen lassen, der abwich.

Dies testet Abhängigkeits- und MCP-Tool-Aufruf-Verhalten – es testet nicht Modell-Upgrades; --max-level 0 ruft nie ein LLM auf. Vollständige Listing-Kopie und Einrichtung: docs/marketplace-listing.md.

Beweise es

Ein gepusher Beleg trägt eine Leiter unabhängig verifizierbarer Behauptungen – nicht eine pauschale „verifiziert“. Je nachdem, was du aktivierst, kann er signiert, zeitgestempelt, CI-bescheinigt sein und überprüfbare Provider-Request-IDs tragen. reelier verify berechnet jede Behauptung offline neu, und eine Behauptung, die du nicht aktiviert hast, erscheint einfach als ehrliche Lücke, niemals als beschämte.

Sieh dir einen echten an: reelier.com/r/HWBdmGob9KeHRqXi-OEaRD0z.

Vollständige 8-stufige Leiter, was jede Stufe beweist und was nicht: docs/REFERENCE.md.

Wenn deine Fähigkeiten Angestellte sind

Mitarbeiter-LebenszyklusReelier-Entsprechung
Sitzung zur Fähigkeit machenreelier from-session
Leistungsbeurteilungreelier run + reelier diff
Flottenwartunggeplante Wiedergaben + Drift-Warnungen
Die Aufzeichnungsignierte Belege

„Verifiziert“ beschreibt die Aufzeichnung, niemals den Agenten – ein Beleg beweist, was lief und was sich änderte, nicht dass der Agent gut in seiner Arbeit war.

Ein Arbeitsvertrag macht einen Angestellten nicht gut – er macht sichtbar und begrenzt, was er tat. Genauso hier: Belege beweisen Umfang und Änderung, niemals Korrektheit.

Für wen es ist

  • Solo-Entwickler / OSS-Maintainer – wieder ein echter Regressionstest; Drift kann nicht stillschweigend durchgehen.
  • Team, das Agent-Änderungen ausliefert – „es lief sauber“ wird ein prüfbares PR-Artefakt, keine Behauptung.
  • Agentur, die Agenten für Kunden betreibt – signierter, zeitgestempelter Liefernachweis, den ein Kunde verifizieren kann.
  • Marktplatz-Käufer oder -Verkäufer – bestätigte Belege sind Bewertungen, die nicht astroturfed werden können.
  • Prüfungsorientierter Betrieb – eine signierte, CI-bescheinigte Spur jedes Schreibvorgangs, einschließlich Idempotenz-Schlüssel.

MIT, für immer kostenlos (Versionen ≤0.16.0 bleiben AGPL-3.0). Deine Daten – Fähigkeiten, Spuren, Läufe – sind in SPEC.md spezifiziert, also ist das Verlassen das Kopieren eines Ordners.

Mitwirken: Issues und PRs willkommen – SPEC.md ist die Quelle der Wahrheit für Formate; repariere den Code, nicht die Spezifikation. npm test vor einem PR.

Wenn Reelier dir einen erneuten Lauf erspart hat, star es ⭐ – so finden es andere Entwickler.