llm-obs-experiment-py-bootstrap

作者: datadog-labs

生成一個自包含的Python實驗客戶端,使用ddtrace.llmobs SDK。輸出可執行的.py腳本或Jupyter .ipynb筆記本,匹配…

npx skills add https://github.com/datadog-labs/agent-skills --skill llm-obs-experiment-py-bootstrap

來自 datadog-labs 的更多技能

dd-audit
datadog-labs
稽核軌跡調查——誰變更了什麼、金鑰遭入侵、成本飆升的根本原因、合規證據(SOC 2/PCI),以及AI活動稽核。
official
agent-install
datadog-labs
Install the Datadog Agent on Kubernetes using the Datadog Operator — required before enabling Single Step Instrumentation (SSI), which automatically…
official
agent-observability-auto-experiment
datadog-labs
針對真實的 Datadog LLM-Obs 資料執行迭代式程式碼改進爬山演算法,以 Claude Code 作為代理程式在本機端運行。建立基準評估,逐步進行…
official
agent-observability-eval-bootstrap
datadog-labs
從生產環境追蹤資料引導建立評估器 — 預設提議線上 LLM-judge 評估器,並在您確認後,在 Datadog 中建立為停用的草稿…
official
agent-observability-eval-pipeline
datadog-labs
為已儀器化的 ml_app 設計的端到端 Agent Observability 管線 — 分類生產追蹤、根因分析故障、啟動評估器,然後(可選地)…
official
agent-observability-experiment-analyzer
datadog-labs
分析LLM實驗結果。處理單一或對比實驗,探索性或問答模式。當使用者說「分析實驗」、「比較…」時使用。
official
agent-observability-replay-trace
datadog-labs
當開發者想要針對某一個特定的 Agent Observability / LLM Obs trace(其輸出結果不盡理想)進行迭代時使用——將該 trace 重新對其……
official
agent-observability-trace-rca
datadog-labs
Root cause analysis on production LLM traces. Diagnoses why an LLM application is failing — works from eval judge verdicts, runtime errors, or structural…
official