llm-obs-eval-bootstrap
bởi datadog-labs
Khởi tạo các bộ đánh giá từ dấu vết sản xuất — theo mặc định đề xuất các bộ đánh giá LLM-judge trực tuyến và, sau khi bạn xác nhận, tạo chúng trong Datadog dưới dạng bản nháp bị vô hiệu hóa…
npx skills add https://github.com/datadog-labs/agent-skills --skill llm-obs-eval-bootstrap