eval-writer

作成者: langchain-ai

deepagentsjsモノレポ用の新しい評価スイートを作成します。データセット設計、テストケースのスキャフォールディング、スコアリングロジック、vitest設定、LangSmith…を処理します。

npx skills add https://github.com/langchain-ai/deepagentsjs --skill eval-writer

langchain-aiのその他のスキル

deepagents-thread-inspector
langchain-ai
ローカルのDeep Agents Code SQLiteセッションストア内の会話を検査・説明します。LangSmithトレースツールが利用できない場合のフォールバックとして使用し、…
deepagents-python-quickstart
langchain-ai
公式クイックスタートに従って、Pythonで最小限のローカルDeep Agentをスキャフォールドし、Tavilyの代わりにプロバイダー標準のウェブ検索を使用します。ユーザーが…を望む場合に使用します。
deepagents-typescript-quickstart
langchain-ai
公式クイックスタートに従って、Tavilyの代わりにプロバイダー標準のウェブ検索を使用しながら、TypeScriptで最小限のローカルDeep Agentをスキャフォールドする。ユーザーが…の場合に使用する。
eval-engineering
langchain-ai
エージェントリポジトリと、ユーザーが提供した任意のトレースを反復的に調査し、ユーザーにインタビューし、Harborの評価を一度に1つ作成・実行・監査します。~に使用します…
LangChain RAG Pipeline
langchain-ai
このスキルは、あらゆる検索拡張生成(RAG)システムを構築する際に呼び出してください。ドキュメントローダー、RecursiveCharacterTextSplitter、埋め込み(OpenAI)などをカバーします。
LangChain Structured Output & HITL
langchain-ai
langchain-structured-output-&-hitl — AIエージェント用のインストール可能なスキルで、langchain-ai/langchain-skillsから公開されています。
LangSmith Datasets
langchain-ai
このスキルは、トレースから評価データセットを作成する場合、データセットをLangSmithにアップロードする場合、またはデータセットをクエリする場合に呼び出します。データセットの種類(final_response、…)をカバーします。
langsmith-evaluator
langchain-ai
LangSmithの評価パイプラインを構築する際にこのスキルを呼び出してください。以下の3つのコアコンポーネントをカバーします:(1) 評価器の作成 - LLM-as-Judge、カスタムコード;(2)…