langsmith

Rastrea, evalúa y despliega agentes de IA y aplicaciones LLM con LangSmith. Úsalo al agregar observabilidad, ejecutar evaluaciones, diseñar prompts o…

npx skills add https://github.com/langchain-ai/docs --skill langsmith

LangSmith

LangSmith is a framework-agnostic platform for building, debugging, and deploying AI agents and LLM applications. Trace requests, evaluate outputs, test prompts, and manage deployments all in one place at smith.langchain.com.

When to use

Use LangSmith when you need to:

  • Trace and debug LLM calls, agent steps, retrieval, and tool use
  • Evaluate LLM outputs with automated or human-in-the-loop scoring
  • Engineer prompts with a visual playground and version control
  • Deploy agents to production with the LangGraph-based agent server
  • Monitor production systems with dashboards, alerts, and cost tracking

When NOT to use

  • To build agent logic or LLM pipelines, use LangChain, LangGraph, or Deep Agents instead
  • LangSmith is the platform layer that complements these frameworks

Quick setup

Set two environment variables to enable tracing from any supported framework:

export LANGSMITH_TRACING=true
export LANGSMITH_API_KEY="your-api-key"  # from smith.langchain.com/settings

Install the SDK

# Python
pip install langsmith

# JavaScript/TypeScript
npm install langsmith

Verify tracing

from langsmith import traceable

@traceable
def my_function(query: str) -> str:
    # Your LLM logic here—all calls inside are traced automatically
    return "result"

Core capabilities

CapabilityDescription
ObservabilityTrace every step of your LLM app with automatic or manual instrumentation
EvaluationRun evaluations with code, LLM-as-judge, or composite evaluators
Prompt engineeringCreate, version, and test prompts in a visual playground
Agent deploymentDeploy LangGraph agents with streaming, human-in-the-loop, and durable execution
MonitoringDashboards, alerts, and cost tracking for production workloads

Key documentation

API reference

For SDK class and method details, use the LangChain API Reference site:

  • Browse: https://reference.langchain.com/python/langsmith
  • MCP server: https://reference.langchain.com/mcp

Related skills

  • langchain—Build agents with prebuilt architecture and model integrations
  • langgraph—Orchestrate stateful, durable agent workflows
  • deep-agents—Batteries-included agent harness with planning and subagents

Más skills de langchain-ai

langgraph-docs
langchain-ai
Accede a la documentación de LangGraph para construir agentes con estado y flujos de trabajo multiagente. Obtiene la documentación oficial de LangGraph en Python que cubre máquinas de estado, diseño de agentes basado en grafos y patrones de intervención humana. Prioriza la documentación relevante según el tipo de consulta: guías de implementación para preguntas de procedimiento, páginas conceptuales para teoría, tutoriales para ejemplos completos y referencias de API para detalles técnicos. Selecciona automáticamente de 2 a 4 URL de documentación más relevantes y recupera su contenido para responder...
official
langgraph-human-in-the-loop
langchain-ai
Pausar la ejecución del grafo para revisión, aprobación o validación humana, luego reanudar con su entrada. Requiere tres componentes: un checkpointer (InMemorySaver o PostgresSaver), un ID de hilo en la configuración y cargas de interrupción serializables en JSON. interrupt(value) pausa y expone datos; Command(resume=value) reanuda y devuelve ese valor al nodo pausado. Todo el código antes de interrupt() se re-ejecuta al reanudar, por lo que los efectos secundarios deben ser idempotentes (usar upsert, no insert). Soporta flujos de aprobación,...
official
web-research
langchain-ai
Usa esta habilidad para solicitudes relacionadas con investigación web; proporciona un enfoque estructurado para realizar investigaciones web exhaustivas.
official
langchain-oss-primer
langchain-ai
SIEMPRE EMPIEZA AQUÍ para cualquier proyecto de construcción de agentes LangChain, Deep Agents o LangGraph. Punto de partida requerido antes de elegir otras habilidades o escribir cualquier…
official
skill-creator
langchain-ai
Guía para crear habilidades efectivas que extiendan las capacidades del agente con conocimientos especializados, flujos de trabajo o integraciones de herramientas. Usa esta habilidad cuando el usuario…
official
social-media
langchain-ai
Redacta publicaciones para redes sociales específicas de cada plataforma, con contenido respaldado por investigación e imágenes complementarias generadas. Admite publicaciones de LinkedIn (1.300 caracteres con tono profesional) e hilos de Twitter/X (280 caracteres por tuit con formato 1/🧵). Requiere delegar la investigación a un subagente antes de redactar, y luego leer los hallazgos para garantizar precisión y relevancia. Genera automáticamente imágenes llamativas para redes sociales usando la herramienta generate_social_image con composiciones audaces y de alto contraste optimizadas para tamaños pequeños...
official
deep-agents-memory
langchain-ai
Backends de memoria y archivos conectables para Deep Agents con opciones de enrutamiento efímero, persistente e híbrido. Cuatro tipos de backend: StateBackend (efímero, con ámbito de hilo), StoreBackend (persistente entre sesiones), FilesystemBackend (acceso real a disco para desarrollo local) y CompositeBackend (enruta diferentes rutas a diferentes backends). FilesystemMiddleware proporciona seis herramientas de operación de archivos: ls, read_file, write_file, edit_file, glob, grep. CompositeBackend utiliza coincidencia de prefijo más largo para enrutar...
official
deep-agents-orchestration
langchain-ai
Orquestrar subagentes, planificar tareas de múltiples pasos y requerir aprobación humana para operaciones sensibles. Delegar trabajo a subagentes especializados mediante la herramienta de tareas; los subagentes personalizados admiten conjuntos de herramientas aislados y mensajes del sistema, mientras que el subagente "de propósito general" predeterminado hereda la configuración del agente principal. Planificar y rastrear flujos de trabajo complejos con write_todos, organizando tareas en estados pendientes, en curso y completados; requiere un thread_id para la persistencia entre invocaciones. Implementar...
official