Noveum

Inspecciona los rastros de agentes de IA, crea conjuntos de datos de evaluación, ejecuta evaluaciones y prueba agentes de voz desde tu cliente MCP.

Servidor MCP alojado

npx add-mcp 'https://noveum.ai/api/mcp'

Se instala en Claude Code, Codex, Cursor y más

Documentación

Dirige Noveum desde cualquier agente de IA.

Claude, Cursor, VS Code, ChatGPT: un solo endpoint MCP los conecta a todos con la plataforma Noveum completa. Tu agente busca trazas, ejecuta evaluaciones, lanza simulaciones y envía correcciones, en lenguaje natural.

noveum-mcp

HTTP · OAuth 2.1

Endpoint MCP

Herramientas~60

tracesdatasetsevals

Recursos16

noveum://projectsnoveum://scorers

Prompts20

/debug_traces/run_evaluation

Un endpoint · todas las capacidades de Noveum

Dos minutos para conectarte.

Añade un endpoint al cliente que ya usas. Pega una clave API para configuraciones headless: o añade solo la URL e inicia sesión con OAuth.

# OAuth sign-in (URL-only)claude mcp add --transport http noveum "https://noveum.ai/api/mcp"# Or pin a Bearer API key (headless)claude mcp add --transport http noveum "https://noveum.ai/api/mcp" \  --header "Authorization: Bearer NOVEUM_API_KEY"

Todo lo que la app puede hacer, tu agente puede hacerlo.

Las herramientas se generan desde la especificación OpenAPI en vivo, los recursos alimentan a tu agente con ids y slugs reales antes de que planifique, y los prompts empaquetan flujos de trabajo completos en un solo comando de barra.

Herramientas

~60 acciones HTTP generadas desde la especificación OpenAPI en vivo: lista cosas, inicia trabajos, consulta el progreso hasta el estado final.

Trazas

Busca spans, errores y latencia en cada despliegue.

Datasets

Crea, versiona y publica datasets de evaluación a partir de tráfico real.

Evaluaciones

Lanza trabajos de evaluación, consulta ejecuciones y lee resultados puntuados.

Pipelines ETL

Construye pipelines de extracción y genera mappers con NovaEval.

Scorers

Explora más de 100 scorers integrados u obtén recomendaciones por dataset.

Proyectos

Lista proyectos, entornos, uso y estado de la organización.

NovaPilot

Inicia análisis, lee informes y gestiona programaciones recurrentes.

NovaSynth

Genera personas, lanza simulaciones y extrae analíticas.

Recursos

Contexto de solo lectura servido como JSON: para que cada id, slug y enum de filtro provenga de datos reales, no de suposiciones.

  • noveum://projects
  • noveum://scorers
  • noveum://filter-values
  • noveum://org-status
  • noveum://datasets
  • noveum://eval-jobs
  • noveum://etl-jobs
  • noveum://novapilot-schedules
  • noveum://novasynth-runs
  • noveum://agent-versions
  • +6 más

Prompts

Flujos de trabajo con comando de barra que indican qué herramientas encadenar, qué consultar y cuándo detenerse.

  • /debug_traces
  • /run_evaluation
  • /analyze_with_novapilot
  • /optimize_costs
  • /trace_error_triage
  • /compare_eval_runs
  • /recommend_scorers_for_dataset
  • /full_agent_improvement_cycle
  • /test_voice_agent
  • /download_novapilot_report_markdown
  • +10 más

Flujos de trabajo reales, en lenguaje natural.

Sin paneles, sin lenguaje de consulta. Apunta tu agente a Noveum y describe el resultado que quieres: estas son cosas que los equipos hacen a diario.

Encuentra y clasifica fallos

/debug_traces

Deja que tu agente te muestre qué se está rompiendo en producción y por qué, directamente desde tus trazas en vivo.

Encuentra las trazas de error de las últimas 24 horas, agrúpalas por causa raíz y muéstrame los tres peores casos con spans de ejemplo.

Convierte trazas en una evaluación

/run_evaluation

Construye un dataset a partir de tráfico real y puntúa candidatos de modelos lado a lado con los jueces calibrados de Noveum.

Crea un dataset a partir de las trazas con fallos de ayer, luego ejecuta una evaluación comparando gpt-4.1 y gemini-3-flash y dime cuál gana en precisión y costo.

Reduce el gasto de modelos

/optimize_costs

Haz que tu agente lea una semana de uso y recomiende una configuración más económica que mantenga la calidad.

Analiza mi uso de tokens y latencia esta semana, luego recomienda una configuración de modelo más económica que mantenga la calidad por encima del 90%.

Cierra el ciclo de principio a fin

/full_agent_improvement_cycle

Ejecuta todo el bucle de traza a dataset a evaluación a corrección con NovaPilot a redespliegue desde un solo prompt.

Ejecuta el ciclo completo de mejora de agente en mi asistente de checkout: trázalo, construye un dataset, evalúa, haz que NovaPilot redacte una corrección y resume el pull request.

Las herramientas están aquí. El manual es una skill.

Un solo copiar y pegar configura tu agente con el manual completo de Noveum: dentro de tu entorno. Tu código nunca sale de tus máquinas.

  1. Integra el SDK noveum-trace

    LangChain · CrewAI · LiveKit · Pipecat
  2. Verifica la completitud de las trazas

    boletín de calificaciones, no "trazas > 0"
  3. Construye un dataset a partir de tráfico real

    mappers generados por IA
  4. Ejecuta evaluaciones

    más de 100 scorers calibrados
  5. Diagnostica con NovaPilot

    causas raíz + radio de impacto
  6. Haz backtest de correcciones como experimentos

    validado, no por corazonadas
  7. Envía la corrección como PR

    luego verifica en producción

Con puerta de aceptación: el agente no puede dar un paso por completado hasta que la plataforma lo confirme.

Copia este prompt en tu agenteCódigo abierto

O conéctate solo con la URL

Los clientes interactivos inician sesión con OAuth: sin necesidad de pegar claves.

Preguntas sobre MCP, respondidas.

¿Qué es el servidor MCP de Noveum?

Es un servidor remoto del Protocolo de Contexto de Modelo en noveum.ai/api/mcp. Conectarlo le da a cualquier cliente de IA compatible con MCP: Claude, Cursor, VS Code, ChatGPT y más: acceso seguro a nivel de herramientas a tu espacio de trabajo de Noveum: trazas, datasets, evaluaciones, scorers y flujos de mejora de agentes, todo impulsado en lenguaje natural.

¿Qué clientes de IA pueden conectarse?

Cualquier cliente que hable el transporte HTTP Streamable de MCP: Claude y Claude Code, Cursor, VS Code, ChatGPT (modo desarrollador), Windsurf, Cline, Replit, Zed, Goose y otros. Los clientes solo-URL inician sesión con OAuth; los clientes headless o con scripts como cURL, Python y CI usan una clave API Bearer.

¿Necesito una clave API o usa OAuth?

Ambos funcionan en el mismo endpoint. Los clientes interactivos descubren OAuth 2.1 automáticamente: añades la URL, apruebas una pantalla de consentimiento una vez y estás conectado sin necesidad de pegar claves. Las configuraciones headless envían un encabezado Authorization: Bearer con una clave API de Noveum en su lugar.

¿Qué puede hacer realmente un agente a través de él?

Alrededor de 60 herramientas generadas desde la API en vivo de Noveum: buscar y leer trazas, crear datasets, ejecutar evaluaciones, gestionar scorers y lanzar trabajos de ETL, NovaPilot y NovaSynth: además de 16 recursos de solo lectura y 20 prompts de flujos guiados. Cada acción respeta los roles y permisos de tu organización.

¿Es seguro? ¿Cómo funcionan los permisos y la revocación?

Los tokens OAuth están vinculados a una sola organización que eliges al dar consentimiento y a alcances generales de lectura / escritura / ejecución que solo limitan lo que una app conectada puede hacer: tus permisos RBAC siguen aplicándose encima. Revoca cualquier app conectada cuando quieras desde Configuración, Apps conectadas, y rota las claves API desde la configuración de tu organización.

¿Conectarlo tiene algún costo adicional?

No: el servidor MCP está incluido con Noveum y no hay cargo separado por conectarse. El uso de la plataforma subyacente (trazas, evaluaciones y trabajos) sigue tu plan normal de Noveum.