vibops-mcp

Plano de control de infraestructura GPU + FinOps de LLM por agente. 74 herramientas. Desplegar, escalar, rastrear costo por agente, aplicar presupuestos. Licencia MIT.

Documentación

vibops-mcp

License: MIT Python 3.11+ MCP Tools Tests

El servidor MCP para VibOps — El Motor de Infraestructura de IA. Del código a GPU en una sola conversación.

El problema

Llevar una aplicación de IA del código a producción en GPUs requiere unir 9+ herramientas — git, Docker, CI/CD, Helm, kubectl, monitoreo de GPU, gestión de costos, cumplimiento, alertas. Cada una con su propia API, panel y modelo de costos. Ninguna interfaz única abarca todo el pipeline.

La solución

vibops-mcp conecta tu asistente de IA a VibOps — el motor que clona, construye, despliega, escala, monitorea, corrige y factura tus aplicaciones y agentes en cualquier GPU, cualquier clúster, cualquier nube. Un pip install, 117 herramientas, una sola conversación.

  • Despliega — clona repositorios, construye contenedores, despliega modelos, ejecuta Helm/kubectl, dispara pipelines, envía trabajos Slurm
  • Opera — escala despliegues, gestiona VMs (Proxmox/XO/vSphere/HPE VME), detecta y corrige anomalías de GPU
  • Observa — utilización de GPU, desglose de cargas de trabajo, MTTR, estimaciones de costos, despliegues K8s en vivo
  • Gobierna — cumplimiento de la Ley de IA, informes SOC 2/RGPD, cadena de auditoría inmutable, gestión de políticas
  • FinOps — seguimiento de costos por agente, aplicación de presupuestos, chargeback, tendencias de gasto, análisis de desperdicio

Cada operación pasa por tu instancia de VibOps y se registra en el registro de auditoría inmutable.

Instalación

pip install git+https://github.com/VibOpsai/vibops-mcp.git

Configuración

Necesitas dos variables de entorno:

VariableDescripción
VIBOPS_URLURL base de tu instancia de VibOps, p. ej. https://vibops.example.com
VIBOPS_TOKENToken de API — crea uno en VibOps → Configuración → Tokens de API

Claude Desktop

Añade a ~/.config/claude/claude_desktop_config.json (macOS: ~/Library/Application Support/Claude/claude_desktop_config.json):

{
  "mcpServers": {
    "vibops": {
      "command": "vibops-mcp",
      "env": {
        "VIBOPS_URL": "https://vibops.example.com",
        "VIBOPS_TOKEN": "your-token-here"
      }
    }
  }
}

Cursor

Añade a .cursor/mcp.json en la raíz de tu proyecto, o a la configuración global:

{
  "mcpServers": {
    "vibops": {
      "command": "vibops-mcp",
      "env": {
        "VIBOPS_URL": "https://vibops.example.com",
        "VIBOPS_TOKEN": "your-token-here"
      }
    }
  }
}

Claude Code (CLI)

claude mcp add vibops vibops-mcp \
  -e VIBOPS_URL=https://vibops.example.com \
  -e VIBOPS_TOKEN=your-token-here

Herramientas disponibles

Observación (16 herramientas — solo lectura)

HerramientaDescripción
list_clustersLista clústeres y utilización de GPU
list_kubectl_contextsLista contextos kubectl disponibles
get_cluster_deploymentsEstado de despliegues K8s en vivo para un clúster
get_cluster_rateObtiene la tarifa de costo de GPU configurada para un clúster
list_jobsLista trabajos recientes con filtros opcionales
get_jobObtiene detalles y resultado de un trabajo
get_job_metricsTasa de éxito de trabajos, latencia P50/P95/P99, desglose de errores
get_gpu_metricsSerie temporal horaria de utilización de GPU
get_workload_breakdownConteo de trabajos por tipo de carga de trabajo
get_mttrTiempo medio de resolución de alertas de GPU
get_cost_estimateGasto estimado de GPU
list_gatewaysLista gateways registrados y su estado
list_alertsLista alertas de GPU (abiertas o resueltas)
list_secretsLista secretos (solo nombres, nunca valores)
list_providersLista proveedores de nube de IA/GPU configurados
list_pipelinesLista pipelines de automatización

Acciones (18 herramientas — escritura)

HerramientaDescripción
scale_deploymentEscala el número de réplicas de un despliegue K8s
deploy_modelDespliega un modelo de IA en un clúster de GPU
helm_upgradeEjecuta helm upgrade --install (destructivo — requiere confirmed=True)
helm_uninstallDesinstala un release de Helm (destructivo — requiere confirmed=True)
run_kubectlEjecuta un comando kubectl arbitrario
git_cloneClona un repositorio git
create_secretAlmacena un secreto cifrado
trigger_pipelineDispara manualmente un pipeline de automatización
slurm_get_cluster_infoObtiene información del clúster Slurm y detalles de particiones
slurm_list_jobsLista trabajos Slurm con filtros opcionales
slurm_get_job_statusObtiene el estado de un trabajo Slurm específico
slurm_get_job_outputRecupera stdout/stderr de un trabajo Slurm completado
slurm_submit_jobEnvía un nuevo trabajo Slurm
slurm_cancel_jobCancela un trabajo Slurm en ejecución o pendiente
registry_list_reposLista repositorios del registro de contenedores
registry_list_tagsLista etiquetas de una imagen de contenedor
registry_check_imageVerifica detalles de la imagen (tamaño, capas, fecha de creación)
registry_delete_tagElimina una etiqueta de imagen obsoleta (requiere confirmed=True)

HPE VME / Morpheus (13 herramientas)

HerramientaDescripción
vme_list_instancesLista todas las VMs gestionadas por HPE VME
vme_get_instanceObtiene estado detallado y configuración de una VM
vme_list_serversLista hosts físicos con CPU/memoria
vme_list_cloudsLista nubes/zonas configuradas (KVM, VMware)
vme_start_instanceInicia una instancia detenida
vme_stop_instanceDetiene una instancia en ejecución
vme_restart_instanceReinicia una instancia
vme_create_snapshotCrea una instantánea (pre-migración)
vme_list_snapshotsLista instantáneas de una instancia
vme_convert_imageConvierte formato de disco (vmdk → qcow2) — migración VMware
vme_list_virtual_imagesLista imágenes y plantillas disponibles
vme_detect_vm_wasteDetecta VMs detenidas/inactivas con recomendaciones
vme_get_activityRegistro de auditoría reciente de Morpheus

Hipervisores — Proxmox, vSphere, Xen Orchestra (30 herramientas)

Documentadas al final y listadas aquí en su totalidad: estas fueron registradas y servidas pero ausentes de este README, por lo que un lector que contara las secciones encontraría 87 de las 117 que promete la primera línea. Ahora suman.

Proxmox VE (5 herramientas)

HerramientaDescripción
proxmox_list_vmsLista VMs en todo el clúster con estado y dimensionamiento
proxmox_start_vmInicia una VM detenida
proxmox_stop_vmDetiene una VM en ejecución (destructivo — requiere confirmed=True)
proxmox_migrate_vmMigra una VM a otro nodo (destructivo — requiere confirmed=True)
proxmox_create_snapshotCrea una instantánea de una VM antes de un cambio riesgoso

VMware vSphere (9 herramientas)

HerramientaDescripción
vsphere_list_vmsLista VMs con estado de energía, host y recursos
vsphere_get_vmLee una VM: estado de energía, host, vCPU, RAM, NICs
vsphere_get_vm_metricsUso de CPU, memoria y disco para una VM
vsphere_list_hostsLista hosts ESXi con capacidad
vsphere_start_vmEnciende una VM
vsphere_stop_vmApaga una VM (destructivo — requiere confirmed=True)
vsphere_restart_vmReinicia una VM (destructivo — requiere confirmed=True)
vsphere_migrate_vmvMotion de una VM a otro host (destructivo — requiere confirmed=True)
vsphere_create_snapshotCrea una instantánea de una VM

Xen Orchestra / XCP-ng (15 herramientas)

HerramientaDescripción
xo_list_vmsLista VMs en todos los pools
xo_start_vmInicia una VM
xo_stop_vmApaga limpiamente una VM (destructivo — requiere confirmed=True)
xo_migrate_vmMigra una VM a otro host (destructivo — requiere confirmed=True)
xo_snapshot_vmCrea una instantánea de una VM
xo_list_srsLista repositorios de almacenamiento — planificación de capacidad antes de una migración
xo_list_tasksTareas XO en ejecución
xo_list_backupsLista trabajos de respaldo configurados
xo_run_backupEjecuta un trabajo de respaldo ahora
xo_restore_backupRestaura una VM desde un respaldo (destructivo — requiere confirmed=True)
xo_rolling_pool_updateParchea cada host del pool, uno a la vez (destructivo — requiere confirmed=True)
xo_v2v_list_esxiLista hosts ESXi alcanzables, para una migración VMware
xo_v2v_list_vmware_vmsLista las VMs en un host ESXi
xo_v2v_migrateMigra una VM de VMware a XCP-ng (destructivo — requiere confirmed=True)
xo_v2v_statusSigue una migración V2V en curso

Multi-hipervisor

HerramientaDescripción
get_vm_usageUso y costo de VMs en cada hipervisor declarado

Configuración (3 herramientas)

HerramientaDescripción
set_cluster_rateEstablece la tarifa de costo de GPU para un clúster (solo administrador)
register_gatewayRegistra un nuevo gateway (devuelve token de un solo uso)
delete_gatewayRevoca un gateway

Plano de Control de Infraestructura de Agentes (12 herramientas)

La capa que faltaba entre tus agentes de IA y tu flota de GPUs. Funciona con cualquier framework (n8n, LangChain, CrewAI, Dify) — solo apunta al Proxy LLM de VibOps.

HerramientaDescripción
FinOps por agente
get_agent_usageCosto de GPU por agente — tokens, solicitudes, costo, horas-GPU. "¿Qué agente cuesta más?"
get_agent_usage_detailDesglose de un agente — desglose diario, distribución de modelos, tendencia de costos
get_agent_budgetPresupuesto actual + gasto MTD para un agente
set_agent_budgetEstablece límite de gasto mensual — alerta suave al 80%, bloqueo duro al 100% (HTTP 429)
Control de acceso a modelos
get_agent_model_rulesLista reglas de acceso a modelos — qué agente puede usar qué LLM
update_agent_model_ruleCrea una regla: patrones glob, denegar primero. "Agentes RH → solo Mistral"
Ciclo de vida de identidades
list_agent_identitiesLista identidades de máquina para agentes
create_agent_identityCrea una nueva identidad de máquina (clave mostrada una vez)
rotate_agent_identityRota la clave de una identidad existente
revoke_agent_identityRevoca una identidad inmediatamente
Grafo de dependencias
get_agent_dependency_graphGrafo completo a nivel de organización: agente→modelo, agente→conector, agente→sub-agente
get_agent_dependenciesDependencias de un agente — análisis de impacto antes de una migración

Gobernanza y Cumplimiento (21 herramientas)

HerramientaDescripción
list_anomaliesLista anomalías de GPU con filtro opcional de clúster/estado
get_open_anomaliesObtiene todas las anomalías actualmente abiertas
resolve_anomalyMarca una anomalía como resuelta
list_compliance_controlsLista controles de cumplimiento (filtra por framework)
get_compliance_scoreObtiene la puntuación de cumplimiento para un framework (o todos)
update_compliance_controlActualiza estado, notas o URL de evidencia para un control
list_compliance_reportsLista informes de cumplimiento generados
generate_compliance_reportGenera un informe SOC 2, RGPD o HIPAA de forma asíncrona
get_compliance_reportConsulta/recupera un informe de cumplimiento generado
list_audit_logsConsulta el registro de auditoría inmutable con filtros
verify_audit_chainVerifica la integridad HMAC-SHA256 de toda la cadena de auditoría
get_policyObtiene la política actual de la organización
update_policyReemplaza la política de la organización (efecto inmediato)
list_eval_rubricsLista rúbricas de evaluación LLM-como-juez
evaluate_jobDispara evaluación LLM-como-juez para un trabajo
get_job_evaluationsRecupera resultados de evaluación para un trabajo
get_ldap_configObtiene configuración de LDAP / Active Directory
update_ldap_configConfigura o habilita/deshabilita integración LDAP
get_siem_configObtiene configuración de exportación SIEM
update_siem_configEstablece destino SIEM Splunk/Datadog
push_to_siemExporta eventos de auditoría al SIEM configurado

GPU FinOps (4 herramientas)

HerramientaDescripción
get_budgetObtiene presupuesto actual de GPU y gasto consumido
get_chargebackObtiene desglose de chargeback por tenant para un mes dado
get_spend_trendObtiene tendencia diaria de gasto de GPU (predeterminado: últimos 30 días)
get_waste_analysisIdentifica recursos GPU inactivos y oportunidades de optimización de costos

Proxy de Inferencia LLM

VibOps incluye un proxy transparente compatible con OpenAI (puerto 8004) que se sitúa entre tus agentes de IA y los servidores de inferencia LLM (vLLM, Ollama, TGI). Cada solicitud de inferencia se registra con atribución de agente para FinOps.

Tus agentes apuntan al proxy en lugar del LLM directamente:

# Before
OPENAI_BASE_URL=http://vllm:8000/v1

# After
OPENAI_BASE_URL=http://vibops-proxy:8004/v1

Añade un encabezado X-VibOps-Agent-Id para atribuir costos por agente:

curl -X POST http://vibops-proxy:8004/v1/chat/completions \
  -H "X-VibOps-Agent-Id: pricing-agent-v2" \
  -H "X-VibOps-Team: supply-chain" \
  -d '{"model": "mistral:7b", "messages": [...]}'

El proxy captura: ID de agente, equipo, modelo, tokens, latencia, costo de GPU — visible en el panel FinOps de la consola y consultable mediante get_agent_usage.

Ejemplos de prompts

"Clone my repo and deploy it on the GPU cluster."
"Deploy llama3:8b on vibops-dev with 2 replicas."
"Scale the inference deployment to 4 replicas on prod-cluster."
"What's our GPU utilisation trend over the last 7 days?"
"Show me the cost breakdown per cluster this week."
"Which clusters have open critical GPU alerts?"
"Are there any open GPU anomalies right now?"
"Scan my infrastructure and show discovered services."
"What's our AI Act compliance score and which controls are non-compliant?"
"Generate a SOC 2 report for Q1 2026."
"Verify the audit chain hasn't been tampered with."
"Which agent costs the most in GPU this month?"
"Show me the inference cost breakdown for the pricing agent."
"Which agents depend on the claude-opus-4-6 model?"
"Create a machine identity for the pricing-agent with a 1-year expiry."
"Show me the spend trend for the last 7 days and flag any waste."

Contribuciones

Ver CONTRIBUTING.md. Todas las contribuciones requieren firma DCO (git commit -s).

Licencia

MIT — libre de usar, modificar y distribuir. Ver LICENSE.

Construido sobre FastMCP y VibOps — El Motor de Infraestructura de IA.