vibops-mcp
Plano de control de infraestructura GPU + FinOps de LLM por agente. 74 herramientas. Desplegar, escalar, rastrear costo por agente, aplicar presupuestos. Licencia MIT.
Documentación
vibops-mcp
El servidor MCP para VibOps — El Motor de Infraestructura de IA. Del código a GPU en una sola conversación.
El problema
Llevar una aplicación de IA del código a producción en GPUs requiere unir 9+ herramientas — git, Docker, CI/CD, Helm, kubectl, monitoreo de GPU, gestión de costos, cumplimiento, alertas. Cada una con su propia API, panel y modelo de costos. Ninguna interfaz única abarca todo el pipeline.
La solución
vibops-mcp conecta tu asistente de IA a VibOps — el motor que clona, construye, despliega, escala, monitorea, corrige y factura tus aplicaciones y agentes en cualquier GPU, cualquier clúster, cualquier nube. Un pip install, 117 herramientas, una sola conversación.
- Despliega — clona repositorios, construye contenedores, despliega modelos, ejecuta Helm/kubectl, dispara pipelines, envía trabajos Slurm
- Opera — escala despliegues, gestiona VMs (Proxmox/XO/vSphere/HPE VME), detecta y corrige anomalías de GPU
- Observa — utilización de GPU, desglose de cargas de trabajo, MTTR, estimaciones de costos, despliegues K8s en vivo
- Gobierna — cumplimiento de la Ley de IA, informes SOC 2/RGPD, cadena de auditoría inmutable, gestión de políticas
- FinOps — seguimiento de costos por agente, aplicación de presupuestos, chargeback, tendencias de gasto, análisis de desperdicio
Cada operación pasa por tu instancia de VibOps y se registra en el registro de auditoría inmutable.
Instalación
pip install git+https://github.com/VibOpsai/vibops-mcp.git
Configuración
Necesitas dos variables de entorno:
| Variable | Descripción |
|---|---|
VIBOPS_URL | URL base de tu instancia de VibOps, p. ej. https://vibops.example.com |
VIBOPS_TOKEN | Token de API — crea uno en VibOps → Configuración → Tokens de API |
Claude Desktop
Añade a ~/.config/claude/claude_desktop_config.json (macOS: ~/Library/Application Support/Claude/claude_desktop_config.json):
{
"mcpServers": {
"vibops": {
"command": "vibops-mcp",
"env": {
"VIBOPS_URL": "https://vibops.example.com",
"VIBOPS_TOKEN": "your-token-here"
}
}
}
}
Cursor
Añade a .cursor/mcp.json en la raíz de tu proyecto, o a la configuración global:
{
"mcpServers": {
"vibops": {
"command": "vibops-mcp",
"env": {
"VIBOPS_URL": "https://vibops.example.com",
"VIBOPS_TOKEN": "your-token-here"
}
}
}
}
Claude Code (CLI)
claude mcp add vibops vibops-mcp \
-e VIBOPS_URL=https://vibops.example.com \
-e VIBOPS_TOKEN=your-token-here
Herramientas disponibles
Observación (16 herramientas — solo lectura)
| Herramienta | Descripción |
|---|---|
list_clusters | Lista clústeres y utilización de GPU |
list_kubectl_contexts | Lista contextos kubectl disponibles |
get_cluster_deployments | Estado de despliegues K8s en vivo para un clúster |
get_cluster_rate | Obtiene la tarifa de costo de GPU configurada para un clúster |
list_jobs | Lista trabajos recientes con filtros opcionales |
get_job | Obtiene detalles y resultado de un trabajo |
get_job_metrics | Tasa de éxito de trabajos, latencia P50/P95/P99, desglose de errores |
get_gpu_metrics | Serie temporal horaria de utilización de GPU |
get_workload_breakdown | Conteo de trabajos por tipo de carga de trabajo |
get_mttr | Tiempo medio de resolución de alertas de GPU |
get_cost_estimate | Gasto estimado de GPU |
list_gateways | Lista gateways registrados y su estado |
list_alerts | Lista alertas de GPU (abiertas o resueltas) |
list_secrets | Lista secretos (solo nombres, nunca valores) |
list_providers | Lista proveedores de nube de IA/GPU configurados |
list_pipelines | Lista pipelines de automatización |
Acciones (18 herramientas — escritura)
| Herramienta | Descripción |
|---|---|
scale_deployment | Escala el número de réplicas de un despliegue K8s |
deploy_model | Despliega un modelo de IA en un clúster de GPU |
helm_upgrade | Ejecuta helm upgrade --install (destructivo — requiere confirmed=True) |
helm_uninstall | Desinstala un release de Helm (destructivo — requiere confirmed=True) |
run_kubectl | Ejecuta un comando kubectl arbitrario |
git_clone | Clona un repositorio git |
create_secret | Almacena un secreto cifrado |
trigger_pipeline | Dispara manualmente un pipeline de automatización |
slurm_get_cluster_info | Obtiene información del clúster Slurm y detalles de particiones |
slurm_list_jobs | Lista trabajos Slurm con filtros opcionales |
slurm_get_job_status | Obtiene el estado de un trabajo Slurm específico |
slurm_get_job_output | Recupera stdout/stderr de un trabajo Slurm completado |
slurm_submit_job | Envía un nuevo trabajo Slurm |
slurm_cancel_job | Cancela un trabajo Slurm en ejecución o pendiente |
registry_list_repos | Lista repositorios del registro de contenedores |
registry_list_tags | Lista etiquetas de una imagen de contenedor |
registry_check_image | Verifica detalles de la imagen (tamaño, capas, fecha de creación) |
registry_delete_tag | Elimina una etiqueta de imagen obsoleta (requiere confirmed=True) |
HPE VME / Morpheus (13 herramientas)
| Herramienta | Descripción |
|---|---|
vme_list_instances | Lista todas las VMs gestionadas por HPE VME |
vme_get_instance | Obtiene estado detallado y configuración de una VM |
vme_list_servers | Lista hosts físicos con CPU/memoria |
vme_list_clouds | Lista nubes/zonas configuradas (KVM, VMware) |
vme_start_instance | Inicia una instancia detenida |
vme_stop_instance | Detiene una instancia en ejecución |
vme_restart_instance | Reinicia una instancia |
vme_create_snapshot | Crea una instantánea (pre-migración) |
vme_list_snapshots | Lista instantáneas de una instancia |
vme_convert_image | Convierte formato de disco (vmdk → qcow2) — migración VMware |
vme_list_virtual_images | Lista imágenes y plantillas disponibles |
vme_detect_vm_waste | Detecta VMs detenidas/inactivas con recomendaciones |
vme_get_activity | Registro de auditoría reciente de Morpheus |
Hipervisores — Proxmox, vSphere, Xen Orchestra (30 herramientas)
Documentadas al final y listadas aquí en su totalidad: estas fueron registradas y servidas pero ausentes de este README, por lo que un lector que contara las secciones encontraría 87 de las 117 que promete la primera línea. Ahora suman.
Proxmox VE (5 herramientas)
| Herramienta | Descripción |
|---|---|
proxmox_list_vms | Lista VMs en todo el clúster con estado y dimensionamiento |
proxmox_start_vm | Inicia una VM detenida |
proxmox_stop_vm | Detiene una VM en ejecución (destructivo — requiere confirmed=True) |
proxmox_migrate_vm | Migra una VM a otro nodo (destructivo — requiere confirmed=True) |
proxmox_create_snapshot | Crea una instantánea de una VM antes de un cambio riesgoso |
VMware vSphere (9 herramientas)
| Herramienta | Descripción |
|---|---|
vsphere_list_vms | Lista VMs con estado de energía, host y recursos |
vsphere_get_vm | Lee una VM: estado de energía, host, vCPU, RAM, NICs |
vsphere_get_vm_metrics | Uso de CPU, memoria y disco para una VM |
vsphere_list_hosts | Lista hosts ESXi con capacidad |
vsphere_start_vm | Enciende una VM |
vsphere_stop_vm | Apaga una VM (destructivo — requiere confirmed=True) |
vsphere_restart_vm | Reinicia una VM (destructivo — requiere confirmed=True) |
vsphere_migrate_vm | vMotion de una VM a otro host (destructivo — requiere confirmed=True) |
vsphere_create_snapshot | Crea una instantánea de una VM |
Xen Orchestra / XCP-ng (15 herramientas)
| Herramienta | Descripción |
|---|---|
xo_list_vms | Lista VMs en todos los pools |
xo_start_vm | Inicia una VM |
xo_stop_vm | Apaga limpiamente una VM (destructivo — requiere confirmed=True) |
xo_migrate_vm | Migra una VM a otro host (destructivo — requiere confirmed=True) |
xo_snapshot_vm | Crea una instantánea de una VM |
xo_list_srs | Lista repositorios de almacenamiento — planificación de capacidad antes de una migración |
xo_list_tasks | Tareas XO en ejecución |
xo_list_backups | Lista trabajos de respaldo configurados |
xo_run_backup | Ejecuta un trabajo de respaldo ahora |
xo_restore_backup | Restaura una VM desde un respaldo (destructivo — requiere confirmed=True) |
xo_rolling_pool_update | Parchea cada host del pool, uno a la vez (destructivo — requiere confirmed=True) |
xo_v2v_list_esxi | Lista hosts ESXi alcanzables, para una migración VMware |
xo_v2v_list_vmware_vms | Lista las VMs en un host ESXi |
xo_v2v_migrate | Migra una VM de VMware a XCP-ng (destructivo — requiere confirmed=True) |
xo_v2v_status | Sigue una migración V2V en curso |
Multi-hipervisor
| Herramienta | Descripción |
|---|---|
get_vm_usage | Uso y costo de VMs en cada hipervisor declarado |
Configuración (3 herramientas)
| Herramienta | Descripción |
|---|---|
set_cluster_rate | Establece la tarifa de costo de GPU para un clúster (solo administrador) |
register_gateway | Registra un nuevo gateway (devuelve token de un solo uso) |
delete_gateway | Revoca un gateway |
Plano de Control de Infraestructura de Agentes (12 herramientas)
La capa que faltaba entre tus agentes de IA y tu flota de GPUs. Funciona con cualquier framework (n8n, LangChain, CrewAI, Dify) — solo apunta al Proxy LLM de VibOps.
| Herramienta | Descripción |
|---|---|
| FinOps por agente | |
get_agent_usage | Costo de GPU por agente — tokens, solicitudes, costo, horas-GPU. "¿Qué agente cuesta más?" |
get_agent_usage_detail | Desglose de un agente — desglose diario, distribución de modelos, tendencia de costos |
get_agent_budget | Presupuesto actual + gasto MTD para un agente |
set_agent_budget | Establece límite de gasto mensual — alerta suave al 80%, bloqueo duro al 100% (HTTP 429) |
| Control de acceso a modelos | |
get_agent_model_rules | Lista reglas de acceso a modelos — qué agente puede usar qué LLM |
update_agent_model_rule | Crea una regla: patrones glob, denegar primero. "Agentes RH → solo Mistral" |
| Ciclo de vida de identidades | |
list_agent_identities | Lista identidades de máquina para agentes |
create_agent_identity | Crea una nueva identidad de máquina (clave mostrada una vez) |
rotate_agent_identity | Rota la clave de una identidad existente |
revoke_agent_identity | Revoca una identidad inmediatamente |
| Grafo de dependencias | |
get_agent_dependency_graph | Grafo completo a nivel de organización: agente→modelo, agente→conector, agente→sub-agente |
get_agent_dependencies | Dependencias de un agente — análisis de impacto antes de una migración |
Gobernanza y Cumplimiento (21 herramientas)
| Herramienta | Descripción |
|---|---|
list_anomalies | Lista anomalías de GPU con filtro opcional de clúster/estado |
get_open_anomalies | Obtiene todas las anomalías actualmente abiertas |
resolve_anomaly | Marca una anomalía como resuelta |
list_compliance_controls | Lista controles de cumplimiento (filtra por framework) |
get_compliance_score | Obtiene la puntuación de cumplimiento para un framework (o todos) |
update_compliance_control | Actualiza estado, notas o URL de evidencia para un control |
list_compliance_reports | Lista informes de cumplimiento generados |
generate_compliance_report | Genera un informe SOC 2, RGPD o HIPAA de forma asíncrona |
get_compliance_report | Consulta/recupera un informe de cumplimiento generado |
list_audit_logs | Consulta el registro de auditoría inmutable con filtros |
verify_audit_chain | Verifica la integridad HMAC-SHA256 de toda la cadena de auditoría |
get_policy | Obtiene la política actual de la organización |
update_policy | Reemplaza la política de la organización (efecto inmediato) |
list_eval_rubrics | Lista rúbricas de evaluación LLM-como-juez |
evaluate_job | Dispara evaluación LLM-como-juez para un trabajo |
get_job_evaluations | Recupera resultados de evaluación para un trabajo |
get_ldap_config | Obtiene configuración de LDAP / Active Directory |
update_ldap_config | Configura o habilita/deshabilita integración LDAP |
get_siem_config | Obtiene configuración de exportación SIEM |
update_siem_config | Establece destino SIEM Splunk/Datadog |
push_to_siem | Exporta eventos de auditoría al SIEM configurado |
GPU FinOps (4 herramientas)
| Herramienta | Descripción |
|---|---|
get_budget | Obtiene presupuesto actual de GPU y gasto consumido |
get_chargeback | Obtiene desglose de chargeback por tenant para un mes dado |
get_spend_trend | Obtiene tendencia diaria de gasto de GPU (predeterminado: últimos 30 días) |
get_waste_analysis | Identifica recursos GPU inactivos y oportunidades de optimización de costos |
Proxy de Inferencia LLM
VibOps incluye un proxy transparente compatible con OpenAI (puerto 8004) que se sitúa entre tus agentes de IA y los servidores de inferencia LLM (vLLM, Ollama, TGI). Cada solicitud de inferencia se registra con atribución de agente para FinOps.
Tus agentes apuntan al proxy en lugar del LLM directamente:
# Before
OPENAI_BASE_URL=http://vllm:8000/v1
# After
OPENAI_BASE_URL=http://vibops-proxy:8004/v1
Añade un encabezado X-VibOps-Agent-Id para atribuir costos por agente:
curl -X POST http://vibops-proxy:8004/v1/chat/completions \
-H "X-VibOps-Agent-Id: pricing-agent-v2" \
-H "X-VibOps-Team: supply-chain" \
-d '{"model": "mistral:7b", "messages": [...]}'
El proxy captura: ID de agente, equipo, modelo, tokens, latencia, costo de GPU — visible en el panel FinOps de la consola y consultable mediante get_agent_usage.
Ejemplos de prompts
"Clone my repo and deploy it on the GPU cluster."
"Deploy llama3:8b on vibops-dev with 2 replicas."
"Scale the inference deployment to 4 replicas on prod-cluster."
"What's our GPU utilisation trend over the last 7 days?"
"Show me the cost breakdown per cluster this week."
"Which clusters have open critical GPU alerts?"
"Are there any open GPU anomalies right now?"
"Scan my infrastructure and show discovered services."
"What's our AI Act compliance score and which controls are non-compliant?"
"Generate a SOC 2 report for Q1 2026."
"Verify the audit chain hasn't been tampered with."
"Which agent costs the most in GPU this month?"
"Show me the inference cost breakdown for the pricing agent."
"Which agents depend on the claude-opus-4-6 model?"
"Create a machine identity for the pricing-agent with a 1-year expiry."
"Show me the spend trend for the last 7 days and flag any waste."
Contribuciones
Ver CONTRIBUTING.md. Todas las contribuciones requieren firma DCO (git commit -s).
Licencia
MIT — libre de usar, modificar y distribuir. Ver LICENSE.
Construido sobre FastMCP y VibOps — El Motor de Infraestructura de IA.