vibops-mcp
Plano de controle de infraestrutura GPU + FinOps de LLM por agente. 74 ferramentas. Implante, escale, monitore custo por agente, aplique orçamentos. Licença MIT.
Documentação
vibops-mcp
O servidor MCP para VibOps — The AI Infrastructure Engine. Do código à GPU em uma única conversa.
O problema
Levar um aplicativo de IA do código à produção em GPUs exige conectar 9+ ferramentas — git, Docker, CI/CD, Helm, kubectl, monitoramento de GPU, gestão de custos, conformidade, alertas. Cada uma com sua própria API, painel e modelo de custo. Nenhuma interface única abrange todo o pipeline.
A solução
vibops-mcp conecta seu assistente de IA ao VibOps — o mecanismo que clona, compila, implanta, escala, monitora, corrige e fatura seus aplicativos e agentes em qualquer GPU, qualquer cluster, qualquer nuvem. Um pip install, 117 ferramentas, uma conversa.
- Ship — clone repositórios, compile containers, implante modelos, execute Helm/kubectl, dispare pipelines, envie jobs Slurm
- Operate — escale deployments, gerencie VMs (Proxmox/XO/vSphere/HPE VME), detecte e corrija anomalias de GPU
- Observe — utilização de GPU, detalhamento de carga de trabalho, MTTR, estimativas de custo, deployments K8s ao vivo
- Govern — conformidade com a Lei de IA, relatórios SOC 2/RGPD, cadeia de auditoria imutável, gestão de políticas
- FinOps — rastreamento de custo por agente, aplicação de orçamento, chargeback, tendências de gastos, análise de desperdício
Toda operação passa pela sua instância VibOps e é registrada no log de auditoria imutável.
Instalação
pip install git+https://github.com/VibOpsai/vibops-mcp.git
Configuração
Você precisa de duas variáveis de ambiente:
| Variável | Descrição |
|---|---|
VIBOPS_URL | URL base da sua instância VibOps, ex.: https://vibops.example.com |
VIBOPS_TOKEN | Token de API — crie um em VibOps → Settings → API Tokens |
Claude Desktop
Adicione em ~/.config/claude/claude_desktop_config.json (macOS: ~/Library/Application Support/Claude/claude_desktop_config.json):
{
"mcpServers": {
"vibops": {
"command": "vibops-mcp",
"env": {
"VIBOPS_URL": "https://vibops.example.com",
"VIBOPS_TOKEN": "your-token-here"
}
}
}
}
Cursor
Adicione em .cursor/mcp.json na raiz do seu projeto, ou na configuração global:
{
"mcpServers": {
"vibops": {
"command": "vibops-mcp",
"env": {
"VIBOPS_URL": "https://vibops.example.com",
"VIBOPS_TOKEN": "your-token-here"
}
}
}
}
Claude Code (CLI)
claude mcp add vibops vibops-mcp \
-e VIBOPS_URL=https://vibops.example.com \
-e VIBOPS_TOKEN=your-token-here
Ferramentas disponíveis
Observação (16 ferramentas — somente leitura)
| Ferramenta | Descrição |
|---|---|
list_clusters | Lista clusters e utilização de GPU |
list_kubectl_contexts | Lista contextos kubectl disponíveis |
get_cluster_deployments | Status de deployments K8s ao vivo para um cluster |
get_cluster_rate | Obtém a taxa de custo de GPU configurada para um cluster |
list_jobs | Lista jobs recentes com filtros opcionais |
get_job | Obtém detalhes e resultado de um job |
get_job_metrics | Taxa de sucesso de jobs, latência P50/P95/P99, detalhamento de erros |
get_gpu_metrics | Série temporal horária de utilização de GPU |
get_workload_breakdown | Contagem de jobs por tipo de carga de trabalho |
get_mttr | Tempo Médio Para Resolver alertas de GPU |
get_cost_estimate | Gasto estimado com GPU |
list_gateways | Lista gateways registrados e status |
list_alerts | Lista alertas de GPU (abertos ou resolvidos) |
list_secrets | Lista segredos (somente nomes, nunca valores) |
list_providers | Lista provedores de nuvem de IA/GPU configurados |
list_pipelines | Lista pipelines de automação |
Ações (18 ferramentas — escrita)
| Ferramenta | Descrição |
|---|---|
scale_deployment | Escala a contagem de réplicas de um deployment K8s |
deploy_model | Implanta um modelo de IA em um cluster de GPU |
helm_upgrade | Executa helm upgrade --install (destrutivo — requer confirmed=True) |
helm_uninstall | Desinstala um release Helm (destrutivo — requer confirmed=True) |
run_kubectl | Executa um comando kubectl arbitrário |
git_clone | Clona um repositório git |
create_secret | Armazena um segredo criptografado |
trigger_pipeline | Dispara manualmente um pipeline de automação |
slurm_get_cluster_info | Obtém informações do cluster Slurm e detalhes de partições |
slurm_list_jobs | Lista jobs Slurm com filtros opcionais |
slurm_get_job_status | Obtém status de um job Slurm específico |
slurm_get_job_output | Recupera stdout/stderr de um job Slurm concluído |
slurm_submit_job | Submete um novo job Slurm |
slurm_cancel_job | Cancela um job Slurm em execução ou pendente |
registry_list_repos | Lista repositórios do container registry |
registry_list_tags | Lista tags de uma imagem de container |
registry_check_image | Verifica detalhes da imagem (tamanho, camadas, data de criação) |
registry_delete_tag | Exclui uma tag de imagem obsoleta (requer confirmed=True) |
HPE VME / Morpheus (13 ferramentas)
| Ferramenta | Descrição |
|---|---|
vme_list_instances | Lista todas as VMs gerenciadas pelo HPE VME |
vme_get_instance | Obtém status detalhado e configuração de uma VM |
vme_list_servers | Lista hosts físicos com CPU/memória |
vme_list_clouds | Lista clouds/zonas configurados (KVM, VMware) |
vme_start_instance | Inicia uma instância parada |
vme_stop_instance | Para uma instância em execução |
vme_restart_instance | Reinicia uma instância |
vme_create_snapshot | Cria um snapshot (pré-migração) |
vme_list_snapshots | Lista snapshots de uma instância |
vme_convert_image | Converte formato de disco (vmdk → qcow2) — migração VMware |
vme_list_virtual_images | Lista imagens e templates disponíveis |
vme_detect_vm_waste | Detecta VMs paradas/ociosas com recomendações |
vme_get_activity | Log de auditoria recente do Morpheus |
Hypervisors — Proxmox, vSphere, Xen Orchestra (30 ferramentas)
Documentado por último e listado aqui por completo: estas foram registradas e servidas, mas ausentes deste README, então um leitor que contasse as seções encontraria 87 das 117 que a primeira linha promete. Agora elas somam.
Proxmox VE (5 ferramentas)
| Ferramenta | Descrição |
|---|---|
proxmox_list_vms | Lista VMs no cluster com status e dimensionamento |
proxmox_start_vm | Inicia uma VM parada |
proxmox_stop_vm | Para uma VM em execução (destrutivo — requer confirmed=True) |
proxmox_migrate_vm | Migra uma VM para outro nó (destrutivo — requer confirmed=True) |
proxmox_create_snapshot | Cria snapshot de uma VM antes de uma mudança arriscada |
VMware vSphere (9 ferramentas)
| Ferramenta | Descrição |
|---|---|
vsphere_list_vms | Lista VMs com estado de energia, host e recursos |
vsphere_get_vm | Lê uma VM: estado de energia, host, vCPU, RAM, NICs |
vsphere_get_vm_metrics | Uso de CPU, memória e disco de uma VM |
vsphere_list_hosts | Lista hosts ESXi com capacidade |
vsphere_start_vm | Liga uma VM |
vsphere_stop_vm | Desliga uma VM (destrutivo — requer confirmed=True) |
vsphere_restart_vm | Reinicia uma VM (destrutivo — requer confirmed=True) |
vsphere_migrate_vm | Faz vMotion de uma VM para outro host (destrutivo — requer confirmed=True) |
vsphere_create_snapshot | Cria snapshot de uma VM |
Xen Orchestra / XCP-ng (15 ferramentas)
| Ferramenta | Descrição |
|---|---|
xo_list_vms | Lista VMs em todos os pools |
xo_start_vm | Inicia uma VM |
xo_stop_vm | Desliga uma VM de forma limpa (destrutivo — requer confirmed=True) |
xo_migrate_vm | Migra uma VM para outro host (destrutivo — requer confirmed=True) |
xo_snapshot_vm | Cria snapshot de uma VM |
xo_list_srs | Lista repositórios de armazenamento — planejamento de capacidade antes de uma migração |
xo_list_tasks | Tarefas XO em execução |
xo_list_backups | Lista jobs de backup configurados |
xo_run_backup | Executa um job de backup agora |
xo_restore_backup | Restaura uma VM de um backup (destrutivo — requer confirmed=True) |
xo_rolling_pool_update | Aplica patch em cada host do pool, um por vez (destrutivo — requer confirmed=True) |
xo_v2v_list_esxi | Lista hosts ESXi alcançáveis, para migração VMware |
xo_v2v_list_vmware_vms | Lista as VMs em um host ESXi |
xo_v2v_migrate | Migra uma VM VMware para XCP-ng (destrutivo — requer confirmed=True) |
xo_v2v_status | Acompanha uma migração V2V em andamento |
Cross-hypervisor
| Ferramenta | Descrição |
|---|---|
get_vm_usage | Uso e custo de VMs em todos os hypervisors declarados |
Configuração (3 ferramentas)
| Ferramenta | Descrição |
|---|---|
set_cluster_rate | Define a taxa de custo de GPU para um cluster (somente admin) |
register_gateway | Registra um novo gateway (retorna token de uso único) |
delete_gateway | Revoga um gateway |
Plano de Controle de Infraestrutura de Agentes (12 ferramentas)
A camada que faltava entre seus agentes de IA e sua frota de GPUs. Funciona com qualquer framework (n8n, LangChain, CrewAI, Dify) — basta apontar para o VibOps LLM Proxy.
| Ferramenta | Descrição |
|---|---|
| FinOps por agente | |
get_agent_usage | Custo de GPU por agente — tokens, requisições, custo, GPU-horas. "Qual agente custa mais?" |
get_agent_usage_detail | Detalhamento de um agente — divisão diária, distribuição de modelos, tendência de custo |
get_agent_budget | Orçamento atual + gasto MTD de um agente |
set_agent_budget | Define limite mensal de gastos — alerta suave em 80%, bloqueio rígido em 100% (HTTP 429) |
| Controle de acesso a modelos | |
get_agent_model_rules | Lista regras de acesso a modelos — qual agente pode usar qual LLM |
update_agent_model_rule | Cria uma regra: padrões glob, deny-first. "Agentes RH → somente Mistral" |
| Ciclo de vida de identidade | |
list_agent_identities | Lista identidades de máquina para agentes |
create_agent_identity | Cria uma nova identidade de máquina (chave exibida uma única vez) |
rotate_agent_identity | Rotaciona a chave de uma identidade existente |
revoke_agent_identity | Revoga uma identidade imediatamente |
| Grafo de dependências | |
get_agent_dependency_graph | Grafo completo da organização: agente→modelo, agente→conector, agente→sub-agente |
get_agent_dependencies | Dependências de um agente — análise de impacto antes da migração |
Governança e Conformidade (21 ferramentas)
| Ferramenta | Descrição |
|---|---|
list_anomalies | Lista anomalias de GPU com filtro opcional de cluster/status |
get_open_anomalies | Obtém todas as anomalias atualmente abertas |
resolve_anomaly | Marca uma anomalia como resolvida |
list_compliance_controls | Lista controles de conformidade (filtro por framework) |
get_compliance_score | Obtém a pontuação de conformidade para um framework (ou todos) |
update_compliance_control | Atualiza status, notas ou URL de evidência de um controle |
list_compliance_reports | Lista relatórios de conformidade gerados |
generate_compliance_report | Gera um relatório SOC 2, RGPD ou HIPAA de forma assíncrona |
get_compliance_report | Consulta/recupera um relatório de conformidade gerado |
list_audit_logs | Consulta o log de auditoria imutável com filtros |
verify_audit_chain | Verifica a integridade HMAC-SHA256 de toda a cadeia de auditoria |
get_policy | Obtém a política atual da organização |
update_policy | Substitui a política da organização (efeito imediato) |
list_eval_rubrics | Lista rubricas de avaliação LLM-como-juiz |
evaluate_job | Dispara avaliação LLM-como-juiz para um job |
get_job_evaluations | Recupera resultados de avaliação de um job |
get_ldap_config | Obtém configuração de LDAP / Active Directory |
update_ldap_config | Configura ou habilita/desabilita integração LDAP |
get_siem_config | Obtém configuração de exportação SIEM push |
update_siem_config | Define destino SIEM Splunk/Datadog |
push_to_siem | Exporta eventos de auditoria para o SIEM configurado |
GPU FinOps (4 ferramentas)
| Ferramenta | Descrição |
|---|---|
get_budget | Obtém orçamento atual de GPU e gasto consumido |
get_chargeback | Obtém detalhamento de chargeback por tenant para um mês específico |
get_spend_trend | Obtém tendência diária de gastos com GPU (padrão: últimos 30 dias) |
get_waste_analysis | Identifica recursos de GPU ociosos e oportunidades de otimização de custos |
LLM Inference Proxy
O VibOps inclui um proxy transparente compatível com OpenAI (porta 8004) que fica entre seus agentes de IA e servidores de inferência LLM (vLLM, Ollama, TGI). Cada requisição de inferência é registrada com atribuição de agente para FinOps.
Seus agentes apontam para o proxy em vez do LLM diretamente:
# Before
OPENAI_BASE_URL=http://vllm:8000/v1
# After
OPENAI_BASE_URL=http://vibops-proxy:8004/v1
Adicione um cabeçalho X-VibOps-Agent-Id para atribuir custos por agente:
curl -X POST http://vibops-proxy:8004/v1/chat/completions \
-H "X-VibOps-Agent-Id: pricing-agent-v2" \
-H "X-VibOps-Team: supply-chain" \
-d '{"model": "mistral:7b", "messages": [...]}'
O proxy captura: ID do agente, equipe, modelo, tokens, latência, custo de GPU — visível no painel FinOps do console e consultável via get_agent_usage.
Exemplos de prompts
"Clone my repo and deploy it on the GPU cluster."
"Deploy llama3:8b on vibops-dev with 2 replicas."
"Scale the inference deployment to 4 replicas on prod-cluster."
"What's our GPU utilisation trend over the last 7 days?"
"Show me the cost breakdown per cluster this week."
"Which clusters have open critical GPU alerts?"
"Are there any open GPU anomalies right now?"
"Scan my infrastructure and show discovered services."
"What's our AI Act compliance score and which controls are non-compliant?"
"Generate a SOC 2 report for Q1 2026."
"Verify the audit chain hasn't been tampered with."
"Which agent costs the most in GPU this month?"
"Show me the inference cost breakdown for the pricing agent."
"Which agents depend on the claude-opus-4-6 model?"
"Create a machine identity for the pricing-agent with a 1-year expiry."
"Show me the spend trend for the last 7 days and flag any waste."
Contribuindo
Veja CONTRIBUTING.md. Todas as contribuições exigem assinatura DCO (git commit -s).
Licença
MIT — livre para usar, modificar e distribuir. Veja LICENSE.
Construído sobre FastMCP e VibOps — The AI Infrastructure Engine.