vibops-mcp

Plano de controle de infraestrutura GPU + FinOps de LLM por agente. 74 ferramentas. Implante, escale, monitore custo por agente, aplique orçamentos. Licença MIT.

Documentação

vibops-mcp

License: MIT Python 3.11+ MCP Tools Tests

O servidor MCP para VibOps — The AI Infrastructure Engine. Do código à GPU em uma única conversa.

O problema

Levar um aplicativo de IA do código à produção em GPUs exige conectar 9+ ferramentas — git, Docker, CI/CD, Helm, kubectl, monitoramento de GPU, gestão de custos, conformidade, alertas. Cada uma com sua própria API, painel e modelo de custo. Nenhuma interface única abrange todo o pipeline.

A solução

vibops-mcp conecta seu assistente de IA ao VibOps — o mecanismo que clona, compila, implanta, escala, monitora, corrige e fatura seus aplicativos e agentes em qualquer GPU, qualquer cluster, qualquer nuvem. Um pip install, 117 ferramentas, uma conversa.

  • Ship — clone repositórios, compile containers, implante modelos, execute Helm/kubectl, dispare pipelines, envie jobs Slurm
  • Operate — escale deployments, gerencie VMs (Proxmox/XO/vSphere/HPE VME), detecte e corrija anomalias de GPU
  • Observe — utilização de GPU, detalhamento de carga de trabalho, MTTR, estimativas de custo, deployments K8s ao vivo
  • Govern — conformidade com a Lei de IA, relatórios SOC 2/RGPD, cadeia de auditoria imutável, gestão de políticas
  • FinOps — rastreamento de custo por agente, aplicação de orçamento, chargeback, tendências de gastos, análise de desperdício

Toda operação passa pela sua instância VibOps e é registrada no log de auditoria imutável.

Instalação

pip install git+https://github.com/VibOpsai/vibops-mcp.git

Configuração

Você precisa de duas variáveis de ambiente:

VariávelDescrição
VIBOPS_URLURL base da sua instância VibOps, ex.: https://vibops.example.com
VIBOPS_TOKENToken de API — crie um em VibOps → Settings → API Tokens

Claude Desktop

Adicione em ~/.config/claude/claude_desktop_config.json (macOS: ~/Library/Application Support/Claude/claude_desktop_config.json):

{
  "mcpServers": {
    "vibops": {
      "command": "vibops-mcp",
      "env": {
        "VIBOPS_URL": "https://vibops.example.com",
        "VIBOPS_TOKEN": "your-token-here"
      }
    }
  }
}

Cursor

Adicione em .cursor/mcp.json na raiz do seu projeto, ou na configuração global:

{
  "mcpServers": {
    "vibops": {
      "command": "vibops-mcp",
      "env": {
        "VIBOPS_URL": "https://vibops.example.com",
        "VIBOPS_TOKEN": "your-token-here"
      }
    }
  }
}

Claude Code (CLI)

claude mcp add vibops vibops-mcp \
  -e VIBOPS_URL=https://vibops.example.com \
  -e VIBOPS_TOKEN=your-token-here

Ferramentas disponíveis

Observação (16 ferramentas — somente leitura)

FerramentaDescrição
list_clustersLista clusters e utilização de GPU
list_kubectl_contextsLista contextos kubectl disponíveis
get_cluster_deploymentsStatus de deployments K8s ao vivo para um cluster
get_cluster_rateObtém a taxa de custo de GPU configurada para um cluster
list_jobsLista jobs recentes com filtros opcionais
get_jobObtém detalhes e resultado de um job
get_job_metricsTaxa de sucesso de jobs, latência P50/P95/P99, detalhamento de erros
get_gpu_metricsSérie temporal horária de utilização de GPU
get_workload_breakdownContagem de jobs por tipo de carga de trabalho
get_mttrTempo Médio Para Resolver alertas de GPU
get_cost_estimateGasto estimado com GPU
list_gatewaysLista gateways registrados e status
list_alertsLista alertas de GPU (abertos ou resolvidos)
list_secretsLista segredos (somente nomes, nunca valores)
list_providersLista provedores de nuvem de IA/GPU configurados
list_pipelinesLista pipelines de automação

Ações (18 ferramentas — escrita)

FerramentaDescrição
scale_deploymentEscala a contagem de réplicas de um deployment K8s
deploy_modelImplanta um modelo de IA em um cluster de GPU
helm_upgradeExecuta helm upgrade --install (destrutivo — requer confirmed=True)
helm_uninstallDesinstala um release Helm (destrutivo — requer confirmed=True)
run_kubectlExecuta um comando kubectl arbitrário
git_cloneClona um repositório git
create_secretArmazena um segredo criptografado
trigger_pipelineDispara manualmente um pipeline de automação
slurm_get_cluster_infoObtém informações do cluster Slurm e detalhes de partições
slurm_list_jobsLista jobs Slurm com filtros opcionais
slurm_get_job_statusObtém status de um job Slurm específico
slurm_get_job_outputRecupera stdout/stderr de um job Slurm concluído
slurm_submit_jobSubmete um novo job Slurm
slurm_cancel_jobCancela um job Slurm em execução ou pendente
registry_list_reposLista repositórios do container registry
registry_list_tagsLista tags de uma imagem de container
registry_check_imageVerifica detalhes da imagem (tamanho, camadas, data de criação)
registry_delete_tagExclui uma tag de imagem obsoleta (requer confirmed=True)

HPE VME / Morpheus (13 ferramentas)

FerramentaDescrição
vme_list_instancesLista todas as VMs gerenciadas pelo HPE VME
vme_get_instanceObtém status detalhado e configuração de uma VM
vme_list_serversLista hosts físicos com CPU/memória
vme_list_cloudsLista clouds/zonas configurados (KVM, VMware)
vme_start_instanceInicia uma instância parada
vme_stop_instancePara uma instância em execução
vme_restart_instanceReinicia uma instância
vme_create_snapshotCria um snapshot (pré-migração)
vme_list_snapshotsLista snapshots de uma instância
vme_convert_imageConverte formato de disco (vmdk → qcow2) — migração VMware
vme_list_virtual_imagesLista imagens e templates disponíveis
vme_detect_vm_wasteDetecta VMs paradas/ociosas com recomendações
vme_get_activityLog de auditoria recente do Morpheus

Hypervisors — Proxmox, vSphere, Xen Orchestra (30 ferramentas)

Documentado por último e listado aqui por completo: estas foram registradas e servidas, mas ausentes deste README, então um leitor que contasse as seções encontraria 87 das 117 que a primeira linha promete. Agora elas somam.

Proxmox VE (5 ferramentas)

FerramentaDescrição
proxmox_list_vmsLista VMs no cluster com status e dimensionamento
proxmox_start_vmInicia uma VM parada
proxmox_stop_vmPara uma VM em execução (destrutivo — requer confirmed=True)
proxmox_migrate_vmMigra uma VM para outro nó (destrutivo — requer confirmed=True)
proxmox_create_snapshotCria snapshot de uma VM antes de uma mudança arriscada

VMware vSphere (9 ferramentas)

FerramentaDescrição
vsphere_list_vmsLista VMs com estado de energia, host e recursos
vsphere_get_vmLê uma VM: estado de energia, host, vCPU, RAM, NICs
vsphere_get_vm_metricsUso de CPU, memória e disco de uma VM
vsphere_list_hostsLista hosts ESXi com capacidade
vsphere_start_vmLiga uma VM
vsphere_stop_vmDesliga uma VM (destrutivo — requer confirmed=True)
vsphere_restart_vmReinicia uma VM (destrutivo — requer confirmed=True)
vsphere_migrate_vmFaz vMotion de uma VM para outro host (destrutivo — requer confirmed=True)
vsphere_create_snapshotCria snapshot de uma VM

Xen Orchestra / XCP-ng (15 ferramentas)

FerramentaDescrição
xo_list_vmsLista VMs em todos os pools
xo_start_vmInicia uma VM
xo_stop_vmDesliga uma VM de forma limpa (destrutivo — requer confirmed=True)
xo_migrate_vmMigra uma VM para outro host (destrutivo — requer confirmed=True)
xo_snapshot_vmCria snapshot de uma VM
xo_list_srsLista repositórios de armazenamento — planejamento de capacidade antes de uma migração
xo_list_tasksTarefas XO em execução
xo_list_backupsLista jobs de backup configurados
xo_run_backupExecuta um job de backup agora
xo_restore_backupRestaura uma VM de um backup (destrutivo — requer confirmed=True)
xo_rolling_pool_updateAplica patch em cada host do pool, um por vez (destrutivo — requer confirmed=True)
xo_v2v_list_esxiLista hosts ESXi alcançáveis, para migração VMware
xo_v2v_list_vmware_vmsLista as VMs em um host ESXi
xo_v2v_migrateMigra uma VM VMware para XCP-ng (destrutivo — requer confirmed=True)
xo_v2v_statusAcompanha uma migração V2V em andamento

Cross-hypervisor

FerramentaDescrição
get_vm_usageUso e custo de VMs em todos os hypervisors declarados

Configuração (3 ferramentas)

FerramentaDescrição
set_cluster_rateDefine a taxa de custo de GPU para um cluster (somente admin)
register_gatewayRegistra um novo gateway (retorna token de uso único)
delete_gatewayRevoga um gateway

Plano de Controle de Infraestrutura de Agentes (12 ferramentas)

A camada que faltava entre seus agentes de IA e sua frota de GPUs. Funciona com qualquer framework (n8n, LangChain, CrewAI, Dify) — basta apontar para o VibOps LLM Proxy.

FerramentaDescrição
FinOps por agente
get_agent_usageCusto de GPU por agente — tokens, requisições, custo, GPU-horas. "Qual agente custa mais?"
get_agent_usage_detailDetalhamento de um agente — divisão diária, distribuição de modelos, tendência de custo
get_agent_budgetOrçamento atual + gasto MTD de um agente
set_agent_budgetDefine limite mensal de gastos — alerta suave em 80%, bloqueio rígido em 100% (HTTP 429)
Controle de acesso a modelos
get_agent_model_rulesLista regras de acesso a modelos — qual agente pode usar qual LLM
update_agent_model_ruleCria uma regra: padrões glob, deny-first. "Agentes RH → somente Mistral"
Ciclo de vida de identidade
list_agent_identitiesLista identidades de máquina para agentes
create_agent_identityCria uma nova identidade de máquina (chave exibida uma única vez)
rotate_agent_identityRotaciona a chave de uma identidade existente
revoke_agent_identityRevoga uma identidade imediatamente
Grafo de dependências
get_agent_dependency_graphGrafo completo da organização: agente→modelo, agente→conector, agente→sub-agente
get_agent_dependenciesDependências de um agente — análise de impacto antes da migração

Governança e Conformidade (21 ferramentas)

FerramentaDescrição
list_anomaliesLista anomalias de GPU com filtro opcional de cluster/status
get_open_anomaliesObtém todas as anomalias atualmente abertas
resolve_anomalyMarca uma anomalia como resolvida
list_compliance_controlsLista controles de conformidade (filtro por framework)
get_compliance_scoreObtém a pontuação de conformidade para um framework (ou todos)
update_compliance_controlAtualiza status, notas ou URL de evidência de um controle
list_compliance_reportsLista relatórios de conformidade gerados
generate_compliance_reportGera um relatório SOC 2, RGPD ou HIPAA de forma assíncrona
get_compliance_reportConsulta/recupera um relatório de conformidade gerado
list_audit_logsConsulta o log de auditoria imutável com filtros
verify_audit_chainVerifica a integridade HMAC-SHA256 de toda a cadeia de auditoria
get_policyObtém a política atual da organização
update_policySubstitui a política da organização (efeito imediato)
list_eval_rubricsLista rubricas de avaliação LLM-como-juiz
evaluate_jobDispara avaliação LLM-como-juiz para um job
get_job_evaluationsRecupera resultados de avaliação de um job
get_ldap_configObtém configuração de LDAP / Active Directory
update_ldap_configConfigura ou habilita/desabilita integração LDAP
get_siem_configObtém configuração de exportação SIEM push
update_siem_configDefine destino SIEM Splunk/Datadog
push_to_siemExporta eventos de auditoria para o SIEM configurado

GPU FinOps (4 ferramentas)

FerramentaDescrição
get_budgetObtém orçamento atual de GPU e gasto consumido
get_chargebackObtém detalhamento de chargeback por tenant para um mês específico
get_spend_trendObtém tendência diária de gastos com GPU (padrão: últimos 30 dias)
get_waste_analysisIdentifica recursos de GPU ociosos e oportunidades de otimização de custos

LLM Inference Proxy

O VibOps inclui um proxy transparente compatível com OpenAI (porta 8004) que fica entre seus agentes de IA e servidores de inferência LLM (vLLM, Ollama, TGI). Cada requisição de inferência é registrada com atribuição de agente para FinOps.

Seus agentes apontam para o proxy em vez do LLM diretamente:

# Before
OPENAI_BASE_URL=http://vllm:8000/v1

# After
OPENAI_BASE_URL=http://vibops-proxy:8004/v1

Adicione um cabeçalho X-VibOps-Agent-Id para atribuir custos por agente:

curl -X POST http://vibops-proxy:8004/v1/chat/completions \
  -H "X-VibOps-Agent-Id: pricing-agent-v2" \
  -H "X-VibOps-Team: supply-chain" \
  -d '{"model": "mistral:7b", "messages": [...]}'

O proxy captura: ID do agente, equipe, modelo, tokens, latência, custo de GPU — visível no painel FinOps do console e consultável via get_agent_usage.

Exemplos de prompts

"Clone my repo and deploy it on the GPU cluster."
"Deploy llama3:8b on vibops-dev with 2 replicas."
"Scale the inference deployment to 4 replicas on prod-cluster."
"What's our GPU utilisation trend over the last 7 days?"
"Show me the cost breakdown per cluster this week."
"Which clusters have open critical GPU alerts?"
"Are there any open GPU anomalies right now?"
"Scan my infrastructure and show discovered services."
"What's our AI Act compliance score and which controls are non-compliant?"
"Generate a SOC 2 report for Q1 2026."
"Verify the audit chain hasn't been tampered with."
"Which agent costs the most in GPU this month?"
"Show me the inference cost breakdown for the pricing agent."
"Which agents depend on the claude-opus-4-6 model?"
"Create a machine identity for the pricing-agent with a 1-year expiry."
"Show me the spend trend for the last 7 days and flag any waste."

Contribuindo

Veja CONTRIBUTING.md. Todas as contribuições exigem assinatura DCO (git commit -s).

Licença

MIT — livre para usar, modificar e distribuir. Veja LICENSE.

Construído sobre FastMCP e VibOps — The AI Infrastructure Engine.