BountyVerdict Agent Decision Tools

Seis ferramentas de decisão somente leitura para agentes de codificação avaliarem recompensas do GitHub, auditarem instruções de agentes, diagnosticarem falhas e instabilidades do GitHub Actions e detectarem desvios de ferramentas MCP. Remote Streamable HTTP

Documentação

APIs de Decisão do Agente BountyVerdict

CI skills.sh

Sete APIs de decisão pagas e limitadas para agentes de codificação autônomos. Diagnostique uma execução falha do GitHub Actions, decida se uma falha é flaky, audite uma skill de terceiros, verifique uma pilha de instruções de agente, compare recompensas do GitHub ou controle uma atualização de servidor MCP. Não é necessária conta ou chave de API; resultados bem-sucedidos são pagos em Base USDC via x402.

Instale o roteador que seleciona a verificação mais restrita e aplica suas salvaguardas de pagamento:

npx skills add cristianmoroaica/bountyverdict --skill route-github-agent-checks -y

Ou inspecione e instale o roteador imutável v1.0.3 com o fluxo de skill nativo do GitHub:

gh skill preview cristianmoroaica/bountyverdict route-github-agent-checks@v1.0.3
gh skill install cristianmoroaica/bountyverdict route-github-agent-checks --pin v1.0.3

O GitHub Copilot CLI pode instalar o repositório como um plugin sem configuração separada de marketplace:

copilot plugin install cristianmoroaica/bountyverdict

Esse plugin expõe as cinco skills públicas de fluxo de trabalho específicas para tarefas do GitHub, CI e MCP. O SkillVerdict e o roteador amplo permanecem como instalações separadas de privilégio mínimo.

Depois, pergunte, por exemplo:

  • "Por que este fluxo de trabalho público do GitHub Actions falhou e o que devo fazer em seguida?"
  • "Esta mudança de esquema tools/list do MCP vai quebrar meu agente após a atualização do servidor?"
DecisãoProdutoPreçoSkill protegida
Uma recompensa pública do GitHub ainda vale a pena?BountyVerdict$0,05preflight-github-bounties
Qual de 2 a 10 recompensas é a melhor candidata?Portfolio$0,40preflight-github-bounties
As instruções de agente do repositório são confiáveis?HarnessVerdict$0,03audit-agent-harness
Uma SKILL.md de terceiros é segura para instalar?SkillVerdict$0,06preflight-agent-skills
Por que esta execução de fluxo de trabalho falhou?RunVerdict$0,04diagnose-github-actions
Esta falha é flaky: tentar novamente uma vez ou corrigir?FlakeVerdict$0,07classify-github-flakes
Uma mudança no catálogo de ferramentas do MCP vai quebrar o agente?MCPDriftVerdict$0,02check-mcp-tool-drift

As skills específicas de tarefa são o caminho de privilégio mínimo. Instale todas as sete somente quando necessário com npx skills add cristianmoroaica/bountyverdict --skill '*' -y.

Para a superfície MCP remota de seis ferramentas, instale o adaptador de marketplace com prioridade de tarefa diretamente de seu repositório público enquanto a indexação de diretório está pendente:

npx skills add cristianmoroaica/bountyverdict-mcp-skill --skill route-github-agent-decisions

Esse adaptador roteia solicitações de recompensa do GitHub, prontidão de repositório, GitHub Actions, nova tentativa flaky e deriva de esquema MCP para uma ferramenta exata, mantém o SkillVerdict excluído e usa um marcador de origem grosseiro sem armazenar prompts, argumentos de ferramenta ou identidades do chamador. Uma chamada válida não assinada é apenas uma prévia de pagamento gratuita; um cliente compatível com x402 deve autorizar separadamente o valor exato em Base USDC antes de receber um veredito.

Agentes compatíveis com MCP podem, em vez disso, conectar-se ao servidor de produção Streamable HTTP em https://bountyverdict-agent-production.mimirslab.workers.dev/mcp. Ele expõe seis ferramentas pagas reais correspondentes aos produtos distribuídos de forma independente; o SkillVerdict permanece excluído deste canal. tools/list publica limites de seleção de tarefa, padrões canônicos de entrada e contratos de sucesso compactos legíveis por máquina cobrindo cada veredito ou ação e sua regra de reutilização. Entrada inválida é rejeitada antes do pagamento, enquanto uma ferramenta selecionada válida retorna um requisito exato de USDC via x402. O contrato oficial do registro é server.json sob io.github.cristianmoroaica/bountyverdict; seus metadados de publicador incluem palavras-chave de tarefa sem marca, casos de uso, preços e resumos de resultados para que agregadores MCP downstream possam indexar o que cada ferramenta realmente resolve.

Use o guia llms-install.md específico do cliente para Codex, Claude, Gemini, VS Code, Cursor, Cline e Kilo. Uma conexão MCP remota não fornece por si só uma carteira: a liquidação automática direta requer um cliente MCP compatível com x402, enquanto hosts padrão podem usar o handoff HTTP exato com versão incluído em toda resposta de ferramenta válida não paga com uma carteira x402 autorizada separadamente.

Os rastreadores Agentic Resource Discovery podem ingerir o ai-catalog.json de propriedade da origem. Ele anuncia o servidor MCP existente com seis consultas de comprador representativas sem marca para recuperação semântica; as buscas de catálogo são medidas separadamente das chamadas de ferramenta, pagamentos e compras.

Para o caso de uso amplo de CI, o guia rastreável GitHub Actions Failure Diagnosis MCP Server compara as ferramentas de causa raiz e nova tentativa flaky, começa com a instalação do adaptador de roteamento com marcador de origem e publica preços exatos, amostras gratuitas, saídas tipadas e o limite de mutação.

Inspecione antes de pagar

Todo produto tem uma amostra gratuita, um contrato OpenAPI legível por máquina, um preço declarado e uma regra de service_reuse para resultado bem-sucedido. Entradas inválidas e falhas upstream não são liquidadas. Comece pela página do agente, agent-manifest.json, o openapi.json de produção ou o servidor MCP remoto acima.

As amostras de recompensa são capturadas de issues públicas reais, não de fixtures inventadas: a amostra de verificação única rejeita uma recompensa TypeORM atribuída, retirada e rejeitada pelo mantenedor, enquanto a amostra de portfólio se recusa a recomendar tanto ela quanto uma recompensa $1,500 do Tenstorrent aberta, mas já atribuída. Use a verificação única $0.05 para um candidato; o portfólio fixo $0.40 é econômico para 8 a 10 candidatos ou quando uma resposta classificada e ciente de falha parcial simplifica materialmente o fluxo de trabalho.

Os sete contratos são verificados continuamente em produção. O Coinbase Bazaar atualmente indexa seis recursos como comerciante. Seis produtos existentes que não são SkillVerdict também estão disponíveis por meio de listagens the402 de esquema exato, por chamada ou por um pacote mensal de $1,05 com até 20 solicitações combinadas. Provas financiadas pelo proprietário são excluídas da receita do cliente.

Para o melhor ajuste atual de intenção de compra, inspecione a amostra gratuita do SkillVerdict e o fluxo de trabalho específico de tarefa preflight-agent-skills. Ele audita todo o diretório público de skills fixado por commit sem executá-lo; o veredito pago custa $0,06.

O HarnessVerdict fixa o branch padrão do repositório em um commit imutável e audita superfícies reconhecidas de AGENTS.md, CLAUDE.md, GEMINI.md, Copilot, Cursor e SKILL.md sem clonar ou executar código do repositório. Ele relata achados com evidências vinculadas de caminho, escopo, portabilidade, orçamento de contexto, frontmatter de skill e material semelhante a segredo.

O SkillVerdict fixa e verifica estaticamente um diretório de skill público solicitado sem executá-lo. Ele combina verificações de padrões perigosos de alta confiança com contexto do repositório, divulgação de capacidades, inventário de domínios externos, redação de segredos e cobertura explícita para reduzir tanto riscos perdidos na cadeia de suprimentos quanto falsos positivos ingênuos.

O RunVerdict lê metadados de job de tentativa exata e logs limitados de jobs com falha sem executar ou reexecutar código. Ele separa falhas primárias de jobs de resultado agregado, redige trechos semelhantes a segredos, classifica famílias de causa raiz e recomenda se deve corrigir, investigar, aguardar ou tentar novamente.

O FlakeVerdict compara uma falha concluída do GitHub Actions com outras tentativas da mesma execução, resultados do mesmo commit e até 12 execuções de fluxo de trabalho comparáveis anteriores. Ele verifica no máximo 8 logs de jobs com falha selecionados e 4 MiB de dados de log, nunca executa código do repositório e nunca dispara, reexecuta, cancela, aprova ou muta o CI de qualquer outra forma. Seus seis resultados tipados são CONFIRMED_FLAKE, LIKELY_FLAKE, RECURRING_FAILURE, NEW_FAILURE, INCONCLUSIVE e NOT_FAILED; somente um CONFIRMED_FLAKE atual pode recomendar uma nova tentativa.

Os agentes podem inspecionar a amostra gratuita do FlakeVerdict e usar a skill protegida classify-github-flakes. Todo resultado bem-sucedido carrega esta regra de reutilização: chame o FlakeVerdict para toda falha concluída do GitHub Actions antes de gastar uma nova tentativa; reutilize o resultado somente para o ID de execução e tentativa exatos e chame novamente após o surgimento de uma nova tentativa.

O MCPDriftVerdict aceita dois snapshots completos inline de tools/list do MCP 2025-11-25, canonicaliza e aplica hash neles, prova apenas um subconjunto conservador de compatibilidade JSON Schema 2020-12, reverte a variância para saídas e sinaliza remoções de ferramentas, mudanças de metadados voltadas ao modelo, quebras de modo de tarefa e regressões declaradas de dicas de segurança. Ele valida e calcula todo o veredito antes da liquidação x402 e nunca se conecta a um servidor MCP, busca URLs de catálogo, invoca ferramentas ou segue instruções de catálogo. Os agentes podem inspecionar a amostra gratuita e a skill protegida check-mcp-tool-drift.

Consulte agent/README.md para o protocolo, verificação local e configuração de implantação.

Os preços de lançamento e a diferenciação são fundamentados em uma comparação ao vivo do Bazaar documentada em docs/MARKET_VALIDATION.md. Agentes e rastreadores podem ler llms.txt antes de decidir se um produto é relevante.

Revise a política de segurança pública e a divulgação de privacidade/tratamento de dados antes de enviar dados ou autorizar pagamento. Vulnerabilidades podem ser relatadas em particular pelo GitHub sem abrir uma issue pública.

Verificador gratuito de recompensas para humanos

Visite BountyVerdict e cole a URL de uma issue pública do GitHub. O navegador faz solicitações somente leitura diretamente à API pública do GitHub sem conta, backend, análise ou armazenamento de dados. Ele verifica o estado da issue e do repositório, pull requests concorrentes, enxames de tentativas com falha, rejeição do mantenedor e linguagem de retirada de recompensa. Todo resultado importante vincula-se a evidências públicas; nenhum resultado garante recompensa, aceitação, merge ou pagamento.

Executar localmente

npm run serve

Abra http://localhost:4174.

Teste

npm test

Método e limites

A pontuação é deliberadamente conservadora e determinística. O BountyVerdict atualmente lê até 300 comentários de issue e a primeira e a mais recente páginas de timeline. Threads muito grandes podem conter evidências adicionais que ele não vê. Os limites de taxa anônimos da API do GitHub se aplicam.

Trate um veredito VIABLE como permissão para investigar mais a fundo — não como permissão para começar a codificar. Reproduza a issue, leia as políticas de contribuição e uso de IA, confirme os termos da recompensa e a elegibilidade de pagamento e estabeleça critérios de aceitação primeiro.

Licença

MIT