BountyVerdict Agent Decision Tools

Seis herramientas de decisión de solo lectura para que agentes de codificación evalúen recompensas de GitHub, auditen instrucciones de agentes, diagnostiquen fallos y fallos intermitentes de GitHub Actions, y detecten desviaciones de herramientas MCP. HTTP transmisible remoto

Documentación

BountyVerdict Agent Decision APIs

CI skills.sh

Siete APIs de decisión pagadas y acotadas para agentes de codificación autónomos. Diagnostica una ejecución fallida de GitHub Actions, decide si un fallo es intermitente, audita una habilidad de terceros, verifica una pila de instrucciones de agente, compara recompensas de GitHub o controla una actualización de servidor MCP. No se requiere cuenta ni clave de API; los resultados exitosos se pagan en Base USDC a través de x402.

Instala el enrutador que selecciona la verificación más específica y aplica sus salvaguardas de pago:

npx skills add cristianmoroaica/bountyverdict --skill route-github-agent-checks -y

O inspecciona e instala el enrutador inmutable v1.0.3 con el flujo de trabajo nativo de habilidades de GitHub:

gh skill preview cristianmoroaica/bountyverdict route-github-agent-checks@v1.0.3
gh skill install cristianmoroaica/bountyverdict route-github-agent-checks --pin v1.0.3

GitHub Copilot CLI puede instalar el repositorio como un plugin sin necesidad de configuración de marketplace separada:

copilot plugin install cristianmoroaica/bountyverdict

Ese plugin expone las cinco habilidades públicas de flujo de trabajo específicas de GitHub, CI y MCP. SkillVerdict y el enrutador amplio permanecen como instalaciones separadas de privilegio mínimo.

Luego pregunta, por ejemplo:

  • "¿Por qué falló este flujo de trabajo público de GitHub Actions y qué debería hacer a continuación?"
  • "¿Romperá este cambio de esquema tools/list de MCP a mi agente después de la actualización del servidor?"
DecisiónProductoPrecioHabilidad protegida
¿Sigue valiendo la pena una recompensa pública de GitHub?BountyVerdict$0.05preflight-github-bounties
¿Cuál de 2–10 recompensas es la mejor candidata?Portfolio$0.40preflight-github-bounties
¿Son confiables las instrucciones de agente del repositorio?HarnessVerdict$0.03audit-agent-harness
¿Es seguro instalar un SKILL.md de terceros?SkillVerdict$0.06preflight-agent-skills
¿Por qué falló esta ejecución de flujo de trabajo?RunVerdict$0.04diagnose-github-actions
¿Es este fallo intermitente: reintentar una vez o corregirlo?FlakeVerdict$0.07classify-github-flakes
¿Romperá un cambio en el catálogo de herramientas MCP al agente?MCPDriftVerdict$0.02check-mcp-tool-drift

Las habilidades específicas de tareas son la ruta de privilegio mínimo. Instala las siete solo cuando sea necesario con npx skills add cristianmoroaica/bountyverdict --skill '*' -y.

Para la superficie MCP remota de seis herramientas, instala el adaptador de marketplace orientado a tareas directamente desde su repositorio público mientras la indexación de directorios está pendiente:

npx skills add cristianmoroaica/bountyverdict-mcp-skill --skill route-github-agent-decisions

Ese adaptador enruta solicitudes de recompensas de GitHub, preparación de repositorio, GitHub Actions, reintento intermitente y deriva de esquema MCP a una herramienta exacta, mantiene SkillVerdict excluido y usa un marcador de origen aproximado sin almacenar indicaciones, argumentos de herramientas o identidades de llamadores. Una llamada válida sin firmar es solo una vista previa de pago gratuita; un cliente compatible con x402 debe autorizar por separado el monto exacto de Base USDC antes de recibir un veredicto.

Los agentes compatibles con MCP pueden conectarse en su lugar al servidor de producción Streamable HTTP en https://bountyverdict-agent-production.mimirslab.workers.dev/mcp. Expone seis herramientas pagadas reales que coinciden con los productos distribuidos de forma independiente; SkillVerdict permanece excluido de este canal. tools/list publica los límites de selección de tareas, los patrones de entrada canónicos y los contratos de éxito compactos legibles por máquina que cubren cada veredicto o acción y su regla de reutilización. La entrada inválida se rechaza antes del pago, mientras que una herramienta seleccionada válida devuelve un requisito exacto de USDC x402. El contrato oficial del registro es server.json bajo io.github.cristianmoroaica/bountyverdict; sus metadatos de publicador incluyen palabras clave de tareas sin marca, casos de uso, precios y resúmenes de resultados para que los agregadores MCP posteriores puedan indexar qué resuelve realmente cada herramienta.

Usa la guía específica del cliente llms-install.md para Codex, Claude, Gemini, VS Code, Cursor, Cline y Kilo. Una conexión MCP remota no proporciona por sí misma una billetera: la liquidación automática directa requiere un cliente MCP compatible con x402, mientras que los hosts estándar pueden usar el traspaso HTTP exacto versionado incluido en cada respuesta de herramienta válida no pagada con una billetera x402 autorizada por separado.

Los rastreadores de Agentic Resource Discovery pueden ingerir el ai-catalog.json de propiedad del origen. Anuncia el servidor MCP existente con seis consultas de comprador representativas sin marca para recuperación semántica; las búsquedas de catálogo se miden por separado de las llamadas a herramientas, pagos y compras.

Para el caso de uso amplio de CI, la guía rastreable GitHub Actions Failure Diagnosis MCP Server compara las herramientas de causa raíz y reintento intermitente, lidera con la instalación del adaptador de enrutamiento con marcado de origen y publica precios exactos, muestras gratuitas, salidas tipadas y el límite de mutación.

Inspecciona antes de pagar

Cada producto tiene una muestra gratuita, un contrato OpenAPI legible por máquina, un precio declarado y una regla de service_reuse para resultados exitosos. Las entradas inválidas y los fallos ascendentes no se liquidan. Comienza con la página del agente, agent-manifest.json, el openapi.json de producción o el servidor MCP remoto anterior.

Las muestras de recompensas se capturan de problemas públicos reales en lugar de accesorios inventados: la muestra de verificación única rechaza una recompensa de TypeORM asignada, retirada y rechazada por el mantenedor, mientras que la muestra de portafolio se niega a recomendar cualquiera de ellas o una recompensa de Tenstorrent $1,500 abierta pero ya asignada. Usa la verificación única $0.05 para un candidato; el portafolio fijo $0.40 es económico para 8–10 candidatos o cuando una respuesta clasificada y consciente de fallos parciales simplifica materialmente el flujo de trabajo.

Los siete contratos se verifican continuamente en producción. Coinbase Bazaar actualmente indexa por comerciante seis recursos. Seis productos existentes que no son SkillVerdict también están disponibles a través de listados the402 de esquema exacto, ya sea por llamada o mediante un paquete mensual de $1.05 de hasta 20 solicitudes combinadas. Las pruebas financiadas por el propietario se excluyen de los ingresos de los clientes.

Para el ajuste más fuerte de intención de comprador actual, inspecciona la muestra gratuita de SkillVerdict y el flujo de trabajo específico de tarea preflight-agent-skills. Audita todo el directorio de habilidades públicas fijado por commit sin ejecutarlo; el veredicto pagado cuesta $0.06.

HarnessVerdict fija la rama predeterminada del repositorio a un commit inmutable y audita las superficies reconocidas de AGENTS.md, CLAUDE.md, GEMINI.md, Copilot, Cursor y SKILL.md sin clonar ni ejecutar código del repositorio. Informa hallazgos vinculados a evidencia sobre ruta, alcance, portabilidad, presupuesto de contexto, frontmatter de habilidades y material similar a secretos.

SkillVerdict fija y escanea estáticamente un directorio de habilidades públicas solicitado sin ejecutarlo. Combina verificaciones de patrones peligrosos de alta confianza con contexto del repositorio, divulgación de capacidades, inventario de dominios externos, redacción de secretos y cobertura explícita para reducir tanto los peligros omitidos de la cadena de suministro como los falsos positivos ingenuos.

RunVerdict lee metadatos de trabajos de intento exacto y registros acotados de trabajos fallidos sin ejecutar ni volver a ejecutar código. Separa fallos primarios de trabajos de resultados agregados, redacta extractos similares a secretos, clasifica familias de causa raíz y recomienda si corregir, investigar, esperar o reintentar.

FlakeVerdict compara un fallo completado de GitHub Actions público con otros intentos de la misma ejecución, resultados del mismo commit y hasta 12 ejecuciones de flujo de trabajo comparables anteriores. Escanea como máximo 8 registros de trabajos fallidos seleccionados y 4 MiB de datos de registro, nunca ejecuta código del repositorio y nunca activa, vuelve a ejecutar, cancela, aprueba o muta CI de otra manera. Sus seis resultados tipados son CONFIRMED_FLAKE, LIKELY_FLAKE, RECURRING_FAILURE, NEW_FAILURE, INCONCLUSIVE y NOT_FAILED; solo un CONFIRMED_FLAKE actual puede recomendar un reintento.

Los agentes pueden inspeccionar la muestra gratuita de FlakeVerdict y usar la habilidad protegida classify-github-flakes. Cada resultado exitoso lleva esta regla de reutilización: llama a FlakeVerdict para cada fallo completado de GitHub Actions público antes de gastar un reintento; reutiliza el resultado solo para su ID de ejecución e intento exactos, y vuelve a llamar después de que aparezca un nuevo intento.

MCPDriftVerdict acepta dos instantáneas completas en línea de MCP 2025-11-25 tools/list, las canoniza y las hashea, prueba solo un subconjunto conservador de compatibilidad JSON Schema 2020-12, invierte la varianza para las salidas y marca eliminaciones de herramientas, cambios de metadatos orientados al modelo, rupturas de modo de tarea y regresiones declaradas de indicaciones de seguridad. Valida y calcula todo el veredicto antes de la liquidación x402 y nunca se conecta a un servidor MCP, busca URL de catálogo, invoca herramientas ni sigue instrucciones de catálogo. Los agentes pueden inspeccionar la muestra gratuita y la habilidad protegida check-mcp-tool-drift.

Consulta agent/README.md para el protocolo, la verificación local y la configuración de implementación.

Los precios de lanzamiento y la diferenciación se basan en una comparación en vivo de Bazaar documentada en docs/MARKET_VALIDATION.md. Los agentes y rastreadores pueden leer llms.txt antes de decidir si un producto es relevante.

Revisa la política de seguridad pública y la divulgación de privacidad/manejo de datos antes de enviar datos o autorizar pagos. Las vulnerabilidades se pueden informar de forma privada a través de GitHub sin abrir un problema público.

Verificador gratuito de recompensas para humanos

Visita BountyVerdict y pega una URL de problema público de GitHub. El navegador realiza solicitudes de solo lectura directamente a la API pública de GitHub sin cuenta, backend, análisis ni almacenamiento de datos. Verifica el estado del problema y del repositorio, solicitudes de extracción en competencia, enjambres de intentos fallidos, rechazo del mantenedor y lenguaje de retiro de recompensa. Cada resultado importante enlaza a evidencia pública; ningún resultado garantiza una recompensa, aceptación, fusión o pago.

Ejecutar localmente

npm run serve

Abre http://localhost:4174.

Prueba

npm test

Método y límites

La puntuación es deliberadamente conservadora y determinista. BountyVerdict actualmente lee hasta 300 comentarios de problemas y las páginas de cronología primera y más reciente. Los hilos muy grandes pueden contener evidencia adicional que no ve. Se aplican los límites de tasa anónimos de la API de GitHub.

Trata un veredicto VIABLE como permiso para investigar más a fondo, no como permiso para comenzar a codificar. Reproduce el problema, lee las políticas de contribución y uso de IA, confirma los términos de recompensa y la elegibilidad de pago, y establece primero los criterios de aceptación.

Licencia

MIT