Mimir’s Lab BountyVerdict

Decisiones MCP de solo lectura y de pago para fallos de GitHub Actions, seguridad de recompensas, preparación de agentes de repositorio y desviación de esquemas MCP.

Documentación

BountyVerdict — Diagnóstico de GitHub Actions y Habilidades de Agente

CI skills.sh placement

Install BountyVerdict MCP in VS Code

El botón añade un selector gratuito y seis herramientas de decisión de pago a VS Code. El selector devuelve de forma determinista la herramienta de pago exacta, el precio, la muestra y la entrada requerida sin producir un veredicto ni solicitar pago. Las llamadas de pago aún requieren una billetera x402 autorizada por separado; instalar, listar o usar el selector no cobra nada.

Inicio rápido de pago: inspecciona y limita un pago x402, o sigue el traspaso de llamadas de pago MCP. Instalar la habilidad, listar herramientas y usar el selector es gratuito.

Siete APIs de decisión acotadas y de pago para agentes de codificación autónomos, disponibles como Habilidades de Agente instalables y un servidor remoto de Protocolo de Contexto de Modelo (MCP). Diagnostica una ejecución fallida de GitHub Actions, decide si un fallo es intermitente, audita una habilidad de terceros, verifica una pila de instrucciones de agente, compara recompensas de GitHub o controla una actualización de servidor MCP. No se requiere cuenta ni clave API; los resultados exitosos se pagan en Base USDC a través de x402.

Instala el enrutador que selecciona la verificación más específica y aplica sus salvaguardas de pago:

npx skills add Mimirs402/bountyverdict --skill route-github-agent-checks -y

GitHub Copilot CLI puede instalar el repositorio como un plugin sin configuración separada de marketplace:

copilot plugin install Mimirs402/bountyverdict

Ese plugin expone las cinco habilidades públicas de flujo de trabajo de GitHub, CI y MCP específicas de tareas. SkillVerdict y el enrutador amplio permanecen como instalaciones separadas de menor privilegio.

Luego pregunta, por ejemplo:

  • "¿Por qué falló este flujo de trabajo público de GitHub Actions y qué debería hacer a continuación?"
  • "¿Romperá este cambio de esquema tools/list de MCP a mi agente después de la actualización del servidor?"
DecisiónProductoPrecioHabilidad protegida
¿Sigue valiendo la pena perseguir una recompensa pública de GitHub?BountyVerdict$0.05preflight-github-bounties
¿Cuál de 8–10 recompensas es la mejor, o necesito una respuesta clasificada para 2–7?Portfolio$0.40preflight-github-bounties
¿Son fiables las instrucciones de agente del repositorio?HarnessVerdict$0.03audit-agent-harness
¿Es seguro instalar un SKILL.md de terceros?SkillVerdict$0.06preflight-agent-skills
¿Por qué falló esta ejecución de flujo de trabajo?RunVerdict$0.04diagnose-github-actions
¿Es este fallo intermitente: reintentar una vez o corregirlo?FlakeVerdict$0.07classify-github-flakes
¿Romperá un cambio en el catálogo de herramientas MCP al agente?MCPDriftVerdict$0.02check-mcp-tool-drift

Las habilidades específicas de tareas son la ruta de menor privilegio. Instala las siete solo cuando sea necesario con npx skills add Mimirs402/bountyverdict --skill '*' -y.

Para la superficie MCP remota de siete herramientas, instala el adaptador de marketplace centrado en tareas directamente desde su repositorio público mientras el indexado de directorios está pendiente:

npx skills add Mimirs402/bountyverdict-mcp-skill --skill route-github-agent-decisions

Ese adaptador enruta solicitudes de recompensas de GitHub, preparación de repositorios, GitHub Actions, reintentos intermitentes y deriva de esquema MCP a una herramienta exacta, mantiene SkillVerdict excluido y usa un marcador de origen aproximado sin almacenar indicaciones, argumentos de herramientas o identidades de llamantes. Una llamada válida sin firmar es solo una vista previa de pago gratuita; un cliente compatible con x402 debe autorizar por separado la cantidad exacta de Base USDC antes de recibir un veredicto.

Los agentes compatibles con MCP pueden conectarse en su lugar al servidor de producción Streamable HTTP en https://bountyverdict-agent-production.mimirslab.workers.dev/mcp. Expone el selector gratuito choose_github_agent_decision más seis herramientas de pago reales que coinciden con los productos distribuidos de forma independiente; SkillVerdict permanece excluido de este canal. Llama al selector con {} para un catálogo compacto de seis herramientas, o proporciona sus campos de tarea exactos existentes para una ruta económica. El catálogo incluye tareas naturales, precios exactos, campos requeridos, muestras gratuitas y una garantía explícita de que la primera cotización válida sin firmar no puede cobrar. tools/list publica límites de selección de tareas, patrones de entrada canónicos y contratos de éxito legibles por máquina y compactos que cubren cada veredicto o acción y su regla de reutilización. La entrada inválida se rechaza antes del pago, mientras que una herramienta de pago seleccionada válida devuelve un requisito exacto de USDC x402. El contrato canónico oficial del Registro es server.json bajo io.github.Mimirs402/bountyverdict; el código fuente, el soporte y las nuevas instalaciones son propiedad de Mimir's Lab. El desafío de pago también publica temporalmente la clave anterior de extensión de traspaso para que los clientes ya instalados sigan funcionando durante la migración.

Usa la guía específica del cliente llms-install.md para Codex, Claude, Gemini, VS Code, Cursor, Cline y Kilo, o abre los instaladores HTTPS de un clic para VS Code y Cursor MCP. Una conexión MCP remota no proporciona por sí misma una billetera: la liquidación automática directa requiere un cliente MCP compatible con x402, mientras que los hosts estándar pueden usar el traspaso HTTP exacto versionado incluido en cada respuesta de herramienta no pagada válida con una billetera x402 autorizada por separado.

Los rastreadores de Descubrimiento de Recursos Agénticos pueden ingerir el ai-catalog.json propiedad del origen. Anuncia el servidor MCP existente con seis consultas de comprador representativas sin marca para recuperación semántica; las recuperaciones de catálogo se miden por separado de las llamadas de herramientas, pagos y compras.

Para el caso de uso amplio de CI, la guía rastreable Servidor MCP de Diagnóstico de Fallos de GitHub Actions compara las herramientas de causa raíz y reintento intermitente, lidera con la instalación del adaptador de enrutamiento con marcado de origen y publica precios exactos, muestras gratuitas, salidas tipadas y el límite de mutación.

Inspecciona antes de pagar

Cada producto tiene una muestra gratuita, un contrato OpenAPI legible por máquina, un precio declarado y una regla de resultado exitoso service_reuse. Las entradas inválidas y los fallos ascendentes no se liquidan. Comienza con la página de agente, agent-manifest.json, el openapi.json de producción o el servidor MCP remoto anterior.

Las muestras de recompensas se capturan de problemas públicos reales en lugar de accesorios inventados: la muestra de verificación única rechaza una recompensa de TypeORM asignada, retirada y rechazada por el mantenedor, mientras que la muestra de portafolio se niega a recomendar tanto esa como una recompensa de Tenstorrent $1,500 abierta pero ya asignada. Usa la verificación única $0.05 para un candidato; el portafolio fijo $0.40 es económico para 8–10 candidatos o cuando una respuesta clasificada y consciente de fallos parciales simplifica materialmente el flujo de trabajo.

La prueba de campo dirigida por el propietario del 2026-07-22 evaluó 24 recompensas de apariencia activa y no encontró un inicio inmediato seguro. Su resultado inicial de 21 EVITAR / 3 PRECAUCIÓN expuso señales de competencia perdidas de reclamos con barra y PR vinculados a comentarios; después de la corrección probada, el mismo conjunto cerró en 23 EVITAR / 1 PRECAUCIÓN / 0 VIABLE. Este punto de referencia demuestra trabajo duplicado evitado, no demanda del cliente, conversión de compra o éxito de pago; un caso positivo VIABLE → accepted → paid sigue siendo una brecha de evidencia explícita.

Los siete contratos se verifican continuamente en producción. Coinbase Bazaar actualmente indexa seis recursos de comerciante. Los siete productos, incluido SkillVerdict, están disponibles a través de the402, NEAR Agent Market y PayanAgent con esquemas exactos específicos del marketplace y cumplimiento automatizado. El paquete mensual actual de the402 cubre los siete servicios a $1.05 por hasta 20 solicitudes combinadas. Las pruebas financiadas por el propietario están excluidas de los ingresos del cliente.

Para el ajuste más fuerte de intención de compra actual, inspecciona la muestra gratuita de SkillVerdict y el flujo de trabajo específico de tarea preflight-agent-skills. Audita todo el directorio de habilidades públicas fijado por commit sin ejecutarlo; el veredicto de pago cuesta $0.06.

HarnessVerdict fija la rama predeterminada del repositorio a un commit inmutable y audita superficies reconocidas de AGENTS.md, CLAUDE.md, GEMINI.md, Copilot, Cursor y SKILL.md sin clonar ni ejecutar código del repositorio. Reporta hallazgos vinculados a evidencia de ruta, alcance, portabilidad, presupuesto de contexto, frontmatter de habilidad y material similar a secretos.

SkillVerdict fija y escanea estáticamente un directorio de habilidades públicas solicitado sin ejecutarlo. Combina verificaciones de patrones peligrosos de alta confianza con contexto del repositorio, divulgación de capacidades, inventario de dominios externos, redacción de secretos y cobertura explícita para reducir tanto peligros omitidos de la cadena de suministro como falsos positivos ingenuos.

RunVerdict lee metadatos de trabajos de intentos exactos y registros acotados de trabajos fallidos sin ejecutar ni volver a ejecutar código. Separa fallos primarios de trabajos de resultados agregados, redacta extractos similares a secretos, clasifica familias de causa raíz y recomienda si corregir, investigar, esperar o reintentar.

FlakeVerdict compara un fallo completado de GitHub Actions público con otros intentos de la misma ejecución, resultados del mismo commit y hasta 12 ejecuciones de flujo de trabajo comparables anteriores. Escanea como máximo 8 registros seleccionados de trabajos fallidos y 4 MiB de datos de registro, nunca ejecuta código del repositorio y nunca activa, vuelve a ejecutar, cancela, aprueba o muta CI de otra manera. Sus seis resultados tipados son CONFIRMED_FLAKE, LIKELY_FLAKE, RECURRING_FAILURE, NEW_FAILURE, INCONCLUSIVE y NOT_FAILED; solo un CONFIRMED_FLAKE actual puede recomendar un reintento.

Los agentes pueden inspeccionar la muestra gratuita de FlakeVerdict y usar la habilidad protegida clasificar fallos intermitentes de GitHub. Cada resultado exitoso lleva esta regla de reutilización: llama a FlakeVerdict para cada fallo completado de GitHub Actions público antes de gastar un reintento; reutiliza el resultado solo para su ID de ejecución e intento exactos, y vuelve a llamar después de que aparezca un nuevo intento.

MCPDriftVerdict acepta dos instantáneas completas en línea de tools/list MCP 2025-11-25, las canoniciza y las hashea, prueba solo un subconjunto conservador de compatibilidad JSON Schema 2020-12, revierte la varianza para salidas y marca eliminaciones de herramientas, cambios de metadatos orientados al modelo, rupturas de modo de tarea y regresiones declaradas de avisos de seguridad. Valida y calcula todo el veredicto antes de la liquidación x402 y nunca se conecta a un servidor MCP, recupera URLs de catálogo, invoca herramientas o sigue instrucciones de catálogo. Los agentes pueden inspeccionar la muestra gratuita y la habilidad protegida verificar deriva de herramientas MCP.

Consulta agent/README.md para el protocolo, la verificación local y la configuración de implementación.

Los precios de lanzamiento y la diferenciación se basan en una comparación en vivo de Bazaar documentada en docs/MARKET_VALIDATION.md. Los agentes y rastreadores pueden leer llms.txt antes de decidir si un producto es relevante.

Revisa la política de seguridad pública y la divulgación de privacidad/manejo de datos antes de enviar datos o autorizar pagos. Las vulnerabilidades se pueden reportar de forma privada a través de GitHub sin abrir un problema público.

Verificador gratuito de recompensas para humanos

Visita BountyVerdict y pega la URL de un problema público de GitHub. El navegador hace solicitudes de solo lectura directamente a la API pública de GitHub sin cuenta, backend, análisis o almacenamiento de datos. Verifica el estado canónico/transferido del problema, asignaciones, bloqueos suaves explícitos, comentarios autenticados de recompensas y reclamos de la App de GitHub, procedencia de recompensas, etiquetas de recompensas otorgadas, solicitudes de extracción en competencia, enjambres de intentos fallidos, rechazo del mantenedor y lenguaje de retiro de recompensas. No accede automáticamente al servicio web de Algora. Cada resultado importante enlaza a evidencia pública; ningún resultado garantiza una recompensa, aceptación, fusión o pago.

Ejecutar localmente

npm run serve

Abre http://localhost:4174.

Prueba

npm test

Método y límites

La puntuación es deliberadamente conservadora y determinista. BountyVerdict lee la primera página de comentarios más hasta dos páginas de comentarios más recientes, y hasta cuatro páginas de línea de tiempo acotadas. Reporta recuentos totales/escaneados y truncamiento, y la evidencia truncada nunca puede producir un veredicto VIABLE. Se aplican límites de tasa anónimos de la API de GitHub. Trata un veredicto de VIABLE como permiso para investigar más a fondo, no como permiso para empezar a codificar. Reproduce el problema, lee las políticas de contribución y uso de IA, confirma los términos de recompensa y la elegibilidad de pago, y establece primero los criterios de aceptación.

Licencia

MIT