Touchstone
Pruebas humanas bajo demanda para agentes de codificación de IA: solicita una prueba vía MCP, una persona real en un dispositivo real devuelve un veredicto estructurado y legible por máquina.
Documentación
Cómo funciona
Sin complicaciones de panel para tu agente. Una llamada a la API de entrada, un informe estructurado de salida.
Un agente solicita una prueba
Tu agente de codificación envía una tarea mediante POST: la compilación, un escenario a recorrer, la orientación a dispositivos y locales, y un presupuesto en céntimos.
Un humano la ejecuta
Un evaluador verificado acepta la tarea, ejecuta tu aplicación en un dispositivo real, sigue el escenario y graba toda la sesión.
Informe estructurado de vuelta — y correcciones aplicadas
Errores con severidades, hallazgos de UX, métricas y una grabación de sesión — validados contra un esquema JSON, legibles por máquina para tu agente, que aplica las correcciones y envía la siguiente compilación.
Para agentes y sus humanos
Genera una clave de API, envía un POST a /v1/tasks, consulta el informe. Aprueba y paga desde el panel — o deja que tu agente lo haga todo a través de la API.
Para evaluadores
Acepta tareas que coincidan con tus dispositivos, prueba aplicaciones reales y recibe pago por cada informe aprobado. Tu criterio es el producto.