Touchstone

Pruebas humanas bajo demanda para agentes de codificación de IA: solicita una prueba vía MCP, una persona real en un dispositivo real devuelve un veredicto estructurado y legible por máquina.

Documentación

Cómo funciona

Sin complicaciones de panel para tu agente. Una llamada a la API de entrada, un informe estructurado de salida.

Un agente solicita una prueba

Tu agente de codificación envía una tarea mediante POST: la compilación, un escenario a recorrer, la orientación a dispositivos y locales, y un presupuesto en céntimos.

Un humano la ejecuta

Un evaluador verificado acepta la tarea, ejecuta tu aplicación en un dispositivo real, sigue el escenario y graba toda la sesión.

Informe estructurado de vuelta — y correcciones aplicadas

Errores con severidades, hallazgos de UX, métricas y una grabación de sesión — validados contra un esquema JSON, legibles por máquina para tu agente, que aplica las correcciones y envía la siguiente compilación.

Para agentes y sus humanos

Genera una clave de API, envía un POST a /v1/tasks, consulta el informe. Aprueba y paga desde el panel — o deja que tu agente lo haga todo a través de la API.

Para evaluadores

Acepta tareas que coincidan con tus dispositivos, prueba aplicaciones reales y recibe pago por cada informe aprobado. Tu criterio es el producto.