Crawlwise

MCP alojado de SEO, AEO y GEO en crawlwise.site: auditorías de páginas, rastreos de sitios, accesibilidad para rastreadores de IA (GPTBot, ClaudeBot, Google-Extended), herramientas de esquema y métricas vitales. Endpoint de producción: https://crawlwise.site/mcp (HTTP transmisible, OAuth).

Servidor MCP alojado

npx add-mcp 'https://crawlwise.site/mcp'

Se instala en Claude Code, Codex, Cursor y más

Documentación

Endpoint

POST /mcp en este host. HTTP Streamable. Pasos completos para cada cliente: /agents.

Conectar (OAuth)

La URL de staging es https://stg.crawlwise.site/mcp. La de producción es https://crawlwise.site/mcp. Usa el host en el que te registraste.

codex mcp add crawlwise --url https://stg.crawlwise.site/mcp
codex mcp login crawlwise
claude mcp add --transport http crawlwise https://stg.crawlwise.site/mcp
grok mcp add --transport http crawlwise https://stg.crawlwise.site/mcp

Luego haz clic en Permitir en el navegador. Alternativa con clave: /account/api.

Reglas

Cada descripción de herramienta indica qué es lo que no mide. Los hallazgos se agrupan como prioridad / vale la pena considerar / no medido. estimate_cost nunca cobra. Las herramientas de ejecución prolongada devuelven un id de trabajo.

Herramientas

  • audit_page — Inicia una auditoría de página completa. Devuelve un job_id de inmediato. Consulta con get_audit usando ese job_id hasta que el estado sea complete. Los hallazgos se agrupan como prioridad / vale la pena considerar / no medido. NO mide posiciones de palabras clave, backlinks, tráfico ni datos de Search Console. NO inventa puntuaciones. Cada acción cita un id de verificación real.
  • get_audit — Consulta una auditoría iniciada con audit_page. Pasa el job_id. Cuando el estado sea running, vuelve a llamar. Cuando esté complete, devuelve hallazgos agrupados como prioridad / vale la pena considerar / no medido. NO inicia una nueva auditoría. NO cobra. NO inventa verificaciones. Un grupo vacío significa que no hay ninguno, no que el sitio sea perfecto.
  • check_ai_crawlers — Obtiene la URL como GPTBot, ClaudeBot y otros rastreadores de IA e informa permitido / bloqueado / desafiado / no establecido. NO mide si un modelo citaría la página, menciones de marca ni posicionamiento en ChatGPT. Un 200 es accesibilidad, no visibilidad.
  • validate_schema — Valida el marcado JSON-LD / schema.org según la elegibilidad para Rich Results. NO envía nada a Google. NO mide si los resultados enriquecidos aparecen realmente en la búsqueda. FAQPage se informa como no una oportunidad de resultado enriquecido.
  • check_vitals — Core Web Vitals mediante PageSpeed Insights para una URL y una estrategia. NO mide datos de campo (CrUX) a menos que PageSpeed los devuelva. NO audita el resto del sitio. Una métrica de laboratorio ausente es not_measured, nunca 0.
  • crawl_site — Inicia un rastreo de varias páginas de un sitio que posees. Devuelve un crawl id de inmediato. NO ejecuta verificaciones de palabras clave ni posiciones. NO rastrea todo internet; se detiene en el límite de páginas del plan. Los huérfanos son not_measured cuando el rastreo fue limitado.
  • get_crawl_issues — Hallazgos entre páginas de un rastreo finalizado: títulos duplicados, cadenas de redirección, enlaces internos rotos, huérfanos. NO inventa problemas que el rastreo no observó. Una lista vacía significa que no se encontró ninguno, no que el sitio sea perfecto.
  • get_internal_link_suggestions — Sugerencias de enlaces internos de un rastreo finalizado. Devuelve una lista vacía cuando no hay nada real que sugerir. NO genera enlaces a páginas que el rastreo nunca vio. NO reescribe tu contenido.
  • generate_schema — Genera JSON-LD para un tipo de schema.org a partir de los campos que proporciones. NO obtiene la página en vivo. NO valida elegibilidad; usa validate_schema para eso.
  • generate_meta_tags — Genera etiquetas meta HTML a partir de los campos que proporciones. NO obtiene la página en vivo. NO verifica unicidad en todo el sitio.
  • generate_robots_txt — Genera un robots.txt a partir de las reglas que proporciones. NO obtiene el robots.txt en vivo. NO demuestra que los rastreadores lo respetarán.
  • explain_finding — Detalle completo de un id de verificación de un trabajo o informe de auditoría. NO añade consejos que no estén ya en esa verificación. Si la verificación es not_measured, esa es la respuesta.
  • estimate_cost — Lo que costaría una operación en esta cuenta, en créditos. Nunca cobra. Nunca crea un trabajo. NO reserva créditos.
  • list_sites — Lista los sitios de esta cuenta. NO incluye otros usuarios. NO verifica dominios como efecto secundario.
  • get_credits — Saldo de créditos actual y gasto reciente. NO cambia el saldo. NO muestra otras cuentas.

OAuth

Descubrimiento: /.well-known/oauth-authorization-server. Manifiesto: /.well-known/mcp.json. Tarjeta de servidor: /.well-known/mcp/server-card.json.

Mantenedores: lista de verificación de directorio en mcp/directories.json en GitHub.

Habilidad

Solo Claude: npm run skill:install. Otros clientes usan MCP.

Registro

Listado en el Registro MCP oficial como site.crawlwise/crawlwise. Mantenedores: consulta docs/agents.md en el repositorio.