MeshArc

Rastrear y extraer sitios web para obtener markdown limpio, y rastrear qué cambió entre rastreos.

Servidor MCP alojado

npx add-mcp 'https://mcp.mesharc.dev/mcp'

Se instala en Claude Code, Codex, Cursor y más

Documentación

Dale a tu asistente acceso a la web — y una memoria de cómo se veía la semana pasada.

mesharc-mcp integra MeshArc en Claude, Cursor o cualquier cliente MCP como diecisiete herramientas. Lee una página, mapea un sitio, rastrea una sección, configura un proyecto vigilado describiéndolo, y pregunta qué cambió — en inglés sencillo, sin código, y sin credenciales que el asistente deba guardar.

Obtén una clave — gratis Configúralo Paquete de Python mesharc[mcp] · la API a la que habla

16

herramientas, desde una página hasta un sitio vigilado.

1

instalación, una línea, tu clave.

0

créditos para mapear, buscar, listar o cambiar configuraciones.

7

conversaciones reales abajo, resultados tal como llegaron.

01configuración

Una instalación, una línea con tu clave.

https://mcp.mesharc.dev/mcp

El servidor alojado. Pégalo como conector personalizado en Claude.ai, inicia sesión en mesharc.dev y aprueba — nada que instalar y ninguna clave que copiar. Solo lectura a menos que permitas cambios.

qué sucede después

  1. 01 Tú preguntas en el asistente, con tus palabras: "rastrea la documentación y dime qué páginas mencionan límites de tasa".
  2. 02 Él elige una herramienta de las diecisiete, completa los argumentos con lo que dijiste, y la llama a través de tu clave.
  3. 03 MeshArc hace el trabajo en nuestros servidores: la escalera de descargas, el mapa del sitio, el registro de cambios — igual que lo haría un script o la aplicación.
  4. 04 Lee la respuesta y razona sobre ella: una tabla, un resumen, una llamada de seguimiento. Un resultado largo es un índice con extractos, presupuestado en toda la respuesta, para que un turno de chat siga siendo un turno de chat.

Crea la clave en Configuración → Claves de API. Una clave read permite que el asistente mire; write le permite crear y ejecutar proyectos. Limítala a los proyectos que debería ver.

02una conversación

Describe el proyecto; el asistente lo configura.

Claude Code, con mesharc-mcp — tal como se ejecutó

you      Set up a project for hotspotseo.com that only scrapes the blog, weekly.

claude   › describe_project_config
         › map_site  url=https://hotspotseo.com/  search=blog
           538 URLs in the sitemap; the blog lives under /blogs/, not /blog/.
         › create_project  seed=https://hotspotseo.com/  schedule=weekly
                           config={"include_paths": ["/blogs/*"]}
         Done — "HotspotSEO blog" runs every Monday at 03:00 and reads only
         /blogs/… pages. Want a first run now?

you      Yes. And make it daily, skip the tag pages.

claude   › update_project  schedule=daily  config={"exclude_paths": ["/tag/*"]}
         › start_run  wait=true
         30 pages read, all under /blogs/. I'll tell you what changed after
         tomorrow's run — or ask me "what changed?" any time.

Esto es lo que "solo el blog" necesita: el asistente preguntó al servidor qué configuraciones existen (describe_project_config), miró el mapa del sitio para encontrar dónde vive realmente el blog (/blogs/, no /blog/), y estableció include_paths a un glob. La primera ejecución leyó treinta páginas del blog y nada más.

Cada nombre de configuración es exacto. Uno adivinado — includePaths — es rechazado con su nombre, para que el asistente se corrija en lugar de creer que un proyecto está configurado cuando no lo está. La lista completa está en configuración; el asistente lee la misma lista.

03las herramientas

Diecisiete herramientas, en tres tipos.

Lee la web3

Una página, muchas páginas, un documento — sin necesidad de proyecto.

scrape_urls por página

Hasta 500 URLs a markdown en una sola llamada; los archivos PDF, Word y hojas de cálculo se leen como texto.

extract_url por página

Una URL con todos los formatos: markdown, texto, HTML limpio, campos de cabecera, campos estructurados, captura de pantalla.

map_site por archivo de mapa del sitio

Cada URL que un sitio declara en sus mapas del sitio, con un filtro de búsqueda — qué tan grande es un sitio y qué secciones tiene, sin descargar una página.

Entiende un sitio3

Un sitio completo o una sección de él, en una sola pregunta.

crawl_site por página

Rastrea un sitio una vez, hasta un límite y profundidad, con globs de inclusión y exclusión; devuelve las páginas cuando termina.

search_pages gratis

Busca dentro de un rastreo: cada palabra, una "frase entre comillas", o un selector CSS.

get_page gratis

Una página almacenada por sí sola, cada cuerpo de hasta 12,000 caracteres, con sus versiones a lo largo de las ejecuciones.

Vigila cambios11

La parte que ningún otro MCP de scraping hace: un sitio mantenido en el tiempo, y qué se movió.

keep_crawl_as_project gratis

Convierte un rastreo único en un proyecto vigilado con un horario. Nada se vuelve a descargar.

create_project gratis

Un proyecto desde una URL semilla, con cualquier configuración — solo una sección, un horario, un formato.

describe_project_config gratis

Cada configuración que un asistente puede establecer, qué significa, y su valor predeterminado — para que "solo el blog" se convierta en la clave correcta.

get_project gratis

Un proyecto con su configuración, horario y última ejecución.

update_project gratis

Cambia el nombre, el horario, o cualquier configuración; solo cambian las claves dadas.

list_projects gratis

Los proyectos del espacio de trabajo con los conteos de su última ejecución.

start_run por página

Rastrea un proyecto ahora; opcionalmente espera por él.

list_pages gratis

Las páginas de una ejecución: url, estado, profundidad, palabras, cuándo cambió.

get_changes gratis

Páginas añadidas, modificadas y eliminadas desde la ejecución anterior, con el registro de cambios.

recrawl_pages por página

Descarga de nuevo las páginas listadas ahora, como una ejecución comparada con la última completa.

get_job gratis

Sigue un rastreo, ejecución o lote de una herramienta larga devuelta: su estado y conteos, y las páginas una vez que termina. Para un rastreo, una página por sí sola con url=, o la siguiente ventana con cursor=.

04lo que puedes preguntar

Siete cosas que la gente pregunta, con lo que se devolvió.

Cada una de estas se ejecutó a través del servidor empaquetado contra el sitio nombrado. Los resultados son los reales.

"Obtén la página de precios de Linear y lista cada nivel y precio."

scrape_urls

1 crédito, 4 segundos: 398 palabras de markdown con los cuatro niveles — Gratis $0, Básico $10, Negocio $16 por usuario al mes, Empresa bajo petición.

"¿Cuántas páginas tiene el sitio de documentación de FastAPI, y cuáles son sobre seguridad?"

map_site

151 URLs declaradas, 9 bajo /tutorial/security/, en 1.3 segundos — un crédito, ninguna página descargada.

"Configura un proyecto para hotspotseo.com que solo rastree el blog, semanalmente."

describe_project_configmap_sitecreate_project

El asistente encontró que el blog vive bajo /blogs/ (538 URLs del mapa del sitio), no /blog/, creó el proyecto con include_paths ["/blogs/*"] los lunes, y la primera ejecución leyó 30 páginas del blog y nada más.

"Hazlo diario en su lugar, y omite las páginas de etiquetas y autores."

update_project

Horario diario a las 03:00, exclude_paths ["/tag/*", "/author/*"]; el include se mantuvo. Una clave adivinada (includePaths) es rechazada con su nombre, no descartada en silencio.

"Revisa de nuevo la página de inicio y la página 2 de quotes.toscrape.com ahora — ¿qué cambió?"

recrawl_pagesget_changes

Una ejecución de dos páginas en 5 segundos; una página cambió, con el registro de cambios para leer.

"Lee este artículo de arXiv (un PDF) y resume el método."

scrape_urls

6,036 palabras de texto del PDF por 2 créditos; el asistente resumió a partir de él.

"¿Cuáles de estas páginas mencionan GDPR pero no cookies?"

search_pages

Búsqueda de contenido sobre el rastreo almacenado, sin créditos; coincidencias con conteos por página.

05lo que no hará

Dicho claramente, para que el asistente no tenga que descubrirlo.

Páginas detrás de un inicio de sesiónEl rastreador lee lo que un visitante puede ver. Una pared de inicio de sesión vuelve como bloqueada, sin costo.

Vigilar una página cada minutoLos horarios son como mínimo cada hora; recrawl_pages es la verificación bajo demanda.

Un rastreo de 5,000 páginas dentro de un solo turno de chatcrawl_site espera el rastreo. Inicia un sitio grande como proyecto con start_run y léelo de vuelta con list_pages.

Más de lo que el plan permiteCada llamada pasa por la clave: los mismos créditos, límites y tasa que un script, y el mismo 402 cuando se agotan.

06preguntas

Preguntas.

¿Qué es MCP?

El Protocolo de Contexto de Modelo: la forma estándar en que se le dan herramientas a un asistente de IA. MeshArc se ofrece como diecisiete herramientas, ya sea alojado en mcp.mesharc.dev — inicias sesión una vez y apruebas, sin nada que instalar — o como un pequeño programa que ejecutas tú mismo y que guarda tu propia clave de API. Hablas en inglés sencillo; el asistente elige la herramienta, la llama, y razona sobre la respuesta.

¿Cuánto cuesta?

Nada más allá de los créditos que cuesta el trabajo. Una llamada de herramienta es una solicitud autenticada ordinaria a través de tu clave — los mismos créditos, límites y tasa que un script, visibles bajo Uso. Leer una página cuesta lo que cuesta el motor que la leyó; mapear, buscar, listar y cambiar configuraciones no cuesta nada.

¿El asistente ve mi clave de API?

No. Alojado, apruebas la aplicación y MeshArc le emite una clave propia, que puedes ver y revocar bajo Configuración → Claves de API; el asistente nunca maneja una credencial. Ejecutado localmente, la clave vive en el entorno del servidor en tu máquina. De cualquier manera, solo obtiene los alcances que permites — lectura, o lectura y escritura — y solo los proyectos que debería ver.

¿Puede cambiar mis proyectos?

Sí, cuando la clave tiene alcance de escritura: create_project, update_project y start_run actúan sobre el espacio de trabajo. Cada nombre de configuración es exacto — uno adivinado es rechazado con su nombre, nunca descartado en silencio — y describe_project_config le dice al asistente qué significa cada uno antes de que lo establezca.

¿Qué asistentes funcionan?

Alojado: conectores de Claude.ai y ChatGPT, Claude móvil, Claude Code, Cursor, y cualquier cliente que acepte una URL MCP remota — nada que instalar. Localmente sobre stdio: Claude Code, Claude Desktop, Cursor, Windsurf, Zed, Continue y cualquier agente que ejecute un servidor MCP, con Python 3.10 o más reciente.