Simplescraper MCP
Extrae datos estructurados y URLs de cualquier sitio web en segundos.
Documentación
Conecta Simplescraper a Claude, Cursor, ChatGPT, o cualquier herramienta de IA que soporte MCP. Una vez conectado, tu asistente de IA puede extraer datos estructurados de cualquier página, descubrir las URLs de un sitio, leer páginas como Markdown limpio, crear y ejecutar recetas de scraping, y trabajar con tus resultados de scraping anteriores, todo desde un prompt de chat normal, sin necesidad de escribir código de scraping.
Model Context Protocol (MCP) es el estándar abierto que estas herramientas usan para llamar servicios externos como Simplescraper. Si eres nuevo en esto, nuestra guía completa del protocolo MCP cubre los conceptos básicos.
La URL del servidor MCP de Simplescraper:
https://mcp.simplescraper.io/mcp
Lo que puedes hacer
| Pregunta a tu asistente de IA | Lo que hace Simplescraper |
|---|---|
| "Extrae nombres de productos, precios y valoraciones de esta página" | Extrae los campos nombrados con IA, sin necesidad de selectores CSS |
| "Encuentra todas las páginas de stripe.com" | Lee el sitemap del sitio y devuelve la lista completa de URLs (sin usar créditos) |
| "Lee esta página y resúmela" | Obtiene la página y la convierte a Markdown limpio |
| "Crea una receta para nytimes.com que capture titulares" | Construye una nueva receta de scraping que puedes reutilizar |
| "Ejecuta mi scraper de competidores y muestra los nuevos datos" | Ejecuta una receta guardada y devuelve resultados frescos |
| "¿Qué cambió desde la última ejecución?" | Obtiene resultados anteriores e historial de ejecuciones para comparar |
| "Añade estas URLs a mi scraper de productos" | Actualiza la lista de URLs por lotes de la receta para una ejecución masiva |
Comienza con el descubrimiento de URLs
extract_urls lee el sitemap de un sitio y devuelve todas las URLs de las páginas sin usar créditos. Es un primer paso natural: mapea un sitio y luego apunta smart_extract o una receta a las páginas que importan.
Configuración rápida
Claude Desktop
- Abre la configuración de Claude Desktop
- Navega a Configuración (abajo a la izquierda) → Integraciones
- Haz clic en "Añadir servidor MCP"
- Introduce estos detalles:
- Nombre: Simplescraper
- URL:
https://mcp.simplescraper.io/mcp
- URL:
- Nombre: Simplescraper
- Completa el flujo de autenticación para conectar tu cuenta de Simplescraper
- ¡Empieza a usar lenguaje natural para controlar tus scrapings!
Disponibilidad de integraciones de Claude
Las integraciones están actualmente disponibles en el plan Max, con disponibilidad más amplia próximamente.
Cursor IDE
Cursor soporta MCP con autenticación OAuth. Cuando añadas el servidor, Cursor abrirá una ventana del navegador para que inicies sesión con tu cuenta de Simplescraper.
Configuración global (todos los proyectos):
- Crea
~/.cursor/mcp.jsonen tu directorio de inicio - Añade esta configuración:
{
"mcpServers": {
"simplescraper": {
"url": "https://mcp.simplescraper.io/mcp"
}
}
}
- Cuando actives el servidor en Cursor, te pedirá que te autentiques con tu cuenta de Simplescraper
Configuración específica del proyecto:
Para herramientas específicas de un proyecto, crea un archivo .cursor/mcp.json en el directorio de tu proyecto:
- Crea
.cursor/mcp.jsonen la raíz de tu proyecto - Usa la misma configuración JSON que arriba
- El servidor solo estará disponible en ese proyecto
A través de la interfaz de configuración de Cursor:
- Abre la configuración de Cursor (Ctrl/Cmd +,)
- Navega a MCP en la barra lateral
- Haz clic en "Añadir servidor"
- Introduce:
- Nombre: Simplescraper
- URL:
https://mcp.simplescraper.io/mcp
- URL:
- Nombre: Simplescraper
- Cuando se te pida, inicia sesión con tu cuenta de Simplescraper
No añadas un encabezado de Authorization manualmente
Cursor maneja la autenticación automáticamente a través de OAuth. Añadir "headers": {"Authorization": "Bearer ..."} con tu clave API impedirá que funcione el flujo de inicio de sesión. Usa la configuración anterior con solo la URL.
Otras aplicaciones de IA
La mayoría de las aplicaciones de IA que soportan MCP tendrán un proceso de configuración similar. Busca la configuración de MCP o "Herramientas" y añade la URL de nuestro servidor: https://mcp.simplescraper.io/mcp
Capacidades disponibles
Simplescraper expone 13 herramientas que tu LLM puede llamar para hacer scraping de sitios y gestionar tus recetas.
Extracción de datos
| Herramienta | Qué hace | Ejemplo de prompt |
|---|---|---|
run_recipe | Ejecuta una receta guardada para extraer datos frescos de su URL configurada. Consume créditos. | "Ejecuta mi scraper de perfil de Twitter ahora y muéstrame los nuevos datos" |
extract_urls | Descubre todas las URLs de páginas de un sitio analizando su sitemap. Gratis: no se descuentan créditos. | "Dame una lista de todas las páginas de stripe.com" |
extract_markdown | Obtiene una página y devuelve su cuerpo como Markdown limpio. Ideal para leer artículos, entradas de blog, documentación o cualquier contenido de página. | "Lee https://example.com/blog/post y resúmelo" |
smart_extract | Usa IA para extraer campos específicos nombrados de una página (precio, título, autor, etc.), sin necesidad de selectores CSS. | "Extrae nombres de productos, precios y valoraciones de https://example.com/products" |
get_latest_results | Obtiene los datos scrapeados más recientes de una receta (datos existentes, sin nuevo scraping). | "Muéstrame los últimos resultados de mi scraper de perfil de Twitter" |
get_results | Obtiene datos de una ejecución de scraping específica por results_id. | "Obtén los datos del ID de resultados abc123" |
get_results_history | Lista ejecuciones de scraping anteriores de una receta con marcas de tiempo y recuentos de páginas. | "¿Cuándo ejecuté por última vez mi scraper de Amazon y cuántas veces esta semana?" |
Gestión de recetas
| Herramienta | Qué hace | Ejemplo de prompt |
|---|---|---|
list_recipes | Encuentra recetas por dominio, palabra clave del nombre o actividad reciente. | "Lista todas mis recetas que hacen scraping de linkedin.com" |
get_recipe | Ver detalles completos de una receta específica, incluidos los selectores. | "Muéstrame los selectores de mi receta de seguimiento de precios de Amazon" |
create_recipe | Construye una nueva receta de scraping con selectores CSS. | "Crea una receta para nytimes.com que capture titulares y marcas de tiempo" |
update_recipe | Modifica el nombre, la URL o los selectores de una receta existente. | "El selector de precio de mi scraper de Amazon necesita actualizarse a .new-price-class" |
Operaciones por lotes
| Herramienta | Qué hace | Ejemplo de prompt |
|---|---|---|
update_batch_urls | Añade o reemplaza la lista de URLs para scraping por lotes (crawler). Combínalo con extract_urls para descubrir URLs primero, y luego run_recipe para ejecutar. | "Añade estas 10 URLs de productos a mi scraper de detalles de productos" |
Capturas de pantalla
| Herramienta | Qué hace | Ejemplo de prompt |
|---|---|---|
screenshot | Captura una captura de pantalla de una página y devuelve una URL de imagen alojada. 1 crédito por solicitud. | "Toma una captura de pantalla de página completa de https://example.com" |
Ejemplos de uso avanzado
Descubrimiento de URLs y scraping por lotes
"Find all product pages on example.com/shop, add them to my product scraper recipe,
and run the scrape."
Claude analizará el sitemap, filtrará las URLs para que coincidan con tu descripción (por ejemplo, rutas que contengan /product/), actualizará la lista de URLs por lotes y ejecutará la receta.
Flujos de trabajo complejos
"Check my Amazon price tracker recipe. If prices have changed by more than 10%
since the last run, create a summary report of the changes."
Operaciones de varios pasos
"Find all recipes that haven't run in the last week, run them,
and summarize any that return errors."
Transformación de datos
"Get the latest results from my job listings scraper and format them
as a markdown table sorted by salary."
Obtener ayuda
- Soporte: Ponte en contacto a través del chat en el sitio web de Simplescraper
- Aprende más sobre MCP: Lee nuestra guía completa del Protocolo MCP