Simplescraper MCP

Extrae datos estructurados y URLs de cualquier sitio web en segundos.

Documentación

Conecta Simplescraper a Claude, Cursor, ChatGPT, o cualquier herramienta de IA que soporte MCP. Una vez conectado, tu asistente de IA puede extraer datos estructurados de cualquier página, descubrir las URLs de un sitio, leer páginas como Markdown limpio, crear y ejecutar recetas de scraping, y trabajar con tus resultados de scraping anteriores, todo desde un prompt de chat normal, sin necesidad de escribir código de scraping.

Model Context Protocol (MCP) es el estándar abierto que estas herramientas usan para llamar servicios externos como Simplescraper. Si eres nuevo en esto, nuestra guía completa del protocolo MCP cubre los conceptos básicos.

La URL del servidor MCP de Simplescraper:

https://mcp.simplescraper.io/mcp

Lo que puedes hacer

Pregunta a tu asistente de IALo que hace Simplescraper
"Extrae nombres de productos, precios y valoraciones de esta página"Extrae los campos nombrados con IA, sin necesidad de selectores CSS
"Encuentra todas las páginas de stripe.com"Lee el sitemap del sitio y devuelve la lista completa de URLs (sin usar créditos)
"Lee esta página y resúmela"Obtiene la página y la convierte a Markdown limpio
"Crea una receta para nytimes.com que capture titulares"Construye una nueva receta de scraping que puedes reutilizar
"Ejecuta mi scraper de competidores y muestra los nuevos datos"Ejecuta una receta guardada y devuelve resultados frescos
"¿Qué cambió desde la última ejecución?"Obtiene resultados anteriores e historial de ejecuciones para comparar
"Añade estas URLs a mi scraper de productos"Actualiza la lista de URLs por lotes de la receta para una ejecución masiva

Comienza con el descubrimiento de URLs

extract_urls lee el sitemap de un sitio y devuelve todas las URLs de las páginas sin usar créditos. Es un primer paso natural: mapea un sitio y luego apunta smart_extract o una receta a las páginas que importan.


Configuración rápida

Claude Desktop

  1. Abre la configuración de Claude Desktop
  2. Navega a Configuración (abajo a la izquierda) → Integraciones
  3. Haz clic en "Añadir servidor MCP"
  4. Introduce estos detalles:
    • Nombre: Simplescraper
      • URL: https://mcp.simplescraper.io/mcp
  5. Completa el flujo de autenticación para conectar tu cuenta de Simplescraper
  6. ¡Empieza a usar lenguaje natural para controlar tus scrapings!

Disponibilidad de integraciones de Claude

Las integraciones están actualmente disponibles en el plan Max, con disponibilidad más amplia próximamente.

Cursor IDE

Cursor soporta MCP con autenticación OAuth. Cuando añadas el servidor, Cursor abrirá una ventana del navegador para que inicies sesión con tu cuenta de Simplescraper.

Configuración global (todos los proyectos):

  1. Crea ~/.cursor/mcp.json en tu directorio de inicio
  2. Añade esta configuración:
{
  "mcpServers": {
    "simplescraper": {
      "url": "https://mcp.simplescraper.io/mcp"
    }
  }
}
  1. Cuando actives el servidor en Cursor, te pedirá que te autentiques con tu cuenta de Simplescraper

Configuración específica del proyecto:

Para herramientas específicas de un proyecto, crea un archivo .cursor/mcp.json en el directorio de tu proyecto:

  1. Crea .cursor/mcp.json en la raíz de tu proyecto
  2. Usa la misma configuración JSON que arriba
  3. El servidor solo estará disponible en ese proyecto

A través de la interfaz de configuración de Cursor:

  1. Abre la configuración de Cursor (Ctrl/Cmd +,)
  2. Navega a MCP en la barra lateral
  3. Haz clic en "Añadir servidor"
  4. Introduce:
    • Nombre: Simplescraper
      • URL: https://mcp.simplescraper.io/mcp
  5. Cuando se te pida, inicia sesión con tu cuenta de Simplescraper

No añadas un encabezado de Authorization manualmente

Cursor maneja la autenticación automáticamente a través de OAuth. Añadir "headers": {"Authorization": "Bearer ..."} con tu clave API impedirá que funcione el flujo de inicio de sesión. Usa la configuración anterior con solo la URL.

Otras aplicaciones de IA

La mayoría de las aplicaciones de IA que soportan MCP tendrán un proceso de configuración similar. Busca la configuración de MCP o "Herramientas" y añade la URL de nuestro servidor: https://mcp.simplescraper.io/mcp


Capacidades disponibles

Simplescraper expone 13 herramientas que tu LLM puede llamar para hacer scraping de sitios y gestionar tus recetas.

Extracción de datos

HerramientaQué haceEjemplo de prompt
run_recipeEjecuta una receta guardada para extraer datos frescos de su URL configurada. Consume créditos."Ejecuta mi scraper de perfil de Twitter ahora y muéstrame los nuevos datos"
extract_urlsDescubre todas las URLs de páginas de un sitio analizando su sitemap. Gratis: no se descuentan créditos."Dame una lista de todas las páginas de stripe.com"
extract_markdownObtiene una página y devuelve su cuerpo como Markdown limpio. Ideal para leer artículos, entradas de blog, documentación o cualquier contenido de página."Lee https://example.com/blog/post y resúmelo"
smart_extractUsa IA para extraer campos específicos nombrados de una página (precio, título, autor, etc.), sin necesidad de selectores CSS."Extrae nombres de productos, precios y valoraciones de https://example.com/products"
get_latest_resultsObtiene los datos scrapeados más recientes de una receta (datos existentes, sin nuevo scraping)."Muéstrame los últimos resultados de mi scraper de perfil de Twitter"
get_resultsObtiene datos de una ejecución de scraping específica por results_id."Obtén los datos del ID de resultados abc123"
get_results_historyLista ejecuciones de scraping anteriores de una receta con marcas de tiempo y recuentos de páginas."¿Cuándo ejecuté por última vez mi scraper de Amazon y cuántas veces esta semana?"

Gestión de recetas

HerramientaQué haceEjemplo de prompt
list_recipesEncuentra recetas por dominio, palabra clave del nombre o actividad reciente."Lista todas mis recetas que hacen scraping de linkedin.com"
get_recipeVer detalles completos de una receta específica, incluidos los selectores."Muéstrame los selectores de mi receta de seguimiento de precios de Amazon"
create_recipeConstruye una nueva receta de scraping con selectores CSS."Crea una receta para nytimes.com que capture titulares y marcas de tiempo"
update_recipeModifica el nombre, la URL o los selectores de una receta existente."El selector de precio de mi scraper de Amazon necesita actualizarse a .new-price-class"

Operaciones por lotes

HerramientaQué haceEjemplo de prompt
update_batch_urlsAñade o reemplaza la lista de URLs para scraping por lotes (crawler). Combínalo con extract_urls para descubrir URLs primero, y luego run_recipe para ejecutar."Añade estas 10 URLs de productos a mi scraper de detalles de productos"

Capturas de pantalla

HerramientaQué haceEjemplo de prompt
screenshotCaptura una captura de pantalla de una página y devuelve una URL de imagen alojada. 1 crédito por solicitud."Toma una captura de pantalla de página completa de https://example.com"

Ejemplos de uso avanzado

Descubrimiento de URLs y scraping por lotes

"Find all product pages on example.com/shop, add them to my product scraper recipe, 
and run the scrape."

Claude analizará el sitemap, filtrará las URLs para que coincidan con tu descripción (por ejemplo, rutas que contengan /product/), actualizará la lista de URLs por lotes y ejecutará la receta.

Flujos de trabajo complejos

"Check my Amazon price tracker recipe. If prices have changed by more than 10% 
since the last run, create a summary report of the changes."

Operaciones de varios pasos

"Find all recipes that haven't run in the last week, run them, 
and summarize any that return errors."

Transformación de datos

"Get the latest results from my job listings scraper and format them 
as a markdown table sorted by salary."

Obtener ayuda