Scrapling Fetch MCP

Obtiene HTML y markdown de sitios web con medidas anti-automatización utilizando Scrapling.

Documentación

scrapling-fetch-mcp

License PyPI version

Ayuda a los asistentes de IA a obtener contenido de sitios web protegidos contra bots. Utiliza Scrapling (patchright + curl-cffi) para evadir las medidas anti-automatización, devolviendo HTML o Markdown limpio.

Optimizado para la recuperación de bajo volumen de documentación y materiales de referencia. No está diseñado para scraping de alto volumen ni para la recolección de datos.

Requisitos: Python 3.10+, uv

Claude Code Skill

La forma más fácil de usar esto es como una skill de Claude Code. Una vez instalada, Claude obtendrá automáticamente las URL protegidas contra bots cuando lo solicites, sin necesidad de comandos manuales.

Instalar en tu proyecto (recomendado: solo se carga en el contexto de este proyecto):

git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch .claude/skills/
rm -rf /tmp/scrapling-fetch-mcp

O instalar para todos los proyectos (se carga en el contexto en todas partes):

git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch ~/.claude/skills/
rm -rf /tmp/scrapling-fetch-mcp

La primera vez que invoques /s-fetch, Claude leerá skills/s-fetch/references/install.md y ejecutará la configuración única (instala la herramienta y descarga los binarios del navegador). Después de eso, solo pregunta de forma natural:

"Fetch the docs at https://example.com/api"
"Find all mentions of 'authentication' on that page"
"Get me the installation instructions from their homepage"

Claude Desktop (servidor MCP)

Si la skill /s-fetch ya ha instalado la herramienta, ve directamente a la configuración siguiente.

De lo contrario, instala primero:

uv tool install git+https://github.com/cyberchitta/scrapling-fetch-mcp
uvx --from git+https://github.com/cyberchitta/scrapling-fetch-mcp scrapling install

Nota: La instalación del navegador descarga cientos de MB y debe completarse antes del primer uso. Si el servidor agota el tiempo de espera inicialmente, espera unos minutos e inténtalo de nuevo.

Añade esto a la configuración de MCP de Claude Desktop y reinicia:

MacOS: ~/Library/Application Support/Claude/claude_desktop_config.json
Windows: %APPDATA%\Claude\claude_desktop_config.json

{
  "mcpServers": {
    "scrapling-fetch": {
      "command": "uvx",
      "args": ["scrapling-fetch-mcp"]
    }
  }
}

Cómo funciona

Dos herramientas, utilizadas automáticamente por Claude:

  • Obtención de páginas — recupera páginas completas con soporte de paginación
  • Extracción de patrones — encuentra contenido que coincide con una expresión regular

Tres niveles de protección, escalados automáticamente:

  • basic — rápido (1-2 s), funciona en la mayoría de los sitios
  • stealth — moderado (3-8 s), Chromium sin interfaz
  • max-stealth — exhaustivo (10 s o más), huella completa del navegador

Limitaciones

  • Solo contenido de texto (documentación, artículos, referencias)
  • No apto para scraping de alto volumen ni para sitios que requieran autenticación
  • El rendimiento varía según la complejidad del sitio y el nivel de protección

Licencia

Apache 2.0