Scrapling Fetch MCP
Obtiene HTML y markdown de sitios web con medidas anti-automatización utilizando Scrapling.
Documentación
scrapling-fetch-mcp
Ayuda a los asistentes de IA a obtener contenido de sitios web protegidos contra bots. Utiliza Scrapling (patchright + curl-cffi) para evadir las medidas anti-automatización, devolviendo HTML o Markdown limpio.
Optimizado para la recuperación de bajo volumen de documentación y materiales de referencia. No está diseñado para scraping de alto volumen ni para la recolección de datos.
Requisitos: Python 3.10+, uv
Claude Code Skill
La forma más fácil de usar esto es como una skill de Claude Code. Una vez instalada, Claude obtendrá automáticamente las URL protegidas contra bots cuando lo solicites, sin necesidad de comandos manuales.
Instalar en tu proyecto (recomendado: solo se carga en el contexto de este proyecto):
git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch .claude/skills/
rm -rf /tmp/scrapling-fetch-mcp
O instalar para todos los proyectos (se carga en el contexto en todas partes):
git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch ~/.claude/skills/
rm -rf /tmp/scrapling-fetch-mcp
La primera vez que invoques /s-fetch, Claude leerá
skills/s-fetch/references/install.md y ejecutará la configuración única
(instala la herramienta y descarga los binarios del navegador). Después de eso, solo
pregunta de forma natural:
"Fetch the docs at https://example.com/api"
"Find all mentions of 'authentication' on that page"
"Get me the installation instructions from their homepage"
Claude Desktop (servidor MCP)
Si la skill /s-fetch ya ha instalado la herramienta, ve directamente a la configuración siguiente.
De lo contrario, instala primero:
uv tool install git+https://github.com/cyberchitta/scrapling-fetch-mcp
uvx --from git+https://github.com/cyberchitta/scrapling-fetch-mcp scrapling install
Nota: La instalación del navegador descarga cientos de MB y debe completarse antes del primer uso. Si el servidor agota el tiempo de espera inicialmente, espera unos minutos e inténtalo de nuevo.
Añade esto a la configuración de MCP de Claude Desktop y reinicia:
MacOS: ~/Library/Application Support/Claude/claude_desktop_config.json
Windows: %APPDATA%\Claude\claude_desktop_config.json
{
"mcpServers": {
"scrapling-fetch": {
"command": "uvx",
"args": ["scrapling-fetch-mcp"]
}
}
}
Cómo funciona
Dos herramientas, utilizadas automáticamente por Claude:
- Obtención de páginas — recupera páginas completas con soporte de paginación
- Extracción de patrones — encuentra contenido que coincide con una expresión regular
Tres niveles de protección, escalados automáticamente:
- basic — rápido (1-2 s), funciona en la mayoría de los sitios
- stealth — moderado (3-8 s), Chromium sin interfaz
- max-stealth — exhaustivo (10 s o más), huella completa del navegador
Limitaciones
- Solo contenido de texto (documentación, artículos, referencias)
- No apto para scraping de alto volumen ni para sitios que requieran autenticación
- El rendimiento varía según la complejidad del sitio y el nivel de protección
Licencia
Apache 2.0