Scrapling Fetch MCP

Obtém HTML e markdown de sites com medidas anti-automação usando Scrapling.

Documentação

scrapling-fetch-mcp

License PyPI version

Ajuda assistentes de IA a obter conteúdo de sites protegidos contra bots. Usa Scrapling (patchright + curl-cffi) para contornar medidas anti-automação, retornando HTML limpo ou Markdown.

Otimizado para recuperação de baixo volume de documentação e materiais de referência. Não foi projetado para raspagem de alto volume ou coleta de dados.

Requisitos: Python 3.10+, uv

Habilidade do Claude Code

A maneira mais fácil de usar isso é como uma habilidade do Claude Code. Uma vez instalado, o Claude buscará automaticamente URLs protegidas contra bots quando você pedir — sem necessidade de comandos manuais.

Instale no seu projeto (recomendado — carrega apenas no contexto deste projeto):

git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch .claude/skills/
rm -rf /tmp/scrapling-fetch-mcp

Ou instale para todos os projetos (carrega no contexto em qualquer lugar):

git clone --depth=1 https://github.com/cyberchitta/scrapling-fetch-mcp /tmp/scrapling-fetch-mcp
cp -r /tmp/scrapling-fetch-mcp/skills/s-fetch ~/.claude/skills/
rm -rf /tmp/scrapling-fetch-mcp

Na primeira vez que você invocar /s-fetch, o Claude lerá skills/s-fetch/references/install.md e executará a configuração única (instala a ferramenta e baixa os binários do navegador). Depois disso, basta pedir naturalmente:

"Fetch the docs at https://example.com/api"
"Find all mentions of 'authentication' on that page"
"Get me the installation instructions from their homepage"

Claude Desktop (Servidor MCP)

Se a habilidade /s-fetch já instalou a ferramenta, pule para a configuração abaixo.

Caso contrário, instale primeiro:

uv tool install git+https://github.com/cyberchitta/scrapling-fetch-mcp
uvx --from git+https://github.com/cyberchitta/scrapling-fetch-mcp scrapling install

Nota: A instalação do navegador baixa centenas de MB e deve ser concluída antes do primeiro uso. Se o servidor expirar inicialmente, aguarde alguns minutos e tente novamente.

Adicione isto às configurações MCP do seu Claude Desktop e reinicie:

MacOS: ~/Library/Application Support/Claude/claude_desktop_config.json
Windows: %APPDATA%\Claude\claude_desktop_config.json

{
  "mcpServers": {
    "scrapling-fetch": {
      "command": "uvx",
      "args": ["scrapling-fetch-mcp"]
    }
  }
}

Como Funciona

Duas ferramentas, usadas automaticamente pelo Claude:

  • Busca de páginas — recupera páginas completas com suporte a paginação
  • Extração de padrões — encontra conteúdo que corresponde a uma regex

Três níveis de proteção, escalados automaticamente:

  • basic — rápido (1-2s), funciona para a maioria dos sites
  • stealth — moderado (3-8s), Chromium sem cabeça
  • max-stealth — completo (10s+), impressão digital completa do navegador

Limitações

  • Apenas conteúdo de texto (documentação, artigos, referências)
  • Não é para raspagem de alto volume ou sites que exigem autenticação
  • O desempenho varia conforme a complexidade do site e o nível de proteção

Licença

Apache 2.0