scrape-do-mcp
Servidor
Documentação
scrape-do-mcp
中文文档 | English
Um servidor MCP que encapsula as APIs documentadas do Scrape.do em um único pacote: a API principal de scraping, a API de Pesquisa Google, a API de Scraper da Amazon, a API Assíncrona e um auxiliar de configuração do Modo Proxy.
Documentação oficial: https://scrape.do/documentation/
Cobertura
scrape_url: API principal do Scrape.do com renderização de JS, segmentação geográfica, persistência de sessão, capturas de tela, ReturnJSON, interações com navegador, cookies e encaminhamento de cabeçalhos.google_search: API estruturada de SERP do Google comgoogle_domain,location,uule,lr,cr,safe,nfpr,filter, paginação e HTML bruto opcional.amazon_product: Endpoint de PDP da Amazon.amazon_offer_listing: Endpoint de listagem de ofertas da Amazon.amazon_search: Endpoint de busca/categoria da Amazon.amazon_raw_html: Endpoint da Amazon com HTML bruto e segmentação geográfica.async_create_job,async_get_job,async_get_task,async_list_jobs,async_cancel_job,async_get_account: Cobertura da API Assíncrona com aliases amigáveis ao MCP e nomes de campos oficiais.proxy_mode_config: Constrói detalhes de conexão do Modo Proxy oficial, strings de parâmetros padrão e referências de certificado CA.
Notas de Compatibilidade
scrape_urlsuporta aliases amigáveis ao MCP e nomes de parâmetros oficiais:render_jsourendersuper_proxyousuperscreenshotouscreenShot
google_searchsuporta:queryouqcountryougllanguageouhldomainougoogle_domainincludeHtmlouinclude_html
async_create_jobaceita tanto campos de alias comotargets,render,webhookUrlquanto campos oficiais da API Assíncrona comoTargets,Render,WebhookURL.async_get_job,async_get_taskeasync_cancel_jobaceitam tantojobId/taskIdquanto os oficiaisjobID/taskID.async_list_jobsaceita tantopageSizequanto o oficialpage_size.- Para encaminhamento de cabeçalhos em
scrape_url, passeheadersmaisheader_mode(custom,extraouforward). - Respostas de captura de tela preservam o corpo JSON oficial do Scrape.do e também anexam conteúdo de imagem do MCP quando capturas de tela estão presentes.
scrape_urlagora usa como padrãooutput="raw"para se alinhar mais de perto à API oficial.scrape_urlinclui metadados de resposta emstructuredContent, o que ajuda a exporpureCookies,transparentResponsee respostas binárias dentro do MCP.
Instalação
Instalação Rápida
claude mcp add-json scrape-do --scope user '{
"type": "stdio",
"command": "npx",
"args": ["-y", "scrape-do-mcp"],
"env": {
"SCRAPE_DO_TOKEN": "YOUR_TOKEN_HERE"
}
}'
Claude Desktop
Adicione isto ao ~/.claude.json:
{
"mcpServers": {
"scrape-do": {
"command": "npx",
"args": ["-y", "scrape-do-mcp"],
"env": {
"SCRAPE_DO_TOKEN": "YOUR_TOKEN_HERE"
}
}
}
}
Obtenha seu token em https://app.scrape.do
Ferramentas Disponíveis
| Ferramenta | Finalidade |
|---|---|
scrape_url | Wrapper principal da API de scraping do Scrape.do |
google_search | Resultados estruturados de busca do Google |
amazon_product | Dados estruturados de PDP da Amazon |
amazon_offer_listing | Ofertas de vendedores da Amazon |
amazon_search | Resultados de palavra-chave/categoria da Amazon |
amazon_raw_html | HTML bruto da Amazon com segmentação geográfica |
async_create_job | Criar trabalhos na API Assíncrona |
async_get_job | Buscar detalhes de trabalhos assíncronos |
async_get_task | Buscar detalhes de tarefas assíncronas |
async_list_jobs | Listar trabalhos assíncronos |
async_cancel_job | Cancelar trabalhos assíncronos |
async_get_account | Buscar informações de conta/concorrência assíncronas |
proxy_mode_config | Gerar configuração do Modo Proxy |
Exemplos de Prompts
Scrape https://example.com with render=true and wait for #app.
Search Google for "open source MCP servers" with google_domain=google.co.uk and lr=lang_en.
Get the Amazon PDP for ASIN B0C7BKZ883 in the US with zipcode 10001.
Create an async job for these 20 URLs and give me the job ID.
Desenvolvimento
npm install
npm run build
npm run dev
Licença
MIT