Simplescraper MCP
Extraia dados estruturados e URLs de qualquer site em segundos
Documentação
Conecte o Simplescraper ao Claude, Cursor, ChatGPT ou qualquer ferramenta de IA que suporte MCP. Uma vez conectado, seu assistente de IA pode extrair dados estruturados de qualquer página, descobrir as URLs de um site, ler páginas como Markdown limpo, criar e executar receitas de scraping e trabalhar com seus resultados anteriores de scraping - tudo a partir de um prompt de chat normal, sem precisar escrever código de scraping.
O Model Context Protocol (MCP) é o padrão aberto que essas ferramentas usam para chamar serviços externos como o Simplescraper. Se você é novo nisso, nosso guia completo do protocolo MCP cobre o básico.
URL do servidor MCP do Simplescraper:
https://mcp.simplescraper.io/mcp
O que você pode fazer
| Pergunte ao seu assistente de IA | O que o Simplescraper faz |
|---|---|
| "Extraia nomes de produtos, preços e avaliações desta página" | Extrai os campos nomeados com IA, sem necessidade de seletores CSS |
| "Encontre todas as páginas em stripe.com" | Lê o sitemap do site e retorna a lista completa de URLs (sem usar créditos) |
| "Leia esta página e resuma-a" | Busca a página e a converte em Markdown limpo |
| "Crie uma receita para nytimes.com que capture manchetes" | Cria uma nova receita de scraping que você pode reutilizar |
| "Execute meu scraper de concorrentes e mostre os novos dados" | Executa uma receita salva e retorna resultados atualizados |
| "O que mudou desde a última execução?" | Busca resultados anteriores e histórico de execuções para comparar |
| "Adicione estas URLs ao meu scraper de produtos" | Atualiza a lista de URLs em lote da receita para uma execução em massa |
Comece com a descoberta de URLs
extract_urls lê o sitemap de um site e retorna todas as URLs de páginas sem usar nenhum crédito. É um primeiro passo natural - mapeie um site e depois aponte smart_extract ou uma receita para as páginas que importam.
Configuração Rápida
Claude Desktop
- Abra as configurações do Claude Desktop
- Navegue até Configurações (canto inferior esquerdo) → Integrações
- Clique em "Adicionar servidor MCP"
- Insira estes detalhes:
- Nome: Simplescraper
- URL:
https://mcp.simplescraper.io/mcp
- URL:
- Nome: Simplescraper
- Conclua o fluxo de autenticação para conectar sua conta Simplescraper
- Comece a usar linguagem natural para controlar seus scrapings!
Disponibilidade das integrações do Claude
As integrações estão atualmente disponíveis no plano Max, com disponibilidade mais ampla em breve.
Cursor IDE
O Cursor suporta MCP com autenticação OAuth. Ao adicionar o servidor, o Cursor abrirá uma janela do navegador para você fazer login com sua conta Simplescraper.
Configuração Global (Todos os Projetos):
- Crie
~/.cursor/mcp.jsonno seu diretório inicial - Adicione esta configuração:
{
"mcpServers": {
"simplescraper": {
"url": "https://mcp.simplescraper.io/mcp"
}
}
}
- Ao ativar o servidor no Cursor, ele solicitará que você autentique com sua conta Simplescraper
Configuração Específica do Projeto:
Para ferramentas específicas de um projeto, crie um arquivo .cursor/mcp.json no diretório do seu projeto:
- Crie
.cursor/mcp.jsonna raiz do seu projeto - Use a mesma configuração JSON acima
- O servidor estará disponível apenas nesse projeto
Pela interface de Configurações do Cursor:
- Abra as Configurações do Cursor (Ctrl/Cmd +,)
- Navegue até MCP na barra lateral
- Clique em "Adicionar servidor"
- Insira:
- Nome: Simplescraper
- URL:
https://mcp.simplescraper.io/mcp
- URL:
- Nome: Simplescraper
- Quando solicitado, faça login com sua conta Simplescraper
Não adicione um cabeçalho Authorization manualmente
O Cursor lida com a autenticação automaticamente por meio de OAuth. Adicionar "headers": {"Authorization": "Bearer ..."} com sua chave de API impedirá que o fluxo de login funcione. Use a configuração acima apenas com a URL.
Outros Aplicativos de IA
A maioria dos aplicativos de IA que suportam MCP terá um processo de configuração semelhante. Procure por configurações de MCP ou "Ferramentas" e adicione a URL do nosso servidor: https://mcp.simplescraper.io/mcp
Recursos Disponíveis
O Simplescraper expõe 13 ferramentas que seu LLM pode chamar para fazer scraping de sites e gerenciar suas receitas.
Extração de Dados
| Ferramenta | O que ela faz | Exemplo de prompt |
|---|---|---|
run_recipe | Executa uma receita salva para extrair dados atualizados da URL configurada. Consome créditos. | "Execute meu scraper de perfil do Twitter agora e mostre os novos dados" |
extract_urls | Descobre todas as URLs de páginas de um site analisando seu sitemap. Grátis - sem dedução de créditos. | "Me dê uma lista de todas as páginas em stripe.com" |
extract_markdown | Busca uma página e retorna seu corpo como Markdown limpo. Ideal para ler artigos, postagens de blog, documentações ou qualquer conteúdo de página. | "Leia https://example.com/blog/post e resuma" |
smart_extract | Usa IA para extrair campos nomeados específicos de uma página (preço, título, autor, etc.) - sem necessidade de seletores CSS. | "Extraia nomes de produtos, preços e avaliações de https://example.com/products" |
get_latest_results | Obtém os dados mais recentes de scraping de uma receita (dados existentes, sem novo scraping). | "Mostre-me os resultados mais recentes do meu scraper de perfil do Twitter" |
get_results | Busca dados de uma execução de scraping específica por results_id. | "Obtenha os dados do ID de resultados abc123" |
get_results_history | Lista execuções anteriores de scraping de uma receita com carimbos de data/hora e contagens de páginas. | "Quando meu scraper da Amazon foi executado pela última vez e quantas vezes esta semana?" |
Gerenciamento de Receitas
| Ferramenta | O que ela faz | Exemplo de prompt |
|---|---|---|
list_recipes | Encontra receitas por domínio, palavra-chave no nome ou atividade recente. | "Liste todas as minhas receitas que fazem scraping de linkedin.com" |
get_recipe | Exibe detalhes completos de uma receita específica, incluindo seletores. | "Mostre-me os seletores da minha receita de rastreamento de preços da Amazon" |
create_recipe | Cria uma nova receita de scraping com seletores CSS. | "Crie uma receita para nytimes.com que capture manchetes e carimbos de data/hora" |
update_recipe | Modifica o nome, a URL ou os seletores de uma receita existente. | "O seletor de preço do meu scraper da Amazon precisa ser atualizado para .new-price-class" |
Operações em Lote
| Ferramenta | O que ela faz | Exemplo de prompt |
|---|---|---|
update_batch_urls | Adiciona ou substitui a lista de URLs para scraping em lote (crawler). Combine com extract_urls para descobrir URLs primeiro e depois run_recipe para executar. | "Adicione estas 10 URLs de produtos ao meu scraper de detalhes de produtos" |
Capturas de Tela
| Ferramenta | O que ela faz | Exemplo de prompt |
|---|---|---|
screenshot | Captura uma captura de tela de uma página e retorna uma URL de imagem hospedada. 1 crédito por solicitação. | "Tire uma captura de tela de página inteira de https://example.com" |
Exemplos de Uso Avançado
Descoberta de URLs e Scraping em Lote
"Find all product pages on example.com/shop, add them to my product scraper recipe,
and run the scrape."
O Claude analisará o sitemap, filtrará as URLs para corresponder à sua descrição (por exemplo, caminhos contendo /product/), atualizará a lista de URLs em lote e executará a receita.
Fluxos de Trabalho Complexos
"Check my Amazon price tracker recipe. If prices have changed by more than 10%
since the last run, create a summary report of the changes."
Operações de Múltiplas Etapas
"Find all recipes that haven't run in the last week, run them,
and summarize any that return errors."
Transformação de Dados
"Get the latest results from my job listings scraper and format them
as a markdown table sorted by salary."
Obtendo Ajuda
- Suporte: Entre em contato pelo chat no site do Simplescraper
- Saiba mais sobre MCP: Leia nosso guia completo do Protocolo MCP