Ransack

Busca e fetch na web para agentes de IA, um endpoint MCP. 12 mecanismos em uma única chave: busca, fetch, descoberta, hosts, compras, verificação, além de YouTube. US$ 15/mês fixos com 500 chamadas/dia - sem créditos, sem cobrança por mecanismo, fetches com falha não custam nada, e cada fetch retorna um recibo de aprovação/reprovação para que falhas silenciosas não te prejudiquem. Funciona com Claude Desktop, Cursor, Cline, Windsurf, Pi, OpenCode.

Documentação

Dê ao seu agente de IA o poder da web.

Pesquise, busque e verifique com uma única chave de preço fixo. A escada de busca obtém páginas que requisições simples não conseguem. Recibos, não veredictos.

{"mcpServers": {
  "ransack": {
    "url": "https://ransack.tools/mcp",
    "headers": {
      "Authorization": "Bearer your_key_here"
    },
    "type": "streamable-http"
  }
}
}

Funciona com Claude Desktop · Cursor · Cline · Windsurf · Pi · OpenCode

Todas as ferramentas. Uma única chave.

Escolha uma ferramenta. Veja a chamada, a resposta real e o custo para a sua janela de contexto.

searchLive

Requisição

Resposta

Distintivo "Ao vivo" = executa contra a API real agora. "Gravado" = resposta real capturada, congelada.

Uma página. 2.181 tokens → 253.

O Ransack retorna os fatos extraídos, não a página bruta. Alterne para ver o que seu agente realmente recebe.

Despejo da página bruta

2.181 tokens

Busca do Ransack

253 tokens

88% menos contexto para os mesmos fatos — espaço para 8× mais páginas na mesma janela.

{
  "url": "https://acme.com/dgx-spark",
  "title": "DGX Spark - Product Page",
  "facts": {
    "gpu": "GB10 Grace Blackwell",
    "memory": "128 GB unified",
    "power": "150W max TDP (240W PSU included)",
    "preorders": "open"
  },
  "extracted_from": "specs section + JSON-LD schema",
  "stripped": "nav, scripts, styles, cookie banner,
               footer, marketing sections (14)",
  "source_verified": true
}

Números exibidos: 2.181 → 253 tokens em uma busca real de página de produto (o recibo decisivo). Substitua pelo endpoint ao vivo na implantação.

Páginas que requisições simples não alcançam.

A escada de busca: o Ransack sobe degrau por degrau até a página ceder. Veja funcionando.

1

Requisições simples

GET padrão do urllib / requests, sem cabeçalhos, sem JS.

2

Cabeçalhos de nível de navegador

User-Agent realista, Accept-Language, dicas de sec-fetch.

3

Renderização headless

Renderização completa do navegador, JS executado, layout estabilizado.

4

Extração para markdown

Conteúdo supérfluo removido; fatos como markdown limpo.

Cada degrau é armazenado em cache por URL+dia. Seu agente vê a página ou uma falha honesta — nunca um resumo alucinado.

Aponte para uma página ou faça uma pergunta.

Buscar uma página

Forneça uma URL e ele retorna a própria página, renderizada e extraída para markdown. Sem modelo no caminho, sem trecho de resumo.

Pesquisar uma questão

Pesquise iterativamente a partir do seu agente: consulta, leitura, reformulação, nova pesquisa e, em seguida, cite o que usou. (Nossa ferramenta de pesquisa de etapa única foi aposentada em 20/09/2026: medida contra um controle sem pesquisa, ela teve desempenho inferior em precisão multi-etapas. Veja o repositório de benchmark para os recibos.)

Pesquisar na web

Metapesquisa entre mecanismos quando você não tem uma URL. Ela apresenta links para você buscar; não reconcilia conflitos por você.

Conhece sua fonte? Busque-a. Precisa de uma resposta citada? Pesquise iterativamente a partir do seu agente e cite o que usou.

Comprovado por benchmarks, não por impressões.

O Ransack leva um agente de 46% para 74,5% no mesmo teste de 200 perguntas. As respostas são avaliadas se o fato verificado aparece:

46% o agente sozinho, sem pesquisa

74,5% o agente + Ransack

92,5% um mecanismo de respostas como Perplexity Sonar: eles escrevem a resposta, o Ransack entrega as fontes ao seu agente (tabela completa no link)

Oito provedores, um único harness, julgados, perdas incluídas. Execute você mesmo: ransack.tools/versus · github.com/chancewalker165-dot/Ransack-bench

Comece grátis, sem cartão

Teste

$0

14 dias · 50 chamadas/dia

Obtenha uma chave gratuita

Pago

$15/mês

500 chamadas/dia. Limites de taxa ainda podem ser aplicados.

Comece grátis, faça upgrade no app

Já tem uma chave? Entre para fazer upgrade

Sem cartão de crédito para começar. O plano pago é $15/mês, fixo: 500 chamadas/dia, 120 requisições/min, todas as ferramentas. Isso equivale a $1 por 1.000 chamadas em uso pleno. Limites de taxa ainda podem ser aplicados.

Perguntas, respondidas com honestidade.

Por que usar o Ransack em vez de outras ferramentas de busca? Isso não é apenas o Firecrawl?

Não. O Firecrawl é uma camada de busca e conversão: você fornece uma URL e ele retorna markdown limpo. Se você já sabe a URL, o Firecrawl é a ferramenta certa (o modo de busca do Ransack também é).

O Ransack é a camada antes e depois da busca:

  • Antes: um fanout de mecanismos (Serper, Brave, DDG, Wikipedia, arXiv, além de mecanismos de descoberta sem chave) que encontra as URLs em primeiro lugar. Você não entrega uma URL ao Ransack, você entrega uma pergunta.
  • Depois: uma escada de busca que tenta todos os extratores e fallbacks (curl_cffi, Lightpanda, Jina, Google Cache, resolvedores de espelhos acadêmicos) até um vencer, e então retorna markdown limpo. O Firecrawl é uma única busca; a escada do Ransack é todas as buscas empilhadas.
  • O modelo de caixa-preta: Seis ferramentas MCP simples. O fanout de mecanismos, a escada de busca e o roteamento processam internamente até um resultado limpo sair.

Quando usar cada um: se você sabe a URL e quer markdown, use a busca. Se tem uma pergunta e quer uma resposta citada, use a pesquisa e deixe seu agente iterar e citar. Se quer todos os ângulos de um host (DNS, logs de CT, sitemaps, arquivos), use o modo de hosts. O Firecrawl não tem equivalente para nada disso.

Quanto custa após o teste e quais são os limites?

O teste é gratuito por 14 dias com 50 chamadas/dia, sem cartão. O plano pago é $15/mês fixo com 500 chamadas/dia, e todas as ferramentas estão incluídas: sem preço por ferramenta e sem aritmética de créditos.

Além do limite diário, há um limite de ritmo por minuto (120/min pago, 60/min no teste) para que um único agente não esgote tudo na chave. Cada resposta informa sua margem restante, e quando você excede o limite, o erro -32029 traz um retry_after_s que você pode respeitar.

Acima do limite, as chamadas falham rapidamente com o motivo anexado. Nada é descartado silenciosamente ou rebaixado sem aviso.

Vocês registram minhas consultas ou as páginas que buscam?

Pesquisa e busca são de passagem por padrão: a resposta volta e nada sobre sua consulta é mantido. Quatro recursos armazenam conteúdo, e a página de privacidade os nomeia precisamente: relatórios de pesquisa (para que get_report possa retorná-los), o cache compartilhado de transcrições e páginas, e o índice de memória semântica por chave.

Sempre armazenados: seu endereço de e-mail (verificação de cadastro e identificação de conta) e contagens de chamadas por ferramenta por chave (limite de taxa e rastreamento de custo). IPs de cadastro são armazenados como hash unidirecional com sal; novas linhas desde 17 de setembro de 2026 contêm apenas o hash, e a página de privacidade afirma claramente que algumas linhas legadas ainda podem conter o endereço bruto.

Todos os detalhes, incluindo as exceções, estão na página de privacidade.

O Ransack executa proxies?

Não. O pipeline é projetado para funcionar sem um pool de IPs. O tratamento anti-bot vem de impersonação de TLS de navegador, camadas de navegador headless e fallbacks de conteúdo degradado (Google Cache, feeds RSS/Atom, Jina). Busca via proxy existe apenas como camadas opcionais pagas de fornecedores (ex.: Nimble), cujas chaves não são necessárias para o pipeline funcionar.

Ele pesquisa pela resposta ou rastreia e extrai links?

Ele está conectado ao MCP, então seu agente decide. A pesquisa apresenta URLs candidatas quando você não conhece a fonte; a busca retorna uma página conhecida como markdown limpo; para uma resposta citada, seu agente executa a pesquisa iterativamente e cita o que usou. Conhece sua fonte? Busque-a. Precisa de uma resposta citada? Itere a pesquisa. A pesquisa é o ponto de partida, não o fallback.

O que acontece quando uma página não pode ser lida?

A busca tenta uma pilha de métodos antes de desistir: HTTP simples, buscas com impersonação de TLS, uma camada de navegador headless para páginas renderizadas no cliente e fallbacks de arquivo ou cache. Se todos falharem, você recebe uma falha explícita, não um resumo adivinhado.

Muros conhecidos, declarados claramente:

  • A extração do TikTok falha em todos os métodos que tentamos.
  • Páginas de produtos da Amazon e Walmart rejeitam uma busca simples. Use o modo de loja com um ASIN ou URL de produto, que contorna o muro por fontes toleradas e as rotula como tal.
  • Paywalls rígidos não são contornados. Trate um domínio com paywall como inacessível, em vez de esperar uma solução alternativa.
  • Páginas mortas relatam seu status HTTP em vez de retornar uma casca de erro 404 suave como conteúdo.

Como posso fazer benchmark eu mesmo?

Como avaliamos: as mesmas perguntas para cada provedor, respostas julgadas se o fato verificado aparece. Método completo e tabelas: ransack.tools/versus. Em dúvida sobre um modo ou parâmetro? Chame ransack com mode=help.