Ransack
Búsqueda web y recuperación para agentes de IA, un solo endpoint MCP. 12 motores detrás de una clave: búsqueda, recuperación, descubrimiento, hosts, compras, verificación, más YouTube. $15/mes plan fijo con 500 llamadas/día: sin créditos, sin facturación por motor, las recuperaciones fallidas no cuestan nada, y cada recuperación devuelve un recibo de aprobación/rechazo para que los fallos silenciosos no te quemen. Funciona con Claude Desktop, Cursor, Cline, Windsurf, Pi, OpenCode.
Documentación
Dale a tu IA acceso a la web.
Busca, obtén y verifica con una sola clave de tarifa plana. La escalera de obtención consigue páginas que las solicitudes simples no pueden. Recibos, no veredictos.
{"mcpServers": {
"ransack": {
"url": "https://ransack.tools/mcp",
"headers": {
"Authorization": "Bearer your_key_here"
},
"type": "streamable-http"
}
}
}
Funciona con Claude Desktop · Cursor · Cline · Windsurf · Pi · OpenCode
Cada herramienta. Una clave.
Elige una herramienta. Ve la llamada, la respuesta real y cuánto cuesta en tu ventana de contexto.
searchLive
Solicitud
Respuesta
Insignia en vivo = se ejecuta contra la API real ahora mismo. Grabado = respuesta real capturada, congelada.
Una página. 2.181 tokens → 253.
Ransack devuelve los hechos extraídos, no la página cruda. Alterna para ver lo que tu agente recibe realmente.
Volcado de página cruda
2.181 tokens
Obtención de Ransack
253 tokens
88% menos contexto por los mismos hechos: espacio para 8× más páginas en la misma ventana.
{
"url": "https://acme.com/dgx-spark",
"title": "DGX Spark - Product Page",
"facts": {
"gpu": "GB10 Grace Blackwell",
"memory": "128 GB unified",
"power": "150W max TDP (240W PSU included)",
"preorders": "open"
},
"extracted_from": "specs section + JSON-LD schema",
"stripped": "nav, scripts, styles, cookie banner,
footer, marketing sections (14)",
"source_verified": true
}
Números mostrados: 2.181 → 253 tokens en una obtención real de página de producto (el recibo contundente). Intercambia el endpoint en vivo al implementar.
Páginas que las solicitudes simples no pueden tocar.
La escalera de obtención: Ransack sube peldaño a peldaño hasta que la página cede. Míralo funcionar.
1
Solicitudes simples
GET por defecto de urllib / requests, sin cabeceras, sin JS.
2
Cabeceras de nivel navegador
UA realista, Accept-Language, pistas sec-fetch.
3
Renderizado sin cabeza
Renderizado completo del navegador, JS ejecutado, diseño estabilizado.
4
Extracción a markdown
Plantilla eliminada; hechos como markdown limpio.
Cada peldaño se almacena en caché por URL+día. Tu agente ve la página o un fallo honesto: nunca un resumen alucinado.
Apúntalo a una página, o hazle una pregunta.
Obtener una página
Dale una URL y devuelve la página en sí, renderizada y extraída a markdown. Sin modelo en el camino, sin fragmento de resumen.
Investigar una pregunta
Busca de forma iterativa desde tu agente: consulta, lee, reformula, busca de nuevo y luego cita lo que usaste. (Nuestra herramienta de investigación de un solo disparo se retiró el 2026-09-20: medida contra un control sin búsqueda, rindió por debajo en precisión de múltiples saltos. Consulta el repositorio de referencia para los recibos).
Buscar en la web
Metabúsqueda entre motores cuando no tienes una URL. Superficie enlaces para que los obtengas; no reconcilia conflictos por ti.
¿Conoces tu fuente? Obténla. ¿Necesitas una respuesta citada? Busca de forma iterativa desde tu agente y cita lo que usaste.
Evaluado, no por sensaciones.
Ransack lleva a un agente del 46% al 74,5% en la misma prueba de 200 preguntas. Las respuestas se califican según si aparece el hecho verificado:
46%el agente solo, sin búsqueda
74,5%el agente + Ransack
92,5%un motor de respuestas como Perplexity Sonar: ellos escriben la respuesta, Ransack entrega las fuentes a tu agente (tabla completa en el enlace)
Ocho proveedores, un arnés, juzgado, pérdidas incluidas. Vuelve a ejecutarlo tú mismo: ransack.tools/versus · github.com/chancewalker165-dot/Ransack-bench
Empieza gratis, sin tarjeta
Prueba
$0
14 días · 50 llamadas/día
De pago
$15/mes
500 llamadas/día. Pueden aplicarse límites de velocidad.
Empieza gratis, mejora en la app
¿Ya tienes una clave? Inicia sesión para mejorar
Sin tarjeta de crédito para empezar. De pago es $15/mes, tarifa plana: 500 llamadas/día, 120 solicitudes/min, cada herramienta. Eso es $1 por cada 1.000 llamadas a pleno uso. Pueden aplicarse límites de velocidad.
Preguntas, respondidas con honestidad.
¿Por qué usar ransack en lugar de otras herramientas de búsqueda? ¿No es esto solo Firecrawl?
No. Firecrawl es una capa de obtención y conversión: le das una URL, devuelve markdown limpio. Si ya conoces la URL, Firecrawl es la herramienta adecuada (también lo es el modo de obtención de ransack).
Ransack es la capa antes y después de la obtención:
- Antes: una expansión de motores (Serper, Brave, DDG, Wikipedia, arXiv, más motores de descubrimiento sin clave) que encuentra las URLs en primer lugar. No le das a ransack una URL, le das una pregunta.
- Después: una escalera de obtención que prueba cada extractor y respaldo (curl_cffi, Lightpanda, Jina, Google Cache, resolutores de espejos académicos) hasta que uno gana, luego devuelve markdown limpio. Firecrawl es una obtención; la escalera de ransack es cada obtención apilada.
- El modelo de caja negra: Seis herramientas MCP simples. La expansión de motores, la escalera de obtención y el enrutamiento se consumen internamente hasta que sale un resultado limpio.
Cuándo usar cada uno: si conoces la URL y quieres markdown, usa fetch. Si tienes una pregunta y quieres una respuesta citada, usa search y deja que tu agente itere y cite. Si quieres todos los ángulos de un host (DNS, registros CT, sitemaps, archivos), usa el modo hosts. Firecrawl no tiene equivalente de nada de eso.
¿Cuánto cuesta después de la prueba y cuáles son los límites?
La prueba es gratis durante 14 días a 50 llamadas/día, sin tarjeta. De pago es $15/mes tarifa plana a 500 llamadas/día, y cada herramienta está incluida: sin precios por herramienta y sin aritmética de créditos.
Además del límite diario hay un límite de ritmo por minuto (120/min de pago, 60/min en prueba) para que un agente no pueda agotar todo lo demás en la clave. Cada respuesta informa tu margen restante, y cuando lo superas, el error -32029 lleva un retry_after_s que puedes respetar.
Pasado el límite, las llamadas fallan rápido con la razón adjunta. Nada se descarta silenciosamente ni se degrada sin aviso.
¿Registras mis consultas o las páginas que obtienes?
Search y fetch son de paso directo por defecto: la respuesta vuelve y no se guarda nada sobre tu consulta. Cuatro funciones sí almacenan contenido, y la página de privacidad las nombra con precisión: informes de investigación (para que get_report pueda devolverlos), la transcripción compartida y los cachés de páginas, y el índice de memoria semántica por clave.
Siempre almacenado: tu dirección de correo electrónico (verificación de registro e identificación de cuenta) y recuentos de llamadas por herramienta por clave (límites de velocidad y seguimiento de costos). Las IPs de registro se almacenan como un hash unidireccional con sal; las filas nuevas desde el 17 de septiembre de 2026 contienen solo el hash, y la página de privacidad declara claramente que algunas filas heredadas podrían contener aún la dirección cruda.
El detalle completo, incluidas las excepciones, está en la página de privacidad.
¿Ejecuta ransack proxies?
No. El pipeline está diseñado para funcionar sin un grupo de IPs. El manejo anti-bot proviene de la suplantación de TLS de navegador, niveles de navegador sin cabeza y respaldos de contenido degradado (Google Cache, feeds RSS/Atom, Jina). La obtención con proxy existe solo como niveles de proveedor de pago opcionales (p. ej., Nimble), cuyas claves no son necesarias para que el pipeline funcione.
¿Busca la respuesta, o rastrea y extrae enlaces?
Está conectado a MCP, así que tu agente decide. Search supera URLs candidatas cuando no conoces la fuente; fetch devuelve una página conocida como markdown limpio; para una respuesta citada, tu agente ejecuta search de forma iterativa y cita lo que usó. ¿Conoces tu fuente? Obténla. ¿Necesitas una respuesta citada? Itera la búsqueda. Search es el punto de partida, no el respaldo.
¿Qué sucede cuando una página no se puede leer?
Fetch prueba una pila de métodos antes de rendirse: HTTP simple, obtenciones con suplantación de TLS, un nivel de navegador sin cabeza para páginas renderizadas en cliente, y respaldos de archivo o caché. Si todos fallan, obtienes un fallo explícito, no un resumen adivinado.
Muros conocidos, declarados claramente:
- La extracción de TikTok falla en todos los métodos que probamos.
- Las páginas de producto de Amazon y Walmart rechazan una obtención simple. Usa el modo tienda con un ASIN o URL de producto, que rodea el muro a través de fuentes toleradas y las etiqueta como tales.
- Los muros de pago duros no se evitan. Trata un dominio con muro de pago como inalcanzable en lugar de esperar una solución.
- Las páginas muertas informan su estado HTTP en lugar de devolver un shell de 404 suave como contenido.
¿Cómo puedo evaluarlo yo mismo?
Cómo calificamos: las mismas preguntas para cada proveedor, respuestas juzgadas según si aparece el hecho verificado. Método completo y tablas: ransack.tools/versus. ¿No tienes claro un modo o parámetro? Llama a ransack con mode=help.