Searchpin
Búsqueda web autoalojada para agentes de IA: búsqueda paralela multi-motor con reordenamiento de resultados basado en embeddings. Sin claves API, pip install.
Documentación
Searchpin
Búsqueda web autoalojada para agentes de IA: cero claves API, cero coste. En 2026, el centro de gravedad del desarrollo de IA está pasando de «chatear» a la «ejecución autónoma de tareas»: los agentes locales de larga duración se están convirtiendo en la norma. Cuando un agente funciona 24/7, ninguna búsqueda web debe verse interrumpida por cuotas de API o facturación. Searchpin fue diseñado para esto desde el primer día: cero dependencias externas, cero límites de uso. Los agentes pueden buscar, obtener y verificar sin restricciones, y los desarrolladores nunca se preocupan por el coste.
Por qué Searchpin
🇨🇳 Optimizado para entornos de red chinos
Usa por defecto Baidu, Sogou, Bing CN y Bing Intl: cuatro motores de búsqueda consultados en paralelo. Funciona de forma nativa dentro de la red china, sin necesidad de proxy ni VPN. La mayoría de las alternativas extranjeras dependen de Google, DuckDuckGo o Brave, que son en gran medida inaccesibles dentro de China.
🧠 Reordenación semántica: un diferenciador que pocos ofrecen
Los resultados de los cuatro motores no se concatenan simplemente. Se fusionan y se reordenan mediante un modelo de embeddings basado en la similitud semántica con la consulta. Lo que recibe tu IA es una lista curada de resultados de alta calidad, no un montón de enlaces ruidosos. Entre los servidores de búsqueda MCP gratuitos, muy pocos ofrecen esta capacidad.
💰 Completamente gratuito, cero barreras
Sin registro de cuenta, sin solicitud de claves API, sin límites de uso. Sin dependencia de ninguna API comercial: sin riesgo de muros de pago repentinos ni restricciones de cuota. Todo el proceso se ejecuta en tu propia máquina.
🔍 Diseñado para sitios web modernos
La extracción de contenido SSR integrada puede analizar páginas renderizadas por Next.js, Nuxt y marcos similares, y extraer datos estructurados JSON-LD y microdatos. El scraping de HTML simple no obtiene nada de estos sitios.
🛡️ Detección de contaminación + verificación cruzada
Detecta y marca automáticamente los resultados no relacionados con tu consulta. Cuatro motores de búsqueda independientes proporcionan resultados verificables de forma cruzada, lo que permite a tu LLM corroborar información entre fuentes para obtener respuestas más creíbles.
⚡ Compensaciones de ingeniería deliberadas
Cada decisión de diseño se tomó pensando en el uso real:
- Consciente de tokens — Los resultados de búsqueda devuelven solo títulos, URL y fragmentos. Los datos de extracción estructurada son compactos y truncados. Tu LLM decide qué páginas merece la pena obtener completas, sin desperdiciar la ventana de contexto.
- Respuesta rápida — Cuatro motores consultados de forma asíncrona en paralelo. El tiempo total depende del motor más lento, no de la suma de los cuatro. Una búsqueda típica se completa en 1–2 segundos.
- Respetuoso con la memoria — El modelo de embeddings (~118MB) se descarga una vez a través de hf-mirror.com (espejo de HuggingFace para China) y luego se reutiliza desde la caché local.
Inicio rápido
pip install searchpin && searchpin-setup
En la primera ejecución, el modelo de embeddings (~118MB) se descarga una vez a través de hf-mirror.com (espejo de HuggingFace para China). Esa es la única configuración inicial.
Configuración
Claude Desktop / Cursor / cualquier cliente MCP
Añade a tu configuración de mcpServers:
{
"mcpServers": {
"Searchpin": {
"command": "searchpin-server",
"args": []
}
}
}
VS Code
O manualmente, añade a .vscode/mcp.json:
{
"servers": {
"Searchpin": {
"command": "searchpin-server",
"args": []
}
}
}
Docker
docker run -i --rm ghcr.io/telly6/searchpin:latest
Python API
from searchpin import SearchEngine
engine = SearchEngine()
results = engine.search("Python 3.13 新特性")
page = engine.fetch("https://docs.python.org/3/whatsnew/3.13.html")
engine.close()