Web Scout
Un servidor MCP para búsqueda web y extracción de contenido utilizando DuckDuckGo.
Documentación
Web Scout MCP Server
Un servidor MCP para búsqueda web mediante DuckDuckGo y extracción de contenido, con soporte para múltiples URLs y optimizaciones de memoria.
✨ Características
- 🔍 Búsqueda en DuckDuckGo: Capacidad de búsqueda web rápida y centrada en la privacidad
- 📄 Extracción de contenido: Extracción de texto limpio y legible de páginas web
- 🚀 Procesamiento paralelo: Soporte para extraer contenido de múltiples URLs simultáneamente
- 💾 Optimización de memoria: Gestión inteligente de memoria para prevenir fallos de la aplicación
- ⏱️ Limitación de velocidad: Regulación inteligente de solicitudes para evitar bloqueos de API
- 🛡️ Manejo de errores: Manejo robusto de errores para una operación confiable
📦 Instalación
Instalación mediante Smithery
Para instalar Web Scout para Claude Desktop automáticamente mediante Smithery:
npx -y @smithery/cli install @pinkpixel-dev/web-scout-mcp --client claude
Instalación global
npm install -g @pinkpixel/web-scout-mcp
Instalación local
npm install @pinkpixel/web-scout-mcp
🚀 Uso
Línea de comandos
Después de instalar globalmente, ejecuta:
web-scout-mcp
Con clientes MCP
Añade esto al config.json de tu cliente MCP (Claude Desktop, Cursor, etc.):
{
"mcpServers": {
"web-scout": {
"command": "npx",
"args": [
"-y",
"@pinkpixel/web-scout-mcp@latest"
]
}
}
}
Variables de entorno
Establece la variable de entorno WEB_SCOUT_DISABLE_AUTOSTART=1 al integrar el paquete y llamar a createServer() tú mismo. Por defecto, ejecutar el punto de entrada publicado (por ejemplo node dist/index.js o npx @pinkpixel/web-scout-mcp) inicializa automáticamente el transporte stdio.
🧰 Herramientas
El servidor proporciona las siguientes herramientas MCP:
🔍 DuckDuckGoWebSearch
Inicia una consulta de búsqueda web utilizando el motor de búsqueda DuckDuckGo y devuelve una lista bien estructurada de resultados.
Entrada:
query(string): La cadena de consulta de búsquedamaxResults(number, opcional): Número máximo de resultados a devolver (por defecto: 10)
Ejemplo:
{
"query": "latest advancements in AI",
"maxResults": 5
}
Salida: Una lista formateada de resultados de búsqueda con títulos, URLs y fragmentos.
📄 UrlContentExtractor
Obtiene y extrae contenido limpio y legible de páginas web eliminando elementos innecesarios como scripts, estilos y navegación.
Entrada:
url: Ya sea una cadena de URL única o un array de cadenas de URL
Ejemplo (URL única):
{
"url": "https://example.com/article"
}
Ejemplo (múltiples URLs):
{
"url": [
"https://example.com/article1",
"https://example.com/article2"
]
}
Salida: Contenido de texto extraído de la(s) URL(s) especificada(s).
🛠️ Desarrollo
# Clone the repository
git clone https://github.com/pinkpixel-dev/web-scout-mcp.git
cd web-scout-mcp
# Install dependencies
npm install
# Build
npm run build
# Run
npm start
📚 Documentación
Para obtener información más detallada sobre el proyecto, consulta estos recursos:
- OVERVIEW.md - Resumen técnico y arquitectura
- CONTRIBUTING.md - Directrices para colaboradores
- CHANGELOG.md - Historial de versiones y cambios
📋 Requisitos
- Node.js >= 18.0.0
- npm o yarn
📄 Licencia
Este proyecto está licenciado bajo la Licencia Apache 2.0.
Hecho con ❤️ por Pink Pixel
✨ Sueña, Pixelízalo ✨