Web Scout

Un servidor MCP para búsqueda web y extracción de contenido utilizando DuckDuckGo.

Documentación

Web Scout MCP Logo

Web Scout MCP Server

npm version License Node.js Version Smithery Badge

web-scout-mcp MCP server MseeP.ai Security Assessment Badge

Un servidor MCP para búsqueda web mediante DuckDuckGo y extracción de contenido, con soporte para múltiples URLs y optimizaciones de memoria.

✨ Características

  • 🔍 Búsqueda en DuckDuckGo: Capacidad de búsqueda web rápida y centrada en la privacidad
  • 📄 Extracción de contenido: Extracción de texto limpio y legible de páginas web
  • 🚀 Procesamiento paralelo: Soporte para extraer contenido de múltiples URLs simultáneamente
  • 💾 Optimización de memoria: Gestión inteligente de memoria para prevenir fallos de la aplicación
  • ⏱️ Limitación de velocidad: Regulación inteligente de solicitudes para evitar bloqueos de API
  • 🛡️ Manejo de errores: Manejo robusto de errores para una operación confiable

📦 Instalación

Instalación mediante Smithery

Para instalar Web Scout para Claude Desktop automáticamente mediante Smithery:

npx -y @smithery/cli install @pinkpixel-dev/web-scout-mcp --client claude

Instalación global

npm install -g @pinkpixel/web-scout-mcp

Instalación local

npm install @pinkpixel/web-scout-mcp

🚀 Uso

Línea de comandos

Después de instalar globalmente, ejecuta:

web-scout-mcp

Con clientes MCP

Añade esto al config.json de tu cliente MCP (Claude Desktop, Cursor, etc.):

{
  "mcpServers": {
    "web-scout": {
      "command": "npx",
      "args": [
        "-y",
        "@pinkpixel/web-scout-mcp@latest"
      ]
    }
  }
}

Variables de entorno

Establece la variable de entorno WEB_SCOUT_DISABLE_AUTOSTART=1 al integrar el paquete y llamar a createServer() tú mismo. Por defecto, ejecutar el punto de entrada publicado (por ejemplo node dist/index.js o npx @pinkpixel/web-scout-mcp) inicializa automáticamente el transporte stdio.

🧰 Herramientas

El servidor proporciona las siguientes herramientas MCP:

🔍 DuckDuckGoWebSearch

Inicia una consulta de búsqueda web utilizando el motor de búsqueda DuckDuckGo y devuelve una lista bien estructurada de resultados.

Entrada:

  • query (string): La cadena de consulta de búsqueda
  • maxResults (number, opcional): Número máximo de resultados a devolver (por defecto: 10)

Ejemplo:

{
  "query": "latest advancements in AI",
  "maxResults": 5
}

Salida: Una lista formateada de resultados de búsqueda con títulos, URLs y fragmentos.

📄 UrlContentExtractor

Obtiene y extrae contenido limpio y legible de páginas web eliminando elementos innecesarios como scripts, estilos y navegación.

Entrada:

  • url: Ya sea una cadena de URL única o un array de cadenas de URL

Ejemplo (URL única):

{
  "url": "https://example.com/article"
}

Ejemplo (múltiples URLs):

{
  "url": [
    "https://example.com/article1",
    "https://example.com/article2"
  ]
}

Salida: Contenido de texto extraído de la(s) URL(s) especificada(s).

🛠️ Desarrollo

# Clone the repository
git clone https://github.com/pinkpixel-dev/web-scout-mcp.git
cd web-scout-mcp

# Install dependencies
npm install

# Build
npm run build

# Run
npm start

📚 Documentación

Para obtener información más detallada sobre el proyecto, consulta estos recursos:

📋 Requisitos

  • Node.js >= 18.0.0
  • npm o yarn

📄 Licencia

Este proyecto está licenciado bajo la Licencia Apache 2.0.

Hecho con ❤️ por Pink Pixel
✨ Sueña, Pixelízalo ✨