Web Scout
Um servidor MCP para busca na web e extração de conteúdo usando DuckDuckGo.
Documentação
Servidor MCP Web Scout
Um servidor MCP para busca na web usando DuckDuckGo e extração de conteúdo, com suporte para múltiplas URLs e otimizações de memória.
✨ Recursos
- 🔍 Busca DuckDuckGo: Capacidade de busca na web rápida e focada em privacidade
- 📄 Extração de Conteúdo: Extração de texto limpa e legível de páginas web
- 🚀 Processamento Paralelo: Suporte para extração de conteúdo de múltiplas URLs simultaneamente
- 💾 Otimização de Memória: Gerenciamento inteligente de memória para evitar travamentos do aplicativo
- ⏱️ Limitação de Taxa: Aceleração inteligente de requisições para evitar bloqueios de API
- 🛡️ Tratamento de Erros: Tratamento robusto de erros para operação confiável
📦 Instalação
Instalando via Smithery
Para instalar o Web Scout para Claude Desktop automaticamente via Smithery:
npx -y @smithery/cli install @pinkpixel-dev/web-scout-mcp --client claude
Instalação Global
npm install -g @pinkpixel/web-scout-mcp
Instalação Local
npm install @pinkpixel/web-scout-mcp
🚀 Uso
Linha de Comando
Após instalar globalmente, execute:
web-scout-mcp
Com Clientes MCP
Adicione isso ao config.json do seu cliente MCP (Claude Desktop, Cursor, etc.):
{
"mcpServers": {
"web-scout": {
"command": "npx",
"args": [
"-y",
"@pinkpixel/web-scout-mcp@latest"
]
}
}
}
Variáveis de Ambiente
Defina a variável de ambiente WEB_SCOUT_DISABLE_AUTOSTART=1 ao incorporar o pacote e chamar createServer() você mesmo. Por padrão, executar o ponto de entrada publicado (por exemplo, node dist/index.js ou npx @pinkpixel/web-scout-mcp) inicializa automaticamente o transporte stdio.
🧰 Ferramentas
O servidor fornece as seguintes ferramentas MCP:
🔍 DuckDuckGoWebSearch
Inicia uma consulta de busca na web usando o mecanismo de busca DuckDuckGo e retorna uma lista bem estruturada de resultados.
Entrada:
query(string): A string da consulta de buscamaxResults(número, opcional): Número máximo de resultados a retornar (padrão: 10)
Exemplo:
{
"query": "latest advancements in AI",
"maxResults": 5
}
Saída: Uma lista formatada de resultados de busca com títulos, URLs e trechos.
📄 UrlContentExtractor
Busca e extrai conteúdo limpo e legível de páginas web, removendo elementos desnecessários como scripts, estilos e navegação.
Entrada:
url: Uma string de URL única ou um array de strings de URL
Exemplo (URL única):
{
"url": "https://example.com/article"
}
Exemplo (múltiplas URLs):
{
"url": [
"https://example.com/article1",
"https://example.com/article2"
]
}
Saída: Conteúdo de texto extraído da(s) URL(s) especificada(s).
🛠️ Desenvolvimento
# Clone the repository
git clone https://github.com/pinkpixel-dev/web-scout-mcp.git
cd web-scout-mcp
# Install dependencies
npm install
# Build
npm run build
# Run
npm start
📚 Documentação
Para informações mais detalhadas sobre o projeto, confira estes recursos:
- OVERVIEW.md - Visão geral técnica e arquitetura
- CONTRIBUTING.md - Diretrizes para colaboradores
- CHANGELOG.md - Histórico de versões e mudanças
📋 Requisitos
- Node.js >= 18.0.0
- npm ou yarn
📄 Licença
Este projeto está licenciado sob a Licença Apache 2.0.
Feito com ❤️ por Pink Pixel
✨ Sonhe, Pixelize ✨