tavily-map

Descoberta rápida de URLs em sites sem extrair conteúdo, ideal para encontrar páginas específicas em sites grandes. Retorna listas estruturadas de todas as URLs de um domínio com profundidade e amplitude configuráveis, filtragem de caminhos por regex e instruções em linguagem natural para filtragem semântica. Suporta controle de profundidade (1–5 níveis), limites de amplitude por página, inclusão/exclusão de links externos e filtragem de domínio por padrões regex. Projetado como etapa 1 em um fluxo de trabalho: mapeie para encontrar a página certa, depois use extract ou...

npx skills add https://github.com/tavily-ai/skills --skill tavily-map

tavily map

Discover URLs on a website without extracting content. Faster than crawling.

Before running any command

If tvly is not found on PATH, install it first:

curl -fsSL https://cli.tavily.com/install.sh | bash && tvly login

Do not skip this step or fall back to other tools.

See tavily-cli for alternative install methods and auth options.

When to use

  • You need to find a specific subpage on a large site
  • You want a list of all URLs before deciding what to extract or crawl
  • Step 3 in the workflow: search → extract → map → crawl → research

Quick start

# Discover all URLs
tvly map "https://docs.example.com" --json

# With natural language filtering
tvly map "https://docs.example.com" --instructions "Find API docs and guides" --json

# Filter by path
tvly map "https://example.com" --select-paths "/blog/.*" --limit 500 --json

# Deep map
tvly map "https://example.com" --max-depth 3 --limit 200 --json

Options

OptionDescription
--max-depthLevels deep (1-5, default: 1)
--max-breadthLinks per page (default: 20)
--limitMax URLs to discover (default: 50)
--instructionsNatural language guidance for URL filtering
--select-pathsComma-separated regex patterns to include
--exclude-pathsComma-separated regex patterns to exclude
--select-domainsComma-separated regex for domains to include
--exclude-domainsComma-separated regex for domains to exclude
--allow-external / --no-externalInclude external links
--timeoutMax wait (10-150 seconds)
-o, --outputSave output to file
--jsonStructured JSON output

Map + Extract pattern

Use map to find the right page, then extract it. This is often more efficient than crawling an entire site:

# Step 1: Find the authentication docs
tvly map "https://docs.example.com" --instructions "authentication" --json

# Step 2: Extract the specific page you found
tvly extract "https://docs.example.com/api/authentication" --json

Tips

  • Map is URL discovery only — no content extraction. Use extract or crawl for content.
  • Map + extract beats crawl when you only need a few specific pages from a large site.
  • Use --instructions for semantic filtering when path patterns aren't enough.

See also

Mais skills de tavily-ai

research
tavily-ai
Pesquisa abrangente sobre qualquer tópico com coleta automática de fontes, análise e citações. Realiza pesquisa web em múltiplas fontes com citações explícitas, ideal para comparações, eventos atuais, análise de mercado e relatórios detalhados. Oferece três opções de modelo: mini para pesquisa direcionada em tópico único (~30s), pro para análise abrangente multi-ângulo (~60-120s) e auto para detecção de complexidade orientada por API. Autentica via OAuth através do servidor MCP do Tavily com login automático baseado em navegador em...
official
search
tavily-ai
Pesquisa na web com resultados otimizados para LLM, pontuação de relevância e filtragem flexível. Suporta quatro modos de profundidade de pesquisa (ultra-rápido, rápido, básico, avançado) com latência configurável e compensações de relevância. Inclui filtragem por domínio, restrições de intervalo de tempo, intervalos de datas, priorização por país e extração de conteúdo bruto. Retorna resultados com título, URL, trecho de conteúdo e pontuação de relevância; resultados opcionais de imagem e favicons. Autenticação automática OAuth via servidor Tavily MCP ou configuração de chave de API;...
official
tavily-best-practices
tavily-ai
We need to translate the given text from English to Brazilian Portuguese. The text describes a web search API for LLMs with various methods. We must preserve product names, protocol names, URLs, numbers, technical terms. The name "tavily-best-practices" is not in the text, so we don't include it. We translate only the text inside <text>. No extra commentary, no labels. Let's translate: "Web search API for LLMs with real-time data access, content extraction, site crawling, and AI-powered research." -> "API de busca web para LLMs com acesso a dados em tempo real, extração de conteúdo, crawling de sites e pesquisa com IA." "Five core methods: search() for web results, extract() for URL content, crawl() for site-wide extraction, map() for URL discovery, and research() for end-to-end AI synthesis" -> "Cinco métodos principais: search() para resultados web, extract() para conteúdo de URL, crawl() para extração em todo o site, map() para descoberta de URLs e
official
tavily-cli
tavily-ai
Pesquisa na web, extração de conteúdo, rastreamento de sites e pesquisa aprofundada via Tavily CLI. Cinco modos de comando que abrangem pesquisa, extração, descoberta de URLs, rastreamento em massa e pesquisa com múltiplas fontes e citações. Todos os comandos suportam saída em JSON e salvamento em arquivo para fluxos de trabalho estruturados e agentivos. O padrão de escalonamento orienta você desde a pesquisa simples até extração, mapeamento, rastreamento e pesquisa abrangente, conforme suas necessidades. Requer instalação do tavily-cli e autenticação via chave de API com tvly login.
official
tavily-crawl
tavily-ai
Rastreador de sites com múltiplas páginas, filtragem semântica e exportação em markdown. Rastreie seções inteiras do site com controle de profundidade e largura; filtre por regex de caminho, domínio ou instruções em linguagem natural para focar os resultados. Salve cada página como arquivos markdown locais via --output-dir, ou retorne JSON estruturado para processamento agêntico. Use instruções semânticas com extração por chunks para evitar inchaço de contexto ao alimentar resultados para LLMs; use extração de página completa para downloads de documentação offline. Suporta...
official
tavily-dynamic-search
tavily-ai
Pesquise na web, filtre resultados e extraia conteúdo para que dados brutos de pesquisa nunca entrem na sua janela de contexto. Apenas sua saída print() selecionada retorna.
official
tavily-extract
tavily-ai
Extrai markdown ou texto limpo de até 20 URLs, com suporte a renderização JavaScript e chunking focado em consultas. Lida com páginas renderizadas por JavaScript com profundidade de extração configurável (básica para páginas simples, avançada para SPAs dinâmicas e tabelas). Suporta extração focada em consulta para retornar apenas trechos de conteúdo relevantes, em vez de páginas inteiras. Retorna markdown otimizado para LLMs por padrão, com opções para formato de texto simples e saída JSON estruturada. Processa até 20 URLs em uma única chamada;...
official
tavily-research
tavily-ai
We need to translate the given text from English to Brazilian Portuguese. The text describes an AI-powered research tool. We must preserve the name "tavily-research" but it's not in the text, so ignore. Also preserve technical terms like "markdown", "JSON", "MLA", "APA", "Chicago", "async", "poll", etc. No extra commentary. Just translate the text inside <text>. The text: "Comprehensive AI-powered research with multi-source synthesis and citations. Produces structured reports grounded in web sources, taking 30-120 seconds depending on model selection (mini for targeted queries, pro for complex comparisons) Supports multiple output formats: markdown reports, JSON with custom schemas, and configurable citation styles (numbered, MLA, APA, Chicago) Includes async workflow for long-running research via --no-wait , status , and poll commands, plus real-time..." Translation: "Pesquisa abrangente com inteligência artificial, síntese de múltiplas fontes e citações. Produz relatórios estruturados base
official