firecrawl-crawl

Extraia conteúdo em massa de sites inteiros ou seções de sites com filtragem por profundidade e caminho. Percorre páginas seguindo links até limites configuráveis de profundidade e contagem de páginas, com filtros de inclusão/exclusão de caminho para delimitar a extração. Suporta polling assíncrono de jobs ou espera síncrona com exibição de progresso por meio das flags --wait e --progress. Oferece controle de concorrência, atrasos entre requisições e formatação de saída em JSON para integração em fluxos de agentes. Parte de um padrão de escalonamento de quatro etapas: search → scrape →...

npx skills add https://github.com/firecrawl/cli --skill firecrawl-crawl

firecrawl crawl

Bulk extract content from a website. Crawls pages following links up to a depth/limit.

Prerequisite: crawl requires authentication (no keyless free tier); without credentials the CLI prompts an interactive login.

Quick start

# Crawl a docs section
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# Full crawl with depth limit
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# Check status of a running crawl
firecrawl crawl <job-id>

Run firecrawl crawl --help for the full option list.

Done when: the crawl reaches a terminal status and the saved output under .firecrawl/ contains the expected pages.

Tips

  • Use --wait when you need the results immediately. It has no default timeout; use --timeout <seconds> to bound polling. Without --wait, crawl returns a job ID for async polling.
  • Scope crawls with --include-paths whenever the request names a section — crawl only the pages you need.
  • Crawl consumes credits per page. Check firecrawl credit-usage before large crawls (credit-usage requires authentication).

See also

Mais skills de firecrawl

firecrawl-research-index
firecrawl
Encontre os artigos que respondem a uma consulta de pesquisa com o Firecrawl Research, utilizando busca semântica, expansão semântica e estrutural, e verificação no corpo do texto. Use sempre esta habilidade para qualquer tarefa de localização de literatura ou recuperação de artigos — consultas de um único artigo ou conjuntos completos de múltiplos artigos.
data-analysisresearchweb-scraping
oracle
firecrawl
Melhores práticas para usar a CLI do oracle (prompt + agrupamento de arquivos, engines, sessões e padrões de anexo de arquivos).
pinecone
firecrawl
Banco de dados vetorial gerenciado para aplicações de IA em produção. Totalmente gerenciado, com escalonamento automático, busca híbrida (densa + esparsa), filtragem por metadados e namespaces.…
wpds
firecrawl
Use ao construir UIs que utilizam o WordPress Design System (WPDS) e seus componentes, tokens, padrões, etc.
audiocraft-audio-generation
firecrawl
Biblioteca PyTorch para geração de áudio, incluindo texto para música (MusicGen) e texto para som (AudioGen). Use quando precisar gerar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestração multi-cloud para cargas de trabalho de ML com otimização automática de custos. Use quando precisar executar treinamento ou jobs em lote em múltiplas nuvens, aproveitar…
firecrawl-seo-audit
firecrawl
Audite o SEO de um site com Firecrawl. Use quando o usuário solicitar uma auditoria de SEO, revisão de metadados e cabeçalhos, análise de sitemap/estrutura do site, oportunidades de palavras-chave, comparação de SERP de concorrentes ou recomendações priorizadas de otimização de busca.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Buscar issues do GitHub, criar subagentes para implementar correções e abrir PRs, depois monitorar e tratar comentários de revisão dos PRs. Uso: /gh-issues [owner/repo] [--label…