firecrawl-crawl

Ekstrak konten secara massal dari seluruh situs web atau bagian situs dengan pemfilteran kedalaman dan jalur. Merayapi halaman dengan mengikuti tautan hingga batas kedalaman dan jumlah halaman yang dapat dikonfigurasi, dengan filter inklusi/eksklusi jalur untuk membatasi cakupan ekstraksi. Mendukung polling pekerjaan asinkron atau penantian sinkron dengan tampilan kemajuan melalui flag --wait dan --progress. Menawarkan kontrol konkurensi, penundaan permintaan, dan pemformatan output JSON untuk integrasi ke dalam alur kerja agen. Bagian dari pola eskalasi empat langkah: cari → kikis →...

npx skills add https://github.com/firecrawl/cli --skill firecrawl-crawl

firecrawl crawl

Bulk extract content from a website. Crawls pages following links up to a depth/limit.

Prerequisite: crawl requires authentication (no keyless free tier); without credentials the CLI prompts an interactive login.

Quick start

# Crawl a docs section
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# Full crawl with depth limit
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# Check status of a running crawl
firecrawl crawl <job-id>

Run firecrawl crawl --help for the full option list.

Done when: the crawl reaches a terminal status and the saved output under .firecrawl/ contains the expected pages.

Tips

  • Use --wait when you need the results immediately. It has no default timeout; use --timeout <seconds> to bound polling. Without --wait, crawl returns a job ID for async polling.
  • Scope crawls with --include-paths whenever the request names a section — crawl only the pages you need.
  • Crawl consumes credits per page. Check firecrawl credit-usage before large crawls (credit-usage requires authentication).

See also

Lebih banyak skill dari firecrawl

firecrawl-research-index
firecrawl
Temukan makalah yang menjawab pertanyaan riset dengan Firecrawl Research, menggunakan pencarian semantik, ekspansi semantik dan struktural, serta verifikasi dalam tubuh. Selalu gunakan keterampilan ini untuk tugas pencarian literatur atau pengambilan makalah — baik pencarian satu makalah maupun kumpulan multi-makalah.
data-analysisresearchweb-scraping
oracle
firecrawl
Praktik terbaik dalam menggunakan CLI oracle (penggabungan prompt dan file, mesin, sesi, dan pola lampiran file).
pinecone
firecrawl
Basis data vektor terkelola untuk aplikasi AI produksi. Sepenuhnya terkelola, penskalaan otomatis, dengan pencarian hibrida (padat + jarang), pemfilteran metadata, dan ruang nama.…
wpds
firecrawl
Gunakan saat membangun antarmuka pengguna yang memanfaatkan WordPress Design System (WPDS) dan komponen, token, pola, dll.
audiocraft-audio-generation
firecrawl
Perpustakaan PyTorch untuk pembuatan audio termasuk teks-ke-musik (MusicGen) dan teks-ke-suara (AudioGen). Gunakan saat Anda perlu menghasilkan musik dari teks…
skypilot-multi-cloud-orchestration
firecrawl
Orkestrasi multi-cloud untuk beban kerja ML dengan optimasi biaya otomatis. Gunakan saat Anda perlu menjalankan pelatihan atau pekerjaan batch di berbagai cloud, memanfaatkan…
firecrawl-seo-audit
firecrawl
Audit SEO situs web dengan Firecrawl. Gunakan saat pengguna meminta audit SEO, tinjauan metadata dan heading, analisis peta situs/struktur situs, peluang kata kunci, perbandingan SERP pesaing, atau rekomendasi optimasi pencarian yang diprioritaskan.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Ambil isu GitHub, hasilkan sub-agen untuk menerapkan perbaikan dan membuka PR, lalu pantau serta tangani komentar tinjauan PR. Penggunaan: /gh-issues [owner/repo] [--label…