firecrawl-crawl

tarafından firecrawl

Tüm web sitelerinden veya site bölümlerinden derinlik ve yol filtrelemesi ile toplu içerik çıkarımı yapar. Yapılandırılabilir derinlik sınırları ve sayfa sayılarına kadar bağlantıları takip ederek sayfaları tarar, yol dahil etme/hariç tutma filtreleri ile çıkarım kapsamını belirler. --wait ve --progress bayrakları ile ilerleme göstergesi sunarak eşzamansız iş yoklaması veya eşzamanlı bekleme modunu destekler. Aracı iş akışlarına entegrasyon için eşzamanlılık kontrolü, istek gecikmeleri ve JSON çıktı biçimlendirmesi sunar. Dört adımlı bir tırmanma deseninin parçasıdır: ara

npx skills add https://github.com/firecrawl/cli --skill firecrawl-crawl

firecrawl crawl

Bulk extract content from a website. Crawls pages following links up to a depth/limit.

When to use

  • You need content from many pages on a site (e.g., all /docs/)
  • You want to extract an entire site section
  • Step 4 in the workflow escalation pattern: search → scrape → map → crawl → interact

Quick start

# Crawl a docs section
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# Full crawl with depth limit
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# Check status of a running crawl
firecrawl crawl <job-id>

Options

OptionDescription
--waitWait for crawl to complete before returning
--progressShow progress while waiting
--limit <n>Max pages to crawl
--max-depth <n>Max link depth to follow
--include-paths <paths>Only crawl URLs matching these paths
--exclude-paths <paths>Skip URLs matching these paths
--delay <ms>Delay between requests
--max-concurrency <n>Max parallel crawl workers
--prettyPretty print JSON output
-o, --output <path>Output file path

Tips

  • Always use --wait when you need the results immediately. Without it, crawl returns a job ID for async polling.
  • Use --include-paths to scope the crawl — don't crawl an entire site when you only need one section.
  • Crawl consumes credits per page. Check firecrawl credit-usage before large crawls.

See also

firecrawl tarafından daha fazla skill

oracle
firecrawl
oracle CLI kullanımı için en iyi uygulamalar (istemci + dosya paketleme, motorlar, oturumlar ve dosya ekleme desenleri).
official
pinecone
firecrawl
Üretken yapay zeka uygulamaları için yönetilen vektör veritabanı. Tamamen yönetilen, otomatik ölçeklenen, hibrit arama (yoğun + seyrek), meta veri filtreleme ve ad alanları ile birlikte gelir.…
official
sentence-transformers
firecrawl
Son teknoloji cümle, metin ve görüntü yerleştirmeleri için çerçeve. Anlamsal benzerlik, kümeleme ve erişim için 5000'den fazla önceden eğitilmiş model sağlar.…
official
wp-playground
firecrawl
WordPress Playground iş akışları için kullanın: tarayıcıda veya yerel olarak @wp-playground/cli (sunucu, run-blueprint, build-snapshot) ile hızlı, tek kullanımlık WP örnekleri,…
official
wp-plugin-development
firecrawl
WordPress eklentileri geliştirirken kullanılır: mimari ve hook’lar, etkinleştirme/devre dışı bırakma/kaldırma, yönetici arayüzü ve Ayarlar API’si, veri depolama, cron/görevler, güvenlik…
official
wp-project-triage
firecrawl
Bir WordPress deposunun (eklenti/tema/blok teması/WP çekirdeği/Gutenberg/tam site) araçlar/testler/sürüm dahil deterministik bir incelemesine ihtiyaç duyduğunuzda kullanın.
official
wp-rest-api
firecrawl
WordPress REST API uç noktalarını/yollarını oluştururken, genişletirken veya hata ayıklarken kullanın: register_rest_route, WP_REST_Controller/kontrolör sınıfları, şema/argüman…
official
wp-wpcli-and-ops
firecrawl
WP-CLI (wp) ile WordPress işlemleri yaparken kullanılır: güvenli arama-değiştirme, veritabanı dışa/içe aktarma, eklenti/tema/kullanıcı/içerik yönetimi, cron, önbellek temizleme,…
official