firecrawl-crawl

Inhalte einer gesamten Website oder eines Website-Abschnitts in großen Mengen extrahieren. Verwenden Sie diese Fähigkeit, wenn der Benutzer eine Website crawlen, alle Seiten aus einem Dokumentationsabschnitt extrahieren möchte,…

npx skills add https://github.com/firecrawl/firecrawl-codex-plugin --skill firecrawl-crawl

firecrawl crawl

Bulk extract content from a website. Crawls pages following links up to a depth/limit.

When to use

  • You need content from many pages on a site (e.g., all /docs/)
  • You want to extract an entire site section
  • Step 4 in the workflow escalation pattern: search → scrape → map → crawl → interact

Quick start

# Crawl a docs section
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# Full crawl with depth limit
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# Check status of a running crawl
firecrawl crawl <job-id>

Options

OptionDescription
--waitWait for crawl to complete before returning
--progressShow progress while waiting
--limit <n>Max pages to crawl
--max-depth <n>Max link depth to follow
--include-paths <paths>Only crawl URLs matching these paths
--exclude-paths <paths>Skip URLs matching these paths
--delay <ms>Delay between requests
--max-concurrency <n>Max parallel crawl workers
--prettyPretty print JSON output
-o, --output <path>Output file path

Tips

  • Always use --wait when you need the results immediately. Without it, crawl returns a job ID for async polling.
  • Use --include-paths to scope the crawl — don't crawl an entire site when you only need one section.
  • Crawl consumes credits per page. Check firecrawl credit-usage before large crawls.

See also

Mehr Skills von firecrawl

firecrawl-research-index
firecrawl
Finden Sie die Paper, die eine Forschungsfrage mit Firecrawl Research beantworten, unter Verwendung von semantischer Suche, semantischer und struktureller Erweiterung sowie In-Text-Verifikation. Verwenden Sie diese Fähigkeit stets für jede Aufgabe zur Literatursuche / Paper-Beschaffung – sowohl für einzelne Paper als auch für vollständige Multi-Paper-Sets.
data-analysisresearchweb-scraping
oracle
firecrawl
Bewährte Verfahren für die Verwendung der oracle CLI (Prompt- und Dateibündelung, Engines, Sitzungen und Dateianhänge-Muster).
pinecone
firecrawl
Verwaltete Vektordatenbank für KI-Produktionsanwendungen. Vollständig verwaltet, automatisch skalierend, mit Hybrid-Suche (dicht + dünnbesetzt), Metadatenfilterung und Namespaces.…
wpds
firecrawl
Verwenden beim Erstellen von Benutzeroberflächen, die das WordPress Design System (WPDS) und seine Komponenten, Tokens, Patterns usw. nutzen.
audiocraft-audio-generation
firecrawl
PyTorch-Bibliothek zur Audioerzeugung, einschließlich Text-zu-Musik (MusicGen) und Text-zu-Geräusch (AudioGen). Verwenden Sie diese, wenn Sie Musik aus Text generieren müssen…
skypilot-multi-cloud-orchestration
firecrawl
Multi-Cloud-Orchestrierung für ML-Workloads mit automatischer Kostenoptimierung. Verwenden Sie dies, wenn Sie Trainings- oder Batch-Jobs über mehrere Clouds hinweg ausführen müssen, nutzen Sie…
firecrawl-seo-audit
firecrawl
Führen Sie eine SEO-Überprüfung einer Website mit Firecrawl durch. Verwenden Sie dies, wenn der Benutzer nach einer SEO-Analyse, einer Überprüfung von Metadaten und Überschriften, einer Sitemap-/Seitenstrukturanalyse, Keyword-Möglichkeiten, einem Vergleich der SERP von Mitbewerbern oder priorisierten Suchoptimierungsempfehlungen fragt.
data-analysisresearchweb-scraping
gh-issues
firecrawl
GitHub-Issues abrufen, Unter-Agenten zur Implementierung von Korrekturen und zum Erstellen von PRs einsetzen, dann PR-Review-Kommentare überwachen und bearbeiten. Verwendung: /gh-issues [owner/repo] [--label…