firecrawl-crawl

Массовое извлечение контента с целых сайтов или разделов сайтов с фильтрацией по глубине и пути. Сканирует страницы, переходя по ссылкам, с настраиваемыми ограничениями глубины и количества страниц, а также фильтрами включения/исключения путей для ограничения извлечения. Поддерживает асинхронный опрос заданий или синхронное ожидание с отображением прогресса через флаги --wait и --progress. Предлагает контроль параллелизма, задержки запросов и форматирование вывода в JSON для интеграции в рабочие процессы агентов. Является частью четырехступенчатой схемы эскалации: поиск → извлечение →...

npx skills add https://github.com/firecrawl/cli --skill firecrawl-crawl

firecrawl crawl

Bulk extract content from a website. Crawls pages following links up to a depth/limit.

Prerequisite: crawl requires authentication (no keyless free tier); without credentials the CLI prompts an interactive login.

Quick start

# Crawl a docs section
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# Full crawl with depth limit
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# Check status of a running crawl
firecrawl crawl <job-id>

Run firecrawl crawl --help for the full option list.

Done when: the crawl reaches a terminal status and the saved output under .firecrawl/ contains the expected pages.

Tips

  • Use --wait when you need the results immediately. It has no default timeout; use --timeout <seconds> to bound polling. Without --wait, crawl returns a job ID for async polling.
  • Scope crawls with --include-paths whenever the request names a section — crawl only the pages you need.
  • Crawl consumes credits per page. Check firecrawl credit-usage before large crawls (credit-usage requires authentication).

See also

Больше skills от firecrawl

firecrawl-research-index
firecrawl
Найдите статьи, отвечающие на исследовательский запрос, с помощью Firecrawl Research, используя семантический поиск, семантическое и структурное расширение, а также проверку в тексте. Всегда используйте этот навык для любых задач по поиску литературы или извлечению статей — от поиска одной статьи до полных наборов из нескольких статей.
data-analysisresearchweb-scraping
oracle
firecrawl
Лучшие практики использования oracle CLI (объединение подсказок и файлов, движки, сессии и шаблоны прикрепления файлов).
pinecone
firecrawl
Управляемая векторная база данных для производственных AI-приложений. Полностью управляемая, с автоматическим масштабированием, гибридным поиском (плотный + разреженный), фильтрацией по метаданным и пространствами имён.
wpds
firecrawl
Используйте при создании интерфейсов на основе WordPress Design System (WPDS) и её компонентов, токенов, паттернов и т.д.
audiocraft-audio-generation
firecrawl
Библиотека PyTorch для генерации аудио, включая преобразование текста в музыку (MusicGen) и текста в звук (AudioGen). Используйте, когда необходимо сгенерировать музыку из текста…
skypilot-multi-cloud-orchestration
firecrawl
Мультиоблачная оркестрация для ML-нагрузок с автоматической оптимизацией затрат. Используйте, когда необходимо запускать обучение или пакетные задания в нескольких облаках, использовать…
firecrawl-seo-audit
firecrawl
Провести SEO-аудит сайта с помощью Firecrawl. Используйте, когда пользователь запрашивает SEO-аудит, проверку метаданных и заголовков, анализ карты сайта/структуры сайта, возможности по ключевым словам, сравнение SERP конкурентов или приоритетные рекомендации по поисковой оптимизации.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Получает задачи GitHub, порождает под-агентов для реализации исправлений и открытия PR, затем отслеживает и обрабатывает комментарии к ревью PR. Использование: /gh-issues [owner/repo] [--label…