firecrawl-parse

Эффективно извлекает и преобразует содержимое любого локального файла — например, PDF, DOCX, DOC, ODT, RTF, XLSX, XLS или HTML — в чистый, хорошо отформатированный Markdown, сохраняемый…

npx skills add https://github.com/firecrawl/firecrawl-claude-plugin --skill firecrawl-parse

firecrawl parse

Turn a local document into clean markdown on disk. Supports PDF, DOCX, DOC, ODT, RTF, XLSX, XLS, HTML/HTM.

Quick start

Always save to .firecrawl/ with -o — parsed docs can be hundreds of KB and blow up context if streamed to stdout. Add .firecrawl/ to .gitignore.

mkdir -p .firecrawl

# File → markdown
firecrawl parse ./paper.pdf -o .firecrawl/paper.md

# AI summary
firecrawl parse ./paper.pdf -S -o .firecrawl/paper-summary.md

# Ask a question about the doc
firecrawl parse ./paper.pdf -Q "What are the main conclusions?" \
  -o .firecrawl/paper-qa.md

Then read the output incrementally with head, grep, or rg.

Run firecrawl parse --help for the full option list.

Done when: the markdown, summary, or answer is written under .firecrawl/ and you have inspected it with bounded reads.

Tips

  • Quote paths with spaces: firecrawl parse "./My Doc.pdf" -o .firecrawl/mydoc.md.
  • Max upload size: 50 MB per file.
  • Credits: ~1 per PDF page; HTML is 1 flat.
  • Check .firecrawl/ before re-parsing the same file.
  • To check your credit balance (recommended for batch processing and similar workflows), use firecrawl credit-usage (requires authentication).

See also

Больше skills от firecrawl

firecrawl-research-index
firecrawl
Найдите статьи, отвечающие на исследовательский запрос, с помощью Firecrawl Research, используя семантический поиск, семантическое и структурное расширение, а также проверку в тексте. Всегда используйте этот навык для любых задач по поиску литературы или извлечению статей — от поиска одной статьи до полных наборов из нескольких статей.
data-analysisresearchweb-scraping
oracle
firecrawl
Лучшие практики использования oracle CLI (объединение подсказок и файлов, движки, сессии и шаблоны прикрепления файлов).
pinecone
firecrawl
Управляемая векторная база данных для производственных AI-приложений. Полностью управляемая, с автоматическим масштабированием, гибридным поиском (плотный + разреженный), фильтрацией по метаданным и пространствами имён.
wpds
firecrawl
Используйте при создании интерфейсов на основе WordPress Design System (WPDS) и её компонентов, токенов, паттернов и т.д.
audiocraft-audio-generation
firecrawl
Библиотека PyTorch для генерации аудио, включая преобразование текста в музыку (MusicGen) и текста в звук (AudioGen). Используйте, когда необходимо сгенерировать музыку из текста…
skypilot-multi-cloud-orchestration
firecrawl
Мультиоблачная оркестрация для ML-нагрузок с автоматической оптимизацией затрат. Используйте, когда необходимо запускать обучение или пакетные задания в нескольких облаках, использовать…
firecrawl-seo-audit
firecrawl
Провести SEO-аудит сайта с помощью Firecrawl. Используйте, когда пользователь запрашивает SEO-аудит, проверку метаданных и заголовков, анализ карты сайта/структуры сайта, возможности по ключевым словам, сравнение SERP конкурентов или приоритетные рекомендации по поисковой оптимизации.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Получает задачи GitHub, порождает под-агентов для реализации исправлений и открытия PR, затем отслеживает и обрабатывает комментарии к ревью PR. Использование: /gh-issues [owner/repo] [--label…