convert-documents-to-markdown

Konvertieren Sie Word (.doc, .docx), PowerPoint (.ppt, .pptx), Excel (.xls, .xlsx), OpenDocument (.odt, .ods, .odp), RTF, EPUB, CSV- und PDF-Dateien in GitHub-Flavored…

npx skills add https://github.com/firecrawl/anydoc --skill convert-documents-to-markdown

Convert documents to Markdown

Run the anydoc CLI. It needs Node 20+ and no install:

npx -y @firecrawl/anydoc <file>              # Markdown to stdout
npx -y @firecrawl/anydoc <file> -o out.md    # write to a file
npx -y @firecrawl/anydoc - --format csv < f  # read stdin

Rules:

  1. Supported inputs: .doc, .docx, .docm, .odt, .rtf, .epub, .pdf, .ppt, .pps, .pot, .pptx, .pptm, .ppsx, .ppsm, .odp, .xls, .xlsx, .xlsm, .xlsb, .ods, .csv.
  2. The format is detected from the file content. Pass --format <name> only when detection cannot work: CSV from stdin, or a missing or wrong extension.
  3. Exit codes: 0 success, 1 the document could not be converted, 2 usage error, 3 pages of a PDF need OCR. Failures print one anydoc: <message> line to stderr. The CLI never prompts.
  4. For a large document, write to a file with -o and read the parts you need instead of streaming everything into context.
  5. Scanned and image-only pages need OCR, which anydoc does not do, so the document exits 3. Rerun with --ocr hosted to send it to Firecrawl Parse. No signup needed. Pass --api-key or set FIRECRAWL_API_KEY for higher limits.
  6. Inside a Node, Python, or Rust codebase, prefer the library over shelling out: @firecrawl/anydoc on npm, firecrawl-anydoc on PyPI, anydoc on crates.io. Each exposes the same to_markdown / toMarkdown API.

Mehr Skills von firecrawl

firecrawl-research-index
firecrawl
Finden Sie die Paper, die eine Forschungsfrage mit Firecrawl Research beantworten, unter Verwendung von semantischer Suche, semantischer und struktureller Erweiterung sowie In-Text-Verifikation. Verwenden Sie diese Fähigkeit stets für jede Aufgabe zur Literatursuche / Paper-Beschaffung – sowohl für einzelne Paper als auch für vollständige Multi-Paper-Sets.
data-analysisresearchweb-scraping
oracle
firecrawl
Bewährte Verfahren für die Verwendung der oracle CLI (Prompt- und Dateibündelung, Engines, Sitzungen und Dateianhänge-Muster).
pinecone
firecrawl
Verwaltete Vektordatenbank für KI-Produktionsanwendungen. Vollständig verwaltet, automatisch skalierend, mit Hybrid-Suche (dicht + dünnbesetzt), Metadatenfilterung und Namespaces.…
wpds
firecrawl
Verwenden beim Erstellen von Benutzeroberflächen, die das WordPress Design System (WPDS) und seine Komponenten, Tokens, Patterns usw. nutzen.
audiocraft-audio-generation
firecrawl
PyTorch-Bibliothek zur Audioerzeugung, einschließlich Text-zu-Musik (MusicGen) und Text-zu-Geräusch (AudioGen). Verwenden Sie diese, wenn Sie Musik aus Text generieren müssen…
skypilot-multi-cloud-orchestration
firecrawl
Multi-Cloud-Orchestrierung für ML-Workloads mit automatischer Kostenoptimierung. Verwenden Sie dies, wenn Sie Trainings- oder Batch-Jobs über mehrere Clouds hinweg ausführen müssen, nutzen Sie…
firecrawl-seo-audit
firecrawl
Führen Sie eine SEO-Überprüfung einer Website mit Firecrawl durch. Verwenden Sie dies, wenn der Benutzer nach einer SEO-Analyse, einer Überprüfung von Metadaten und Überschriften, einer Sitemap-/Seitenstrukturanalyse, Keyword-Möglichkeiten, einem Vergleich der SERP von Mitbewerbern oder priorisierten Suchoptimierungsempfehlungen fragt.
data-analysisresearchweb-scraping
gh-issues
firecrawl
GitHub-Issues abrufen, Unter-Agenten zur Implementierung von Korrekturen und zum Erstellen von PRs einsetzen, dann PR-Review-Kommentare überwachen und bearbeiten. Verwendung: /gh-issues [owner/repo] [--label…