firecrawl-knowledge-ingest

tarafından firecrawl

Firecrawl tarayıcısı ile genel veya kimlik doğrulamalı bilgi tabanlarını ve dokümantasyon portallarını işleyin. JS ağırlıklı dokümanlar, giriş gerektiren portallar, sayfalanmış yardım merkezleri, destek bilgi tabanları veya dokümantasyon sitelerinden yapılandırılmış JSON/markdown çıkarımı için kullanın.

npx skills add https://github.com/firecrawl/firecrawl-workflows --skill firecrawl-knowledge-ingest

Firecrawl Knowledge Ingest

Use this when a docs portal needs browser navigation, auth, pagination, or JS rendering.

Onboarding Interview

Infer the portal URL, output format, auth needs, and page limit from context. If the portal is clear, proceed immediately.

Ask at most 1-3 concise questions only if blocked, such as the portal URL, whether authentication is required, or the desired output format.

Firecrawl Collection Plan

Use Firecrawl browser to:

  • open the portal and inspect navigation
  • identify sections, categories, sidebar links, and article URLs
  • follow sidebar navigation, next links, pagination, load-more controls, or search
  • scrape article content as markdown
  • extract metadata such as title, section, last updated date, author, and tags

Try Firecrawl map as a supplement for public URLs, but use browser navigation for auth-gated or JS-heavy content.

Final Deliverable

# Knowledge Ingest: [Portal]

## Summary
[Pages extracted, sections covered, limitations]

## Output
[JSON/markdown/merged file path or content]

## Sections
[Section names and article counts]

## Failed Or Restricted Pages
[Any access/loading issues]

## Sources
[URLs extracted]

## Rerun Inputs
workflow: firecrawl-knowledge-ingest
url: [portal url]
format: [json/markdown/merged]
max_pages: [number]

JSON Shape

Use source, url, extractedAt, totalArticles, and sections[] with article title, url, section, content, and metadata.

Quality Bar

  • Preserve code examples, tables, and formatting.
  • Strip nav chrome, headers, and footers.
  • Track extraction progress and page failures.
  • Respect authentication boundaries.

firecrawl tarafından daha fazla skill

firecrawl-research-index
firecrawl
Firecrawl Research ile bir araştırma sorgusunu yanıtlayan makaleleri bulun; anlamsal arama, anlamsal ve yapısal genişletme ve gövde içi doğrulama kullanarak. Bu beceriyi her zaman herhangi bir literatür bulma / makale alma görevi için kullanın — tek makale aramaları veya tam çoklu makale setleri.
data-analysisresearchweb-scraping
oracle
firecrawl
oracle CLI kullanımı için en iyi uygulamalar (istemci + dosya paketleme, motorlar, oturumlar ve dosya ekleme desenleri).
pinecone
firecrawl
Üretken yapay zeka uygulamaları için yönetilen vektör veritabanı. Tamamen yönetilen, otomatik ölçeklenen, hibrit arama (yoğun + seyrek), meta veri filtreleme ve ad alanları ile birlikte gelir.…
wpds
firecrawl
WordPress Tasarım Sistemi (WPDS) ve bileşenleri, tokenları, desenleri vb. kullanarak kullanıcı arayüzleri oluştururken kullanın.
audiocraft-audio-generation
firecrawl
Metin tabanlı müzik (MusicGen) ve ses (AudioGen) oluşturma dahil olmak üzere ses üretimi için PyTorch kütüphanesi. Metinden müzik oluşturmanız gerektiğinde kullanın…
skypilot-multi-cloud-orchestration
firecrawl
Çoklu bulut üzerinde ML iş yükleri için otomatik maliyet optimizasyonu ile orkestrasyon. Birden fazla bulutta eğitim veya toplu işler çalıştırmanız gerektiğinde kullanın, yararlanın…
firecrawl-seo-audit
firecrawl
Bir web sitesinin SEO'sunu Firecrawl ile denetleyin. Kullanıcı SEO denetimi, meta veri ve başlık incelemesi, site haritası/site yapısı analizi, anahtar kelime fırsatları, rakip SERP karşılaştırması veya önceliklendirilmiş arama optimizasyonu önerileri istediğinde kullanın.
data-analysisresearchweb-scraping
gh-issues
firecrawl
GitHub sorunlarını getir, düzeltmeleri uygulamak ve PR'lar açmak için alt ajanlar oluştur, ardından PR inceleme yorumlarını izle ve yanıtla. Kullanım: /gh-issues [sahip/depo] [--etiket…]