firecrawl-knowledge-base

Construa uma base de conhecimento a partir de conteúdo web com Firecrawl. Use para documentação de referência local, chunks prontos para RAG, conjuntos de dados para fine-tuning, espelhos de documentação, corpora de tópicos ou markdown organizado de fontes web pronto para LLM.

npx skills add https://github.com/firecrawl/firecrawl-workflows --skill firecrawl-knowledge-base

Firecrawl Knowledge Base

Use this to turn URLs or topics into organized LLM-ready content.

Onboarding Interview

Infer the source, goal, depth, and output location from context. If the source and goal are clear, proceed immediately.

Ask at most 1-3 concise questions only if blocked, such as the source URL/topic, whether the output is reference/RAG/training/docs, or training format if training is requested.

Firecrawl Collection Plan

Use Firecrawl map for documentation sites, search for topic-based corpora, scrape pages into markdown, and preserve code examples and tables.

For files, follow the Firecrawl download-style convention:

.firecrawl/
  <hostname>/
    <path>/
      index.md

Parallel Work

If appropriate, use sub-agents or equivalent parallel task runners:

  • one docs section per researcher
  • official docs, tutorials, community discussions, and references by source type
  • source scraping vs chunk generation vs manifest generation

Output Modes

  • Reference: markdown files, index.md, and sources.json.
  • RAG: markdown files plus chunk files and manifest.json.
  • Training: scraped source files plus training-data.jsonl and training-metadata.json.
  • Docs mirror: complete markdown mirror with a table of contents.

Final Deliverable

# Knowledge Base: [Source]

## Summary
[What was collected and why]

## Output Structure
[Files/directories created]

## Coverage
[Sections, source types, counts]

## Usage Notes
[How to use in RAG, docs, training, or agent context]

## Sources
[URLs collected]

## Rerun Inputs
workflow: firecrawl-knowledge-base
source: [url/topic]
goal: [reference/rag/train/docs]
depth: [quick/thorough/exhaustive]
output_dir: [.firecrawl/]

Quality Bar

  • Preserve code examples and formatting.
  • Remove boilerplate navigation where possible.
  • Include source URLs in frontmatter or metadata.

Mais skills de firecrawl

oracle
firecrawl
Melhores práticas para usar a CLI do oracle (prompt + agrupamento de arquivos, engines, sessões e padrões de anexo de arquivos).
official
firecrawl-demo-walkthrough
firecrawl
Percorra os principais fluxos de um produto com o navegador Firecrawl e produza um passo a passo estruturado de UX/produto. Use para inscrição, integração, preços, documentação, painel, preparação de demonstração do produto, análise de UX e análise da experiência de primeira execução.
browser-automationofficialresearch
sag
firecrawl
Texto para fala da ElevenLabs com experiência de usuário no estilo "say" do Mac.
official
pinecone
firecrawl
Banco de dados vetorial gerenciado para aplicações de IA em produção. Totalmente gerenciado, com escalonamento automático, busca híbrida (densa + esparsa), filtragem por metadados e namespaces.…
official
sentence-transformers
firecrawl
Framework para embeddings de sentenças, textos e imagens de última geração. Fornece mais de 5000 modelos pré-treinados para similaridade semântica, clusterização e recuperação.
official
model-merging
firecrawl
Mesclar vários modelos ajustados usando mergekit para combinar capacidades sem retreinamento. Use ao criar modelos especializados combinando conhecimentos específicos de domínio…
official
deepspeed
firecrawl
Orientação especializada para treinamento distribuído com DeepSpeed - estágios de otimização ZeRO, paralelismo de pipeline, FP16/BF16/FP8, Adam de 1 bit, atenção esparsa
official
discord
firecrawl
Operações do Discord via a ferramenta
official