firecrawl-company-directories

Extraia listas estruturadas de empresas de diretórios com Firecrawl. Use para extrair dados do YC, Crunchbase, Product Hunt, G2, diretórios de startups, diretórios de categorias ou bancos de dados personalizados de empresas em JSON, CSV, listas prontas para CRM ou tabelas de pesquisa.

npx skills add https://github.com/firecrawl/firecrawl-workflows --skill firecrawl-company-directories

Firecrawl Company Directories

Use this to turn startup or company directories into structured lists.

Onboarding Interview

Infer the directory, filters, result count, and output format from context. If the source is clear, proceed immediately.

Ask at most 1-3 concise questions only if blocked, such as the directory URL/name, required filters, or target result count.

Firecrawl Collection Plan

Use Firecrawl browser when the directory needs filters, pagination, infinite scroll, or profile clicks. Use scrape/map when listings are public and static.

Suggested sources include YC companies, Crunchbase, Product Hunt, G2 categories, or any custom directory URL.

Extraction Fields

Capture fields that are visible:

  • name
  • description
  • industry/category
  • stage/founded/location/team size/funding when visible
  • tags
  • directory profile URL
  • company website URL

Leave unavailable fields blank. Do not infer.

Final Deliverable

# Company Directory Export: [Source]

## Summary
[Filters, count extracted, limitations]

## Companies
[Table or link to JSON/CSV]

## Sources
[Directory pages and profiles used]

## Rerun Inputs
workflow: firecrawl-company-directories
directory: [source]
filters: [criteria]
max_results: [number]
output: [json/csv/markdown]

JSON Shape

Use source, filters, extractedAt, totalResults, and companies[] with name, url, description, industry, stage, founded, location, teamSize, funding, tags, profileUrl, and websiteUrl.

Quality Bar

  • Deduplicate companies.
  • Track pagination progress.
  • Note rate limits, login walls, or CAPTCHA blocks.

Mais skills de firecrawl

firecrawl-research-index
firecrawl
Encontre os artigos que respondem a uma consulta de pesquisa com o Firecrawl Research, utilizando busca semântica, expansão semântica e estrutural, e verificação no corpo do texto. Use sempre esta habilidade para qualquer tarefa de localização de literatura ou recuperação de artigos — consultas de um único artigo ou conjuntos completos de múltiplos artigos.
data-analysisresearchweb-scraping
oracle
firecrawl
Melhores práticas para usar a CLI do oracle (prompt + agrupamento de arquivos, engines, sessões e padrões de anexo de arquivos).
pinecone
firecrawl
Banco de dados vetorial gerenciado para aplicações de IA em produção. Totalmente gerenciado, com escalonamento automático, busca híbrida (densa + esparsa), filtragem por metadados e namespaces.…
wpds
firecrawl
Use ao construir UIs que utilizam o WordPress Design System (WPDS) e seus componentes, tokens, padrões, etc.
audiocraft-audio-generation
firecrawl
Biblioteca PyTorch para geração de áudio, incluindo texto para música (MusicGen) e texto para som (AudioGen). Use quando precisar gerar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestração multi-cloud para cargas de trabalho de ML com otimização automática de custos. Use quando precisar executar treinamento ou jobs em lote em múltiplas nuvens, aproveitar…
firecrawl-seo-audit
firecrawl
Audite o SEO de um site com Firecrawl. Use quando o usuário solicitar uma auditoria de SEO, revisão de metadados e cabeçalhos, análise de sitemap/estrutura do site, oportunidades de palavras-chave, comparação de SERP de concorrentes ou recomendações priorizadas de otimização de busca.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Buscar issues do GitHub, criar subagentes para implementar correções e abrir PRs, depois monitorar e tratar comentários de revisão dos PRs. Uso: /gh-issues [owner/repo] [--label…