firecrawl-company-directories

Извлекайте структурированные списки компаний из каталогов с помощью Firecrawl. Используйте для сбора данных с YC, Crunchbase, Product Hunt, G2, стартап-каталогов, тематических справочников или пользовательских баз компаний в формате JSON, CSV, списков, готовых для CRM, или исследовательских таблиц.

npx skills add https://github.com/firecrawl/firecrawl-workflows --skill firecrawl-company-directories

Firecrawl Company Directories

Use this to turn startup or company directories into structured lists.

Onboarding Interview

Infer the directory, filters, result count, and output format from context. If the source is clear, proceed immediately.

Ask at most 1-3 concise questions only if blocked, such as the directory URL/name, required filters, or target result count.

Firecrawl Collection Plan

Use Firecrawl browser when the directory needs filters, pagination, infinite scroll, or profile clicks. Use scrape/map when listings are public and static.

Suggested sources include YC companies, Crunchbase, Product Hunt, G2 categories, or any custom directory URL.

Extraction Fields

Capture fields that are visible:

  • name
  • description
  • industry/category
  • stage/founded/location/team size/funding when visible
  • tags
  • directory profile URL
  • company website URL

Leave unavailable fields blank. Do not infer.

Final Deliverable

# Company Directory Export: [Source]

## Summary
[Filters, count extracted, limitations]

## Companies
[Table or link to JSON/CSV]

## Sources
[Directory pages and profiles used]

## Rerun Inputs
workflow: firecrawl-company-directories
directory: [source]
filters: [criteria]
max_results: [number]
output: [json/csv/markdown]

JSON Shape

Use source, filters, extractedAt, totalResults, and companies[] with name, url, description, industry, stage, founded, location, teamSize, funding, tags, profileUrl, and websiteUrl.

Quality Bar

  • Deduplicate companies.
  • Track pagination progress.
  • Note rate limits, login walls, or CAPTCHA blocks.

Больше skills от firecrawl

firecrawl-research-index
firecrawl
Найдите статьи, отвечающие на исследовательский запрос, с помощью Firecrawl Research, используя семантический поиск, семантическое и структурное расширение, а также проверку в тексте. Всегда используйте этот навык для любых задач по поиску литературы или извлечению статей — от поиска одной статьи до полных наборов из нескольких статей.
data-analysisresearchweb-scraping
oracle
firecrawl
Лучшие практики использования oracle CLI (объединение подсказок и файлов, движки, сессии и шаблоны прикрепления файлов).
pinecone
firecrawl
Управляемая векторная база данных для производственных AI-приложений. Полностью управляемая, с автоматическим масштабированием, гибридным поиском (плотный + разреженный), фильтрацией по метаданным и пространствами имён.
wpds
firecrawl
Используйте при создании интерфейсов на основе WordPress Design System (WPDS) и её компонентов, токенов, паттернов и т.д.
audiocraft-audio-generation
firecrawl
Библиотека PyTorch для генерации аудио, включая преобразование текста в музыку (MusicGen) и текста в звук (AudioGen). Используйте, когда необходимо сгенерировать музыку из текста…
skypilot-multi-cloud-orchestration
firecrawl
Мультиоблачная оркестрация для ML-нагрузок с автоматической оптимизацией затрат. Используйте, когда необходимо запускать обучение или пакетные задания в нескольких облаках, использовать…
firecrawl-seo-audit
firecrawl
Провести SEO-аудит сайта с помощью Firecrawl. Используйте, когда пользователь запрашивает SEO-аудит, проверку метаданных и заголовков, анализ карты сайта/структуры сайта, возможности по ключевым словам, сравнение SERP конкурентов или приоритетные рекомендации по поисковой оптимизации.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Получает задачи GitHub, порождает под-агентов для реализации исправлений и открытия PR, затем отслеживает и обрабатывает комментарии к ревью PR. Использование: /gh-issues [owner/repo] [--label…