e-commerce

Навигация по сайтам электронной коммерции для извлечения товаров, цен, категорий и остатков. Обрабатывает пагинацию, варианты и витрины с интенсивным использованием JavaScript.

npx skills add https://github.com/firecrawl/web-agent --skill e-commerce

E-commerce Extraction

General Patterns

  • Check for sitemap.xml first -- many stores list all product URLs
  • Look for /products.json, /api/products, or similar API endpoints before scraping HTML
  • Product listing pages usually paginate: look for ?page=N, ?offset=N, or "Load more" buttons
  • Always check the total count shown on the page vs what you've extracted

Product Data Checklist

  • Name, brand, SKU/ID
  • Price (current, original/compare-at, currency)
  • Variants (size, color, etc.) with per-variant pricing and availability
  • Images (primary + gallery)
  • Description (short + long)
  • Category/breadcrumb path
  • Availability/stock status
  • Ratings and review count

Pagination

  • Check for: next/prev links, page numbers, "showing X of Y" text
  • For infinite scroll: use interact to scroll and load more
  • Keep count: if page says "200 products" and you have 24, keep going

JS-Heavy Sites

  • Use interact for sites that require JavaScript rendering
  • Look for XHR/API calls in the page that return JSON -- often easier than parsing HTML
  • Single-page apps often have internal APIs at predictable paths

Site-specific playbooks are in the sites/ directory

Больше skills от firecrawl

firecrawl-research-index
firecrawl
Найдите статьи, отвечающие на исследовательский запрос, с помощью Firecrawl Research, используя семантический поиск, семантическое и структурное расширение, а также проверку в тексте. Всегда используйте этот навык для любых задач по поиску литературы или извлечению статей — от поиска одной статьи до полных наборов из нескольких статей.
data-analysisresearchweb-scraping
oracle
firecrawl
Лучшие практики использования oracle CLI (объединение подсказок и файлов, движки, сессии и шаблоны прикрепления файлов).
pinecone
firecrawl
Управляемая векторная база данных для производственных AI-приложений. Полностью управляемая, с автоматическим масштабированием, гибридным поиском (плотный + разреженный), фильтрацией по метаданным и пространствами имён.
wpds
firecrawl
Используйте при создании интерфейсов на основе WordPress Design System (WPDS) и её компонентов, токенов, паттернов и т.д.
audiocraft-audio-generation
firecrawl
Библиотека PyTorch для генерации аудио, включая преобразование текста в музыку (MusicGen) и текста в звук (AudioGen). Используйте, когда необходимо сгенерировать музыку из текста…
skypilot-multi-cloud-orchestration
firecrawl
Мультиоблачная оркестрация для ML-нагрузок с автоматической оптимизацией затрат. Используйте, когда необходимо запускать обучение или пакетные задания в нескольких облаках, использовать…
firecrawl-seo-audit
firecrawl
Провести SEO-аудит сайта с помощью Firecrawl. Используйте, когда пользователь запрашивает SEO-аудит, проверку метаданных и заголовков, анализ карты сайта/структуры сайта, возможности по ключевым словам, сравнение SERP конкурентов или приоритетные рекомендации по поисковой оптимизации.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Получает задачи GitHub, порождает под-агентов для реализации исправлений и открытия PR, затем отслеживает и обрабатывает комментарии к ревью PR. Использование: /gh-issues [owner/repo] [--label…