e-commerce

Navegar por sitios de comercio electrónico para extraer productos, precios, categorías e inventario. Maneja paginación, variantes y tiendas con mucho JavaScript.

npx skills add https://github.com/firecrawl/web-agent --skill e-commerce

E-commerce Extraction

General Patterns

  • Check for sitemap.xml first -- many stores list all product URLs
  • Look for /products.json, /api/products, or similar API endpoints before scraping HTML
  • Product listing pages usually paginate: look for ?page=N, ?offset=N, or "Load more" buttons
  • Always check the total count shown on the page vs what you've extracted

Product Data Checklist

  • Name, brand, SKU/ID
  • Price (current, original/compare-at, currency)
  • Variants (size, color, etc.) with per-variant pricing and availability
  • Images (primary + gallery)
  • Description (short + long)
  • Category/breadcrumb path
  • Availability/stock status
  • Ratings and review count

Pagination

  • Check for: next/prev links, page numbers, "showing X of Y" text
  • For infinite scroll: use interact to scroll and load more
  • Keep count: if page says "200 products" and you have 24, keep going

JS-Heavy Sites

  • Use interact for sites that require JavaScript rendering
  • Look for XHR/API calls in the page that return JSON -- often easier than parsing HTML
  • Single-page apps often have internal APIs at predictable paths

Site-specific playbooks are in the sites/ directory

Más skills de firecrawl

firecrawl-research-index
firecrawl
Encuentra los artículos que responden a una consulta de investigación con Firecrawl Research, utilizando búsqueda semántica, expansión semántica y estructural, y verificación en el cuerpo del texto. Usa siempre esta habilidad para cualquier tarea de búsqueda de literatura o recuperación de artículos, ya sea para consultas de un solo artículo o conjuntos completos de múltiples artículos.
data-analysisresearchweb-scraping
oracle
firecrawl
Mejores prácticas para usar la CLI de oracle (prompt + agrupación de archivos, motores, sesiones y patrones de adjuntar archivos).
pinecone
firecrawl
Base de datos vectorial gestionada para aplicaciones de IA en producción. Completamente gestionada, con escalado automático, búsqueda híbrida (densa + dispersa), filtrado por metadatos y espacios de nombres.…
wpds
firecrawl
Úsalo al construir interfaces de usuario que aprovechen el Sistema de Diseño de WordPress (WPDS) y sus componentes, tokens, patrones, etc.
audiocraft-audio-generation
firecrawl
Biblioteca de PyTorch para generación de audio que incluye texto a música (MusicGen) y texto a sonido (AudioGen). Úsala cuando necesites generar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestración multinube para cargas de trabajo de ML con optimización automática de costos. Úsalo cuando necesites ejecutar entrenamiento o trabajos por lotes en múltiples nubes, aprovechar…
firecrawl-seo-audit
firecrawl
Auditar el SEO de un sitio web con Firecrawl. Úsalo cuando el usuario solicite una auditoría SEO, revisión de metadatos y encabezados, análisis del mapa del sitio o estructura del sitio, oportunidades de palabras clave, comparación de SERP de competidores o recomendaciones priorizadas de optimización de búsqueda.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Obtener issues de GitHub, generar subagentes para implementar correcciones y abrir PRs, luego monitorear y abordar comentarios de revisión de PRs. Uso: /gh-issues [owner/repo] [--label…