firecrawl-agent

Extracción autónoma de datos impulsada por IA que navega sitios complejos y devuelve JSON estructurado. Usa esta habilidad cuando el usuario quiera datos estructurados de…

npx skills add https://github.com/firecrawl/firecrawl-codex-plugin --skill firecrawl-agent

firecrawl agent

AI-powered autonomous extraction. The agent navigates sites and extracts structured data (takes 2-5 minutes).

When to use

  • You need structured data from complex multi-page sites
  • Manual scraping would require navigating many pages
  • You want the AI to figure out where the data lives

Quick start

# Extract structured data
firecrawl agent "extract all pricing tiers" --wait -o .firecrawl/pricing.json

# With a JSON schema for structured output
firecrawl agent "extract products" --schema '{"type":"object","properties":{"name":{"type":"string"},"price":{"type":"number"}}}' --wait -o .firecrawl/products.json

# Focus on specific pages
firecrawl agent "get feature list" --urls "<url>" --wait -o .firecrawl/features.json

Options

OptionDescription
--urls <urls>Starting URLs for the agent
--model <model>Model to use: spark-1-mini or spark-1-pro
--schema <json>JSON schema for structured output
--schema-file <path>Path to JSON schema file
--max-credits <n>Credit limit for this agent run
--waitWait for agent to complete
--prettyPretty print JSON output
-o, --output <path>Output file path

Tips

  • Always use --wait to get results inline. Without it, returns a job ID.
  • Use --schema for predictable, structured output — otherwise the agent returns freeform data.
  • Agent runs consume more credits than simple scrapes. Use --max-credits to cap spending.
  • For simple single-page extraction, prefer scrape — it's faster and cheaper.

See also

Más skills de firecrawl

firecrawl-research-index
firecrawl
Encuentra los artículos que responden a una consulta de investigación con Firecrawl Research, utilizando búsqueda semántica, expansión semántica y estructural, y verificación en el cuerpo del texto. Usa siempre esta habilidad para cualquier tarea de búsqueda de literatura o recuperación de artículos, ya sea para consultas de un solo artículo o conjuntos completos de múltiples artículos.
data-analysisresearchweb-scraping
oracle
firecrawl
Mejores prácticas para usar la CLI de oracle (prompt + agrupación de archivos, motores, sesiones y patrones de adjuntar archivos).
pinecone
firecrawl
Base de datos vectorial gestionada para aplicaciones de IA en producción. Completamente gestionada, con escalado automático, búsqueda híbrida (densa + dispersa), filtrado por metadatos y espacios de nombres.…
wpds
firecrawl
Úsalo al construir interfaces de usuario que aprovechen el Sistema de Diseño de WordPress (WPDS) y sus componentes, tokens, patrones, etc.
audiocraft-audio-generation
firecrawl
Biblioteca de PyTorch para generación de audio que incluye texto a música (MusicGen) y texto a sonido (AudioGen). Úsala cuando necesites generar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestración multinube para cargas de trabajo de ML con optimización automática de costos. Úsalo cuando necesites ejecutar entrenamiento o trabajos por lotes en múltiples nubes, aprovechar…
firecrawl-seo-audit
firecrawl
Auditar el SEO de un sitio web con Firecrawl. Úsalo cuando el usuario solicite una auditoría SEO, revisión de metadatos y encabezados, análisis del mapa del sitio o estructura del sitio, oportunidades de palabras clave, comparación de SERP de competidores o recomendaciones priorizadas de optimización de búsqueda.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Obtener issues de GitHub, generar subagentes para implementar correcciones y abrir PRs, luego monitorear y abordar comentarios de revisión de PRs. Uso: /gh-issues [owner/repo] [--label…