firecrawl-agent

Extração autônoma de dados com IA que navega por sites complexos e retorna JSON estruturado. Use esta habilidade quando o usuário quiser dados estruturados de…

npx skills add https://github.com/firecrawl/firecrawl-codex-plugin --skill firecrawl-agent

firecrawl agent

AI-powered autonomous extraction. The agent navigates sites and extracts structured data (takes 2-5 minutes).

When to use

  • You need structured data from complex multi-page sites
  • Manual scraping would require navigating many pages
  • You want the AI to figure out where the data lives

Quick start

# Extract structured data
firecrawl agent "extract all pricing tiers" --wait -o .firecrawl/pricing.json

# With a JSON schema for structured output
firecrawl agent "extract products" --schema '{"type":"object","properties":{"name":{"type":"string"},"price":{"type":"number"}}}' --wait -o .firecrawl/products.json

# Focus on specific pages
firecrawl agent "get feature list" --urls "<url>" --wait -o .firecrawl/features.json

Options

OptionDescription
--urls <urls>Starting URLs for the agent
--model <model>Model to use: spark-1-mini or spark-1-pro
--schema <json>JSON schema for structured output
--schema-file <path>Path to JSON schema file
--max-credits <n>Credit limit for this agent run
--waitWait for agent to complete
--prettyPretty print JSON output
-o, --output <path>Output file path

Tips

  • Always use --wait to get results inline. Without it, returns a job ID.
  • Use --schema for predictable, structured output — otherwise the agent returns freeform data.
  • Agent runs consume more credits than simple scrapes. Use --max-credits to cap spending.
  • For simple single-page extraction, prefer scrape — it's faster and cheaper.

See also

Mais skills de firecrawl

firecrawl-research-index
firecrawl
Encontre os artigos que respondem a uma consulta de pesquisa com o Firecrawl Research, utilizando busca semântica, expansão semântica e estrutural, e verificação no corpo do texto. Use sempre esta habilidade para qualquer tarefa de localização de literatura ou recuperação de artigos — consultas de um único artigo ou conjuntos completos de múltiplos artigos.
data-analysisresearchweb-scraping
oracle
firecrawl
Melhores práticas para usar a CLI do oracle (prompt + agrupamento de arquivos, engines, sessões e padrões de anexo de arquivos).
pinecone
firecrawl
Banco de dados vetorial gerenciado para aplicações de IA em produção. Totalmente gerenciado, com escalonamento automático, busca híbrida (densa + esparsa), filtragem por metadados e namespaces.…
wpds
firecrawl
Use ao construir UIs que utilizam o WordPress Design System (WPDS) e seus componentes, tokens, padrões, etc.
audiocraft-audio-generation
firecrawl
Biblioteca PyTorch para geração de áudio, incluindo texto para música (MusicGen) e texto para som (AudioGen). Use quando precisar gerar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestração multi-cloud para cargas de trabalho de ML com otimização automática de custos. Use quando precisar executar treinamento ou jobs em lote em múltiplas nuvens, aproveitar…
firecrawl-seo-audit
firecrawl
Audite o SEO de um site com Firecrawl. Use quando o usuário solicitar uma auditoria de SEO, revisão de metadados e cabeçalhos, análise de sitemap/estrutura do site, oportunidades de palavras-chave, comparação de SERP de concorrentes ou recomendações priorizadas de otimização de busca.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Buscar issues do GitHub, criar subagentes para implementar correções e abrir PRs, depois monitorar e tratar comentários de revisão dos PRs. Uso: /gh-issues [owner/repo] [--label…