firecrawl-download

Descarga sitios web completos como archivos locales organizados en múltiples formatos. Primero mapea la estructura del sitio, luego extrae cada página descubierta en directorios anidados bajo .firecrawl/, compatible con markdown, enlaces, capturas de pantalla y combinaciones de formatos personalizados. Filtra páginas por patrones de ruta (--include-paths, --exclude-paths), consultas de búsqueda, inclusión de subdominios y límites de páginas para controlar el alcance. Todas las opciones estándar de extracción funcionan con la descarga: selección de formato, capturas de pantalla de página completa, contenido principal...

npx skills add https://github.com/firecrawl/cli --skill firecrawl-download

firecrawl download (invoked as firecrawl x download)

Experimental. download is available under the firecrawl x command group.

Prerequisite: download requires authentication (no keyless free tier); without credentials the CLI prompts an interactive login.

Maps the site origin first to discover pages, then scrapes each one into nested directories under .firecrawl/. Use --include-paths to scope a non-root URL to one section. Automated runs always pass -y — without it the command opens an interactive wizard that blocks on a prompt.

Quick start

# With screenshots
firecrawl x download https://docs.example.com --screenshot --limit 20 -y

# Multiple formats (each saved as its own file per page)
firecrawl x download https://docs.example.com --format markdown,links --screenshot --limit 20 -y
# Creates per page: index.md + links.txt + screenshot.png

# Filter to specific sections
firecrawl x download https://docs.example.com --include-paths "/features,/sdks" -y

# Skip translations
firecrawl x download https://docs.example.com --exclude-paths "/zh,/ja,/fr,/es,/pt-BR" -y

Run firecrawl x download --help for the full option list, including which scrape options download supports.

Done when: the command exits successfully and the expected files exist under .firecrawl/.

See also

Más skills de firecrawl

firecrawl-research-index
firecrawl
Encuentra los artículos que responden a una consulta de investigación con Firecrawl Research, utilizando búsqueda semántica, expansión semántica y estructural, y verificación en el cuerpo del texto. Usa siempre esta habilidad para cualquier tarea de búsqueda de literatura o recuperación de artículos, ya sea para consultas de un solo artículo o conjuntos completos de múltiples artículos.
data-analysisresearchweb-scraping
oracle
firecrawl
Mejores prácticas para usar la CLI de oracle (prompt + agrupación de archivos, motores, sesiones y patrones de adjuntar archivos).
pinecone
firecrawl
Base de datos vectorial gestionada para aplicaciones de IA en producción. Completamente gestionada, con escalado automático, búsqueda híbrida (densa + dispersa), filtrado por metadatos y espacios de nombres.…
wpds
firecrawl
Úsalo al construir interfaces de usuario que aprovechen el Sistema de Diseño de WordPress (WPDS) y sus componentes, tokens, patrones, etc.
audiocraft-audio-generation
firecrawl
Biblioteca de PyTorch para generación de audio que incluye texto a música (MusicGen) y texto a sonido (AudioGen). Úsala cuando necesites generar música a partir de texto…
skypilot-multi-cloud-orchestration
firecrawl
Orquestración multinube para cargas de trabajo de ML con optimización automática de costos. Úsalo cuando necesites ejecutar entrenamiento o trabajos por lotes en múltiples nubes, aprovechar…
firecrawl-seo-audit
firecrawl
Auditar el SEO de un sitio web con Firecrawl. Úsalo cuando el usuario solicite una auditoría SEO, revisión de metadatos y encabezados, análisis del mapa del sitio o estructura del sitio, oportunidades de palabras clave, comparación de SERP de competidores o recomendaciones priorizadas de optimización de búsqueda.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Obtener issues de GitHub, generar subagentes para implementar correcciones y abrir PRs, luego monitorear y abordar comentarios de revisión de PRs. Uso: /gh-issues [owner/repo] [--label…