firecrawl-map

Découvrir et filtrer des URL sur un site web, avec recherche optionnelle pour localiser des pages spécifiques. Prend en charge le filtrage par requête de recherche pour trouver des pages correspondant à des mots-clés dans de grands sites. Inclut des stratégies de gestion du sitemap (inclure, ignorer ou utiliser uniquement) et l'inclusion optionnelle de sous-domaines. Produit des résultats en texte brut ou en JSON avec des limites d'URL configurables. Souvent associé à firecrawl-scrape : utiliser map avec recherche pour trouver l'URL cible, puis la scraper.

npx skills add https://github.com/firecrawl/cli --skill firecrawl-map

firecrawl map

Discover URLs on a site. Use --search to find a specific page within a large site.

Prerequisite: map requires authentication (no keyless free tier); without credentials the CLI prompts an interactive login.

Quick start

# Find a specific page on a large site
firecrawl map "<url>" --search "authentication" -o .firecrawl/filtered.txt

# Get all URLs
firecrawl map "<url>" --limit 500 --json -o .firecrawl/urls.json

Run firecrawl map --help for the full option list (sitemap handling, subdomains, etc.).

Done when: the URL list is saved under .firecrawl/ and you have selected the URLs to scrape or crawl next.

Tips

  • Map + scrape is a common pattern: use map --search to find the right URL, then scrape it.
  • Example: map https://docs.example.com --search "auth" → found /docs/api/authentication → scrape that URL.

See also

Plus de skills de firecrawl

firecrawl-research-index
firecrawl
Trouvez les articles qui répondent à une requête de recherche avec Firecrawl Research, en utilisant la recherche sémantique, l'expansion sémantique et structurelle, et la vérification dans le corps du texte. Utilisez toujours cette compétence pour toute tâche de recherche d'articles ou de récupération de documents — qu'il s'agisse de consulter un seul article ou un ensemble complet de plusieurs articles.
data-analysisresearchweb-scraping
oracle
firecrawl
Meilleures pratiques pour utiliser l'interface en ligne de commande oracle (invite + regroupement de fichiers, moteurs, sessions et modèles de pièces jointes).
pinecone
firecrawl
Base de données vectorielle gérée pour les applications d'IA en production. Entièrement gérée, mise à l'échelle automatique, avec recherche hybride (dense + sparse), filtrage par métadonnées et espaces de noms.…
wpds
firecrawl
À utiliser lors de la création d'interfaces utilisateur exploitant le WordPress Design System (WPDS) et ses composants, tokens, motifs, etc.
audiocraft-audio-generation
firecrawl
Bibliothèque PyTorch pour la génération audio incluant texte-vers-musique (MusicGen) et texte-vers-son (AudioGen). À utiliser lorsque vous avez besoin de générer de la musique à partir de texte…
skypilot-multi-cloud-orchestration
firecrawl
Orchestration multi-cloud pour les charges de travail ML avec optimisation automatique des coûts. À utiliser lorsque vous devez exécuter des tâches d’entraînement ou par lots sur plusieurs clouds, tirer parti de…
firecrawl-seo-audit
firecrawl
Auditer le SEO d'un site web avec Firecrawl. À utiliser lorsque l'utilisateur demande un audit SEO, une revue des métadonnées et des titres, une analyse du sitemap/de la structure du site, des opportunités de mots-clés, une comparaison des SERP concurrents, ou des recommandations priorisées d'optimisation pour la recherche.
data-analysisresearchweb-scraping
gh-issues
firecrawl
Récupérer les issues GitHub, générer des sous-agents pour implémenter des correctifs et ouvrir des PR, puis surveiller et traiter les commentaires de révision des PR. Utilisation : /gh-issues [owner/repo] [--label…]