parallel-web-extract

Extraction de contenu d'URL. Utilisez pour récupérer n'importe quelle URL - pages web, articles, PDFs, sites lourds en JavaScript. Efficace en tokens : s'exécute dans un contexte forké. Préférez à…

npx skills add https://github.com/parallel-web/parallel-cursor-plugin --skill parallel-web-extract

URL Extraction

Extract content from: $ARGUMENTS

Command

Choose a short, descriptive filename based on the URL or content (e.g., vespa-docs, react-hooks-api). Use lowercase with hyphens, no spaces. Substitute it into the command inline$FILENAME is a placeholder, not a shell variable.

parallel-cli extract "$ARGUMENTS" --json -o "/tmp/$FILENAME.json"

Concrete example:

parallel-cli extract "https://docs.parallel.ai" --json -o "/tmp/parallel-docs.json"

Note: -o always saves JSON. The extension must be .json.

Options if needed:

  • --objective "focus area" to focus extraction on a specific goal (also silences the "neither objective nor search_queries" warning that V1 emits when neither is set)
  • -q "keyword" (repeatable) to prioritize keywords in excerpts
  • --full-content to include the complete page body (for long articles, PDFs, or when excerpts may not capture what you need)
  • --full-content-max-chars N to cap full-content size per result
  • --no-excerpts to strip excerpts when you only want full content

Handling failed extractions

If the response has an errors field, an empty results array, or a 404/timeout for the URL, do NOT fabricate content. Tell the user the extraction failed, surface the upstream status, and suggest:

  • Verifying the URL (the page may have moved)
  • Retrying with --full-content if excerpts came back empty but the page exists
  • Using parallel-cli search to locate the current URL if the page was renamed

Response format

Return content as:

Page Title

Then the extracted content verbatim, with these rules:

  • Keep content verbatim - do not paraphrase or summarize
  • Parse lists exhaustively - extract EVERY numbered/bulleted item
  • Strip only obvious noise: nav menus, footers, ads
  • Preserve all facts, names, numbers, dates, quotes

After the response, mention the output file path (/tmp/$FILENAME.json) so the user knows it's available for follow-up questions.

If the parallel-cli binary is not installed

If the shell reports command not found: parallel-cli (i.e. the binary itself is missing — distinct from a No such command error from a stale CLI, which the in-body guidance above covers), stop immediately. Do NOT search the web yourself, do NOT use any built-in search tools, and do NOT try to answer the query from your own knowledge. Instead, tell the user:

  1. parallel-cli is not installed
  2. Run /parallel-setup to install it
  3. Then retry their request

Plus de skills de parallel-web

parallel-monitor
parallel-web
Surveiller en continu le web pour détecter des changements à intervalles réguliers. Utiliser lorsque l'utilisateur demande de « surveiller », « suivre les modifications de », « observer » ou « m'alerter quand » quelque chose…
migrate-to-parallel
parallel-web
Migrez complètement les intégrations de données web d'Exa, Tavily, Perplexity ou Firecrawl vers les produits Parallel appropriés tout en préservant le comportement de l'application. Utilisez…
parallel-data-enrichment
parallel-web
Enrichissement en masse de données d'entreprise, de personnes ou de produits avec des champs issus du web comme les noms des PDG, les financements et les coordonnées. Accepte les données JSON en ligne ou les fichiers CSV ; produit des résultats enrichis au format CSV. Fonctionne de manière asynchrone avec suivi de progression via une URL de surveillance et des commandes d'interrogation. Nécessite l'outil parallel-cli et un accès Internet ; gère de grands ensembles de données avec des délais configurables. Prend en charge les demandes de champs flexibles via des descriptions d'intention en langage naturel (par exemple, "nom du PDG et année de fondation").
parallel-deep-research
parallel-web
Recherche exhaustive avec profondeur, latence et compromis de coût configurables pour des sujets complexes. Trois niveaux de processeurs (pro-fast, ultra-fast, ultra) allant de 30 secondes à 25 minutes, avec un coût variant de 1x à 3x par rapport à la base. Exécution asynchrone avec interrogation : lancez la recherche instantanément, suivez la progression via une URL, récupérez les résultats lorsqu'ils sont prêts sans blocage. Les sorties génèrent un rapport formaté en Markdown et des métadonnées JSON ; un résumé exécutif est affiché sur stdout pour un aperçu rapide. Conçu pour une...
parallel-findall
parallel-web
Découvrir des entités (entreprises, personnes, produits, etc.) correspondant à une description en langage naturel. À utiliser lorsque l'utilisateur demande de « trouver tous les X » ou « lister tous les Y qui… » —…
parallel-memory
parallel-web
Rappelez les exécutions passées de Parallel Task, Monitor et FindAll lorsqu'elles peuvent aider ; évincez les exécutions ou effacez la mémoire lorsqu'on vous le demande.
parallel-web-extract
parallel-web
Extrait le contenu de plusieurs URL en parallèle, de manière économe en tokens. Gère les pages web, articles, PDF et sites lourds en JavaScript avec une seule commande. S'exécute dans un contexte forké pour minimiser la surcharge de tokens par rapport à WebFetch intégré. Prend en charge l'extraction par lots de plusieurs URL avec des objectifs de focus optionnels. Nécessite l'installation et l'authentification de parallel-cli ; produit le contenu extrait au format markdown dans un fichier local pour les requêtes de suivi.
parallel-web-search
parallel-web
Recherche web rapide pour des informations actuelles, des recherches et des vérifications de faits sur internet. Exécute des requêtes basées sur un seul objectif ou plusieurs recherches par mots-clés en parallèle, renvoyant jusqu'à 10 résultats avec des extraits et des métadonnées. Prend en charge le filtrage temporel via --after-date et les recherches spécifiques à un domaine avec --include-domains. Produit un JSON structuré avec titres, URL, dates de publication et extraits pour une analyse facile et des requêtes de suivi. Nécessite des citations en ligne pour chaque affirmation en utilisant le markdown...