parallel-web-extract

tarafından parallel-web

URL içeriği çıkarma. Herhangi bir URL'yi getirmek için kullanılır - web sayfaları, makaleler, PDF'ler, JavaScript yoğun siteler. Token verimli: çatallanmış bağlamda çalışır. Şunlara tercih edilir…

npx skills add https://github.com/parallel-web/parallel-cursor-plugin --skill parallel-web-extract

URL Extraction

Extract content from: $ARGUMENTS

Command

Choose a short, descriptive filename based on the URL or content (e.g., vespa-docs, react-hooks-api). Use lowercase with hyphens, no spaces. Substitute it into the command inline$FILENAME is a placeholder, not a shell variable.

parallel-cli extract "$ARGUMENTS" --json -o "/tmp/$FILENAME.json"

Concrete example:

parallel-cli extract "https://docs.parallel.ai" --json -o "/tmp/parallel-docs.json"

Note: -o always saves JSON. The extension must be .json.

Options if needed:

  • --objective "focus area" to focus extraction on a specific goal (also silences the "neither objective nor search_queries" warning that V1 emits when neither is set)
  • -q "keyword" (repeatable) to prioritize keywords in excerpts
  • --full-content to include the complete page body (for long articles, PDFs, or when excerpts may not capture what you need)
  • --full-content-max-chars N to cap full-content size per result
  • --no-excerpts to strip excerpts when you only want full content

Handling failed extractions

If the response has an errors field, an empty results array, or a 404/timeout for the URL, do NOT fabricate content. Tell the user the extraction failed, surface the upstream status, and suggest:

  • Verifying the URL (the page may have moved)
  • Retrying with --full-content if excerpts came back empty but the page exists
  • Using parallel-cli search to locate the current URL if the page was renamed

Response format

Return content as:

Page Title

Then the extracted content verbatim, with these rules:

  • Keep content verbatim - do not paraphrase or summarize
  • Parse lists exhaustively - extract EVERY numbered/bulleted item
  • Strip only obvious noise: nav menus, footers, ads
  • Preserve all facts, names, numbers, dates, quotes

After the response, mention the output file path (/tmp/$FILENAME.json) so the user knows it's available for follow-up questions.

If the parallel-cli binary is not installed

If the shell reports command not found: parallel-cli (i.e. the binary itself is missing — distinct from a No such command error from a stale CLI, which the in-body guidance above covers), stop immediately. Do NOT search the web yourself, do NOT use any built-in search tools, and do NOT try to answer the query from your own knowledge. Instead, tell the user:

  1. parallel-cli is not installed
  2. Run /parallel-setup to install it
  3. Then retry their request

parallel-web tarafından daha fazla skill

parallel-monitor
parallel-web
Web'deki değişiklikleri belirli aralıklarla sürekli olarak takip edin. Kullanıcı 'izle', 'değişiklikleri takip et', 'gözlemle' veya 'bir şey olduğunda beni uyar' gibi ifadeler kullandığında kullanın…
migrate-to-parallel
parallel-web
Exa, Tavily, Perplexity veya Firecrawl web-veri entegrasyonlarını, uygulama davranışını koruyarak tamamen uygun Parallel ürünlerine taşıyın. Kullanın…
parallel-data-enrichment
parallel-web
Şirket, kişi veya ürün verilerinin CEO adları, finansman ve iletişim bilgileri gibi web kaynaklı alanlarla toplu zenginleştirilmesi. Satır içi JSON verilerini veya CSV dosyalarını kabul eder; zenginleştirilmiş sonuçları CSV olarak çıkarır. İzleme URL'si ve yoklama komutlarıyla ilerleme takibi yapılarak asenkron çalışır. parallel-cli aracı ve internet erişimi gerektirir; yapılandırılabilir zaman aşımlarıyla büyük veri kümelerini işler. Doğal dil amaç tanımları aracılığıyla esnek alan taleplerini destekler (ör. "CEO adı ve kuruluş yılı").
parallel-deep-research
parallel-web
Karmaşık konular için yapılandırılabilir derinlik, gecikme ve maliyet dengesi sunan kapsamlı araştırma. 30 saniyeden 25 dakikaya kadar değişen üç işlemci katmanı (pro-fast, ultra-fast, ultra), 1x ila 3x temel maliyet ölçeklendirmesi. Anında araştırma başlatma, URL üzerinden ilerleme takibi, blokaj olmadan sonuçları hazır olduğunda alma imkanı sağlayan yoklama ile asenkron yürütme. Çıktılar biçimlendirilmiş markdown raporu ve JSON meta verisi; hızlı genel bakış için stdout'a yazdırılan yönetici özeti. Açıkça... için tasarlanmıştır.
parallel-findall
parallel-web
Doğal dildeki bir açıklamayla eşleşen varlıkları (şirketler, kişiler, ürünler vb.) keşfeder. Kullanıcı 'tüm X'leri bul' veya 'her Y'yi listele…' gibi bir şey istediğinde kullanın.
parallel-memory
parallel-web
Geçmiş Parallel Task, Monitor ve FindAll çalıştırmalarını işe yarayabileceklerinde hatırla; istendiğinde çalıştırmaları çıkar veya belleği temizle.
parallel-web-extract
parallel-web
Birden çok URL'den içerikleri paralel olarak, token verimli şekilde çıkarır. Tek bir komutla web sayfaları, makaleler, PDF'ler ve JavaScript ağırlıklı siteleri işler. Yerleşik WebFetch'e kıyasla token yükünü azaltmak için çatallanmış bir bağlamda çalışır. İsteğe bağlı odak hedefleriyle birden çok URL'nin toplu çıkarımını destekler. parallel-cli kurulumu ve kimlik doğrulaması gerektirir; çıkarılan içerikleri takip sorguları için yerel bir dosyaya markdown olarak çıktılar.
parallel-web-search
parallel-web
İnternet genelinde güncel bilgi, araştırma ve doğrulama için hızlı web araması. Tek bir hedefe yönelik sorguları veya birden fazla anahtar kelime aramasını paralel olarak yürütür, alıntılar ve meta verilerle birlikte en fazla 10 sonuç döndürür. --after-date ile zamana duyarlı filtreleme ve --include-domains ile alana özgü aramaları destekler. Kolay ayrıştırma ve takip sorguları için başlıklar, URL'ler, yayın tarihleri ve alıntılar içeren yapılandırılmış JSON çıktısı verir. Her iddia için markdown kullanarak satır içi alıntı gerektirir...