tavily-extract

tarafından tavily-ai

20 URL'ye kadar temiz markdown veya metin çıkarır; JavaScript işleme ve sorgu odaklı parçalama desteği sunar. JavaScript ile oluşturulmuş sayfaları, yapılandırılabilir çıkarma derinliğiyle (basit sayfalar için temel, dinamik SPA'lar ve tablolar için gelişmiş) işler. Tam sayfalar yerine yalnızca ilgili içerik parçalarını döndürmek için sorgu odaklı çıkarmayı destekler. Varsayılan olarak LLM için optimize edilmiş markdown döndürür; düz metin biçimi ve yapılandırılmış JSON çıktısı seçenekleri sunar. Tek bir çağrıda 20 URL'ye kadar işler;...

npx skills add https://github.com/tavily-ai/skills --skill tavily-extract

tavily extract

Extract clean markdown or text content from one or more URLs.

Before running

Run extract directly when tvly is available. Extract supports capped keyless access, so do not look for an API key or authenticate before the first request.

If tvly is missing, follow the tavily-cli setup before retrying. If the keyless cap is reached in an interactive session, run tvly login to open browser OAuth, then retry the original extraction once. In an unattended environment, report the cap and authentication options instead of starting an interactive flow. Do not start a second login immediately after guided setup has completed.

When to use

  • You have a specific URL and want its content
  • You need text from JavaScript-rendered pages
  • Step 2 in the workflow: search → extract → map → crawl → research

Quick start

# Single URL
tvly extract "https://example.com/article" --json

# Multiple URLs
tvly extract "https://example.com/page1" "https://example.com/page2" --json

# Query-focused extraction (returns relevant chunks only)
tvly extract "https://example.com/docs" --query "authentication API" --chunks-per-source 3 --json

# JS-heavy pages
tvly extract "https://app.example.com" --extract-depth advanced --json

# Save to file
tvly extract "https://example.com/article" -o article.json

Options

OptionDescription
--queryRerank chunks by relevance to this query
--chunks-per-sourceChunks per URL (1-5, requires --query)
--extract-depthbasic (default) or advanced (for JS pages)
--formatmarkdown (default) or text
--include-imagesInclude image URLs
--timeoutMax wait time (1-60 seconds)
-o, --outputSave the JSON response to a file
--jsonStructured JSON output

Extract depth

DepthWhen to use
basicSimple pages, fast — try this first
advancedJS-rendered SPAs, dynamic content, tables

Tips

  • Max 20 URLs per request — batch larger lists into multiple calls.
  • Use --query + --chunks-per-source to get only relevant content instead of full pages.
  • Try basic first, fall back to advanced if content is missing.
  • Set --timeout for slow pages (up to 60s).
  • Inspect failed_results even after exit code 0. A successful request can still return no extracted pages. Retry the affected URL with advanced when appropriate, otherwise report the per-URL failure instead of treating the request as complete.
  • If search results already contain the content you need (via --include-raw-content), skip the extract step.

See also

tavily-ai tarafından daha fazla skill

research
tavily-ai
Herhangi bir konuda otomatik kaynak toplama, analiz ve alıntılarla kapsamlı araştırma. Açık alıntılarla çoklu kaynak web araştırması yapar; karşılaştırmalar, güncel olaylar, pazar analizi ve detaylı raporlar için idealdir. Üç model seçeneği sunar: hedefli tek konulu araştırma için mini (~30 sn), kapsamlı çok açılı analiz için pro (~60-120 sn) ve API tabanlı karmaşıklık algılama için auto. Tavily MCP sunucusu üzerinden OAuth ile kimlik doğrulama yapar ve otomatik tarayıcı tabanlı giriş ile...
search
tavily-ai
LLM için optimize edilmiş sonuçlar, alaka düzeyi puanlaması ve esnek filtreleme ile web araması. Yapılandırılabilir gecikme ve alaka düzeyi dengeleriyle dört arama derinliği modunu (ultra hızlı, hızlı, temel, gelişmiş) destekler. Alan filtresi, zaman aralığı kısıtlamaları, tarih aralıkları, ülke önceliklendirmesi ve ham içerik çıkarma içerir. Başlık, URL, içerik parçacığı ve alaka düzeyi puanı ile sonuçlar döndürür; isteğe bağlı görsel sonuçları ve faviconlar. Tavily MCP sunucusu veya API anahtarı yapılandırması aracılığıyla
tavily-best-practices
tavily-ai
We need to translate the given English text into Turkish, preserving the name "tavily-best-practices" but not including it unless it appears in the source. The source text does not include the name, so we just translate the description. We must preserve product names, protocol names, URLs, numbers, technical terms. No extra commentary. The text: "Web search API for LLMs with real-time data access, content extraction, site crawling, and AI-powered research. Five core methods: search() for web results, extract() for URL content, crawl() for site-wide extraction, map() for URL discovery, and research() for end-to-end AI synthesis Supports Python and JavaScript SDKs with async clients for parallel queries and configurable search depth (ultra-fast/fast/basic/advanced) Crawl method accepts semantic instructions to focus extraction on..." Translate to Turkish. Note: "LLMs" should remain as is. "API" remains. Method names like search(), extract(), etc. remain. "SDKs" remains. "async clients" - maybe "asenk
tavily-cli
tavily-ai
Web araması, içerik çıkarma, site tarama ve Tavily CLI üzerinden derin araştırma. Arama, çıkarma, URL keşfi, toplu tarama ve alıntılarla çoklu kaynak araştırmasını kapsayan beş komut modu. Tüm komutlar, yapılandırılmış, aracı tabanlı iş akışları için JSON çıktısı ve dosyaya kaydetmeyi destekler. İhtiyaçlarınıza göre basit aramadan çıkarma, haritalama, tarama ve kapsamlı araştırmaya yönlendiren bir yükseltme deseni. tavily-cli kurulumu ve tvly login ile API anahtarı kimlik doğrulaması gerektirir.
tavily-crawl
tavily-ai
Çok sayfalı web sitesi tarayıcısı, anlamsal filtreleme ve markdown dışa aktarma ile. Derinlik ve genişlik kontrolü ile tüm site bölümlerini tarayın; sonuçları odaklamak için yol regex'i, alan adı veya doğal dil talimatlarıyla filtreleyin Her sayfayı --output-dir aracılığıyla yerel markdown dosyaları olarak kaydedin veya aracı işleme için yapılandırılmış JSON döndürün Sonuçları LLM'lere beslerken bağlam şişmesini önlemek için parça çıkarma ile anlamsal talimatlar kullanın; çevrimdışı dokümantasyon indirmeleri için tam sayfa çıkarma kullanın Destekler...
tavily-dynamic-search
tavily-ai
Web'de arama yap, sonuçları filtrele ve içerik çıkar, böylece ham arama verileri asla bağlam pencerene girmez. Yalnızca düzenlenmiş print() çıktın geri döner.
tavily-research
tavily-ai
Çoklu kaynak sentezi ve alıntılarla kapsamlı yapay zeka destekli araştırma. Web kaynaklarına dayalı yapılandırılmış raporlar üretir, model seçimine bağlı olarak 30-120 saniye sürer (mini hedefli sorgular için, pro karmaşık karşılaştırmalar için). Birden çok çıktı formatını destekler: markdown raporları, özel şemalarla JSON ve yapılandırılabilir alıntı stilleri (numaralı, MLA, APA, Chicago). --no-wait, status ve poll komutları aracılığıyla uzun süreli araştırma için async iş akışı ve gerçek zamanlı...
tavily-search
tavily-ai
LLM için optimize edilmiş sonuçlar, içerik parçacıkları ve alaka düzeyi puanları ile web araması. Dört arama derinliğini (ultra hızlı, hızlı, temel, gelişmiş) destekler, yapılandırılabilir sonuç sayıları 20'ye kadar çıkar, ayrıca alan filtresi ve zaman aralığı kısıtlamaları sunar. LLM tüketimi için optimize edilmiş içerik parçacıkları, alaka düzeyi puanları ve meta verilerle yapılandırılmış JSON çıktısı döndürür. Haber ve finans konuları için özel arama modları içerir, isteğe bağlı AI tarafından oluşturulan yanıtlar ve tam sayfa içerik