tavily-extract

tarafından tavily-ai

20 URL'ye kadar temiz markdown veya metin çıkarır; JavaScript işleme ve sorgu odaklı parçalama desteği sunar. JavaScript ile oluşturulmuş sayfaları, yapılandırılabilir çıkarma derinliğiyle (basit sayfalar için temel, dinamik SPA'lar ve tablolar için gelişmiş) işler. Tam sayfalar yerine yalnızca ilgili içerik parçalarını döndürmek için sorgu odaklı çıkarmayı destekler. Varsayılan olarak LLM için optimize edilmiş markdown döndürür; düz metin biçimi ve yapılandırılmış JSON çıktısı seçenekleri sunar. Tek bir çağrıda 20 URL'ye kadar işler;...

npx skills add https://github.com/tavily-ai/skills --skill tavily-extract

tavily extract

Extract clean markdown or text content from one or more URLs.

Before running any command

If tvly is not found on PATH, install it first:

curl -fsSL https://cli.tavily.com/install.sh | bash && tvly login

Do not skip this step or fall back to other tools.

See tavily-cli for alternative install methods and auth options.

When to use

  • You have a specific URL and want its content
  • You need text from JavaScript-rendered pages
  • Step 2 in the workflow: search → extract → map → crawl → research

Quick start

# Single URL
tvly extract "https://example.com/article" --json

# Multiple URLs
tvly extract "https://example.com/page1" "https://example.com/page2" --json

# Query-focused extraction (returns relevant chunks only)
tvly extract "https://example.com/docs" --query "authentication API" --chunks-per-source 3 --json

# JS-heavy pages
tvly extract "https://app.example.com" --extract-depth advanced --json

# Save to file
tvly extract "https://example.com/article" -o article.md

Options

OptionDescription
--queryRerank chunks by relevance to this query
--chunks-per-sourceChunks per URL (1-5, requires --query)
--extract-depthbasic (default) or advanced (for JS pages)
--formatmarkdown (default) or text
--include-imagesInclude image URLs
--timeoutMax wait time (1-60 seconds)
-o, --outputSave output to file
--jsonStructured JSON output

Extract depth

DepthWhen to use
basicSimple pages, fast — try this first
advancedJS-rendered SPAs, dynamic content, tables

Tips

  • Max 20 URLs per request — batch larger lists into multiple calls.
  • Use --query + --chunks-per-source to get only relevant content instead of full pages.
  • Try basic first, fall back to advanced if content is missing.
  • Set --timeout for slow pages (up to 60s).
  • If search results already contain the content you need (via --include-raw-content), skip the extract step.

See also

tavily-ai tarafından daha fazla skill

research
tavily-ai
Herhangi bir konuda otomatik kaynak toplama, analiz ve alıntılarla kapsamlı araştırma. Açık alıntılarla çoklu kaynak web araştırması yapar; karşılaştırmalar, güncel olaylar, pazar analizi ve detaylı raporlar için idealdir. Üç model seçeneği sunar: hedefli tek konulu araştırma için mini (~30 sn), kapsamlı çok açılı analiz için pro (~60-120 sn) ve API tabanlı karmaşıklık algılama için auto. Tavily MCP sunucusu üzerinden OAuth ile kimlik doğrulama yapar ve otomatik tarayıcı tabanlı giriş ile...
official
search
tavily-ai
LLM için optimize edilmiş sonuçlar, alaka düzeyi puanlaması ve esnek filtreleme ile web araması. Yapılandırılabilir gecikme ve alaka düzeyi dengeleriyle dört arama derinliği modunu (ultra hızlı, hızlı, temel, gelişmiş) destekler. Alan filtresi, zaman aralığı kısıtlamaları, tarih aralıkları, ülke önceliklendirmesi ve ham içerik çıkarma içerir. Başlık, URL, içerik parçacığı ve alaka düzeyi puanı ile sonuçlar döndürür; isteğe bağlı görsel sonuçları ve faviconlar. Tavily MCP sunucusu veya API anahtarı yapılandırması aracılığıyla
official
tavily-best-practices
tavily-ai
We need to translate the given English text into Turkish, preserving the name "tavily-best-practices" but not including it unless it appears in the source. The source text does not include the name, so we just translate the description. We must preserve product names, protocol names, URLs, numbers, technical terms. No extra commentary. The text: "Web search API for LLMs with real-time data access, content extraction, site crawling, and AI-powered research. Five core methods: search() for web results, extract() for URL content, crawl() for site-wide extraction, map() for URL discovery, and research() for end-to-end AI synthesis Supports Python and JavaScript SDKs with async clients for parallel queries and configurable search depth (ultra-fast/fast/basic/advanced) Crawl method accepts semantic instructions to focus extraction on..." Translate to Turkish. Note: "LLMs" should remain as is. "API" remains. Method names like search(), extract(), etc. remain. "SDKs" remains. "async clients" - maybe "asenk
official
tavily-cli
tavily-ai
Web araması, içerik çıkarma, site tarama ve Tavily CLI üzerinden derin araştırma. Arama, çıkarma, URL keşfi, toplu tarama ve alıntılarla çoklu kaynak araştırmasını kapsayan beş komut modu. Tüm komutlar, yapılandırılmış, aracı tabanlı iş akışları için JSON çıktısı ve dosyaya kaydetmeyi destekler. İhtiyaçlarınıza göre basit aramadan çıkarma, haritalama, tarama ve kapsamlı araştırmaya yönlendiren bir yükseltme deseni. tavily-cli kurulumu ve tvly login ile API anahtarı kimlik doğrulaması gerektirir.
official
tavily-crawl
tavily-ai
Çok sayfalı web sitesi tarayıcısı, anlamsal filtreleme ve markdown dışa aktarma ile. Derinlik ve genişlik kontrolü ile tüm site bölümlerini tarayın; sonuçları odaklamak için yol regex'i, alan adı veya doğal dil talimatlarıyla filtreleyin Her sayfayı --output-dir aracılığıyla yerel markdown dosyaları olarak kaydedin veya aracı işleme için yapılandırılmış JSON döndürün Sonuçları LLM'lere beslerken bağlam şişmesini önlemek için parça çıkarma ile anlamsal talimatlar kullanın; çevrimdışı dokümantasyon indirmeleri için tam sayfa çıkarma kullanın Destekler...
official
tavily-dynamic-search
tavily-ai
Web'de arama yap, sonuçları filtrele ve içerik çıkar, böylece ham arama verileri asla bağlam pencerene girmez. Yalnızca düzenlenmiş print() çıktın geri döner.
official
tavily-map
tavily-ai
Web sitelerinde içerik çıkarmadan hızlı URL keşfi, büyük sitelerde belirli sayfaları bulmak için idealdir. Yapılandırılabilir derinlik ve genişlik, regex yol filtrelemesi ve anlamsal filtreleme için doğal dil talimatları ile bir alandaki tüm URL'lerin yapılandırılmış listelerini döndürür. Derinlik kontrolünü (1–5 seviye), sayfa başına genişlik sınırlarını, harici bağlantı ekleme/hariç tutma ve regex desenleri aracılığıyla alan filtrelemesini destekler. Bir iş akışında 1. adım olarak tasarlanmıştır: doğru sayfayı bulmak için haritalayın, ardından çıkarma veya...
official
tavily-research
tavily-ai
Çoklu kaynak sentezi ve alıntılarla kapsamlı yapay zeka destekli araştırma. Web kaynaklarına dayalı yapılandırılmış raporlar üretir, model seçimine bağlı olarak 30-120 saniye sürer (mini hedefli sorgular için, pro karmaşık karşılaştırmalar için). Birden çok çıktı formatını destekler: markdown raporları, özel şemalarla JSON ve yapılandırılabilir alıntı stilleri (numaralı, MLA, APA, Chicago). --no-wait, status ve poll komutları aracılığıyla uzun süreli araştırma için async iş akışı ve gerçek zamanlı...
official