Scrapeless

resmi

Gerçek zamanlı Scrapeless Google SERP (Google Arama, Google Uçuş, Google Harita, Google İşler...) sonuçlarını LLM uygulamalarınıza entegre edin. Bu sunucu, AI iş akışları, sohbet robotları ve araştırma araçları için dinamik bağlam alımını sağlar.

Scrapeless MCP ile neler yapabilirsiniz?

  • Google arama ve trendlergoogle_search ve google_trends ile canlı arama sonuçları veya trend verileri isteyin.
  • Tarayıcı otomasyonubrowser_goto ve browser_click gibi araçları kullanarak bulut tabanlı bir tarayıcıyı gezinme, tıklama, kaydırma ve ekran görüntüsü alma işlemleri için yönlendirin.
  • Herhangi bir URL'yi kazıyınscrape_html, scrape_markdown veya scrape_screenshot ile bir sayfanın HTML'sini, Markdown'ını veya ekran görüntüsünü alın.
  • Tüm siteleri tarayıncrawl_start ile eşzamansız bir tarama işi başlatın, ardından crawl_result ile sonuçları yoklayın.
  • Yapay zeka destekli çıkarım — ChatGPT, Gemini veya Perplexity gibi motorlar için yapılandırılmış kazıma görevleri oluşturmak üzere ai_scraper kullanın.

Dokümantasyon

preview

Scrapeless MCP Sunucusu

Scrapeless Model Context Protocol (MCP) Sunucusuna hoş geldiniz — LLM'lerin, AI Ajanlarının ve AI uygulamalarının web ile gerçek zamanlı olarak etkileşime girmesini sağlayan güçlü bir entegrasyon katmanı.

Açık MCP standardı üzerine inşa edilen Scrapeless MCP Sunucusu, ChatGPT, Claude gibi modelleri ve Cursor ile Windsurf gibi araçları aşağıdakiler de dahil olmak üzere çok çeşitli harici yeteneklere sorunsuz bir şekilde bağlar:

  • Google hizmetleri entegrasyonu (Arama, Trendler)
  • Sayfa düzeyinde gezinme ve etkileşim için tarayıcı otomasyonu
  • Dinamik, yoğun JavaScript kullanan siteleri kazıyın — HTML, Markdown veya ekran görüntüsü olarak dışa aktarın
  • Bağlantıları takip ederek tüm web sitelerini tarayın ve her sayfayı birden fazla formatta yakalayın
  • AI Kazıyıcı ChatGPT, Gemini, Perplexity, Copilot, Google AI Mode, Google AI Overview, Grok veya Alexa için bir AI Kazıyıcı görevi oluşturun

İster bir AI araştırma asistanı, ister bir kodlama yardımcı pilotu veya otonom web ajanları oluşturuyor olun, bu sunucu iş akışlarınızın ihtiyaç duyduğu dinamik bağlamı ve gerçek dünya verilerini sağlar — engellenmeden.

Kullanım Örnekleri

  1. Claude ile Otomatik Web Etkileşimi ve Veri Çıkarma

Scrapeless MCP Tarayıcı'yı kullanarak Claude, konuşma komutları aracılığıyla web gezintisi, tıklama, kaydırma ve kazıma gibi karmaşık görevleri gerçekleştirebilir; web etkileşim sonuçlarının gerçek zamanlı önizlemesi live sessions üzerinden yapılır.

preview

  1. Cloudflare'i Atlayarak Hedef Sayfa İçeriğini Alma

Scrapeless MCP Tarayıcı hizmetini kullanarak Cloudflare sayfasına otomatik olarak erişilir ve işlem tamamlandıktan sonra sayfa içeriği çıkarılarak Markdown formatında döndürülür.

preview

  1. Dinamik Olarak İşlenen Sayfa İçeriğini Çıkarma ve Dosyaya Yazma

Scrapeless MCP Evrensel API'sini kullanarak yukarıdaki hedef sayfanın JavaScript ile işlenmiş içeriği kazınır, Markdown formatında dışa aktarılır ve son olarak text.md adlı yerel bir dosyaya yazılır.

preview

  1. Otomatik SERP Kazıma

Scrapeless MCP Sunucusunu kullanarak Google Arama'da "web scraping" anahtar kelimesini sorgulayın, ilk 10 arama sonucunu (başlık, bağlantı ve özet dahil) alın ve içeriği serp.text adlı dosyaya yazın.

preview

Bu sunucuların nasıl kullanılacağına dair bazı ek örnekler:

Örnek
Google aramasıyla scrapeless'ı arayın.
Son bir yılda "AI" için arama ilgisini bulun.
chatgpt.com adresini ziyaret etmek için bir tarayıcı kullanın, "Bugün hava nasıl?" diye arayın ve sonuçları özetleyin.
scrapeless.com sayfasının HTML içeriğini kazıyın.
scrapeless.com sayfasının Markdown içeriğini kazıyın.
scrapeless.com sayfasının ekran görüntülerini alın.

Kurulum Rehberi

  1. Scrapeless Anahtarını Alın
  • Scrapeless Panosuna giriş yapın (Ücretsiz deneme mevcuttur)
  • Ardından soldaki "Ayarlar"a tıklayın -> "API Anahtarı Yönetimi"ni seçin -> "API Anahtarı Oluştur"a tıklayın. Son olarak, oluşturduğunuz API Anahtarına tıklayarak kopyalayın.

preview

  1. MCP İstemcinizi Yapılandırın

Scrapeless MCP Sunucusu hem Stdio hem de Streamable HTTP aktarım modlarını destekler.

🖥️ Stdio (Yerel Yürütme)

{
  "mcpServers": {
    "Scrapeless MCP Server": {
      "command": "npx",
      "args": ["-y", "scrapeless-mcp-server"],
      "env": {
        "SCRAPELESS_API_KEY": "YOUR_SCRAPELESS_KEY"
      }
    }
  }
}

🌐 Streamable HTTP (Barındırılan API Modu)

{
  "mcpServers": {
    "Scrapeless MCP Server": {
      "type": "streamable-http",
      "url": "https://api.scrapeless.com/mcp",
      "headers": {
        "x-api-token": "YOUR_SCRAPELESS_KEY"
      },
      "disabled": false,
      "alwaysAllow": []
    }
  }
}

Gelişmiş Seçenekler

Tarayıcı oturumu davranışını isteğe bağlı parametrelerle özelleştirin. Bunlar, ortam değişkenleri (Stdio için) veya HTTP başlıkları (Streamable HTTP için) aracılığıyla ayarlanabilir:

Stdio (Env Değişkeni)Streamable HTTP (HTTP Başlığı)Açıklama
BROWSER_PROFILE_IDx-browser-profile-idOturum sürekliliği için yeniden kullanılabilir bir tarayıcı profili kimliği belirtir.
BROWSER_PROFILE_PERSISTx-browser-profile-persistÇerezler, yerel depolama vb. için kalıcı depolamayı etkinleştirir.
BROWSER_SESSION_TTLx-browser-session-ttlSaniye cinsinden maksimum oturum zaman aşımını tanımlar. Oturum, bu hareketsizlik süresinden sonra otomatik olarak sona erer.

Claude Desktop ile Entegrasyon

  1. Claude Desktop'ı açın
  2. Şuraya gidin: SettingsToolsMCP Servers
  3. **"MCP Sunucusu Ekle"**ye tıklayın
  4. Yukarıdaki Stdio veya Streamable HTTP yapılandırmasını yapıştırın
  5. Sunucuyu kaydedin ve etkinleştirin
  6. Claude artık Scrapeless kullanarak web sorguları yapabilecek, içerik çıkarabilecek ve sayfalarla etkileşime girebilecek

Cursor IDE ile Entegrasyon

  1. Cursor'ı açın
  2. Cmd + Shift + P tuşuna basın ve şunu arayın: Configure MCP Servers
  3. Yukarıdaki formatı kullanarak Scrapeless MCP yapılandırmasını ekleyin
  4. Dosyayı kaydedin ve Cursor'ı yeniden başlatın (gerekirse)
  5. Artık Cursor'a şunun gibi şeyler sorabilirsiniz:
    1. "Search StackOverflow for a solution to this error"
    2. "Scrape the HTML from this page"
  6. Ve arka planda Scrapeless kullanacaktır.

Desteklenen MCP Araçları

AdAçıklama
google_searchEvrensel bilgi arama motoru.
google_trendsGoogle Trends'ten trend arama verilerini alın.
browser_createScrapeless kullanarak bir bulut tarayıcı oturumu oluşturun veya yeniden kullanın.
browser_closeBulut tarayıcısının bağlantısını keserek geçerli oturumu kapatır.
browser_gotoTarayıcıyı belirtilen bir URL'ye yönlendirin.
browser_go_backTarayıcı geçmişinde bir adım geri gidin.
browser_go_forwardTarayıcı geçmişinde bir adım ileri gidin.
browser_clickSayfadaki belirli bir öğeye tıklayın.
browser_typeBelirtilen bir giriş alanına metin yazın.
browser_press_keyBir tuşa basmayı simüle edin.
browser_wait_forBelirli bir sayfa öğesinin görünmesini bekleyin.
browser_waitYürütmeyi sabit bir süre duraklatın.
browser_screenshotGeçerli sayfanın ekran görüntüsünü alın.
browser_get_htmlGeçerli sayfanın tam HTML'ini alın.
browser_get_textGeçerli sayfadaki tüm görünür metni alın.
browser_scrollSayfanın altına kaydırın.
browser_scroll_toBelirli bir öğeyi görünüme kaydırın.
scrape_htmlBir URL'yi kazıyın ve tam HTML içeriğini döndürün.
scrape_markdownBir URL'yi kazıyın ve içeriğini Markdown olarak döndürün.
scrape_screenshotHerhangi bir web sayfasının yüksek kaliteli ekran görüntüsünü alın.
crawl_startTemel bir URL'den eşzamansız bir tarama işi başlatın ve iş kimliğini döndürün.
crawl_cancelDevam eden bir tarama işini kimliğine göre iptal edin.
crawl_resultBir tarama işini kimliğine göre tamamlanana kadar yoklayın ve taranan verileri döndürün.
ai_scraperChatGPT, Gemini, Perplexity, Copilot, Google AI Mode, Google AI Overview, Grok veya Alexa için bir AI Kazıyıcı görevi oluşturun.

Güvenlik En İyi Uygulamaları

Scrapeless MCP Sunucusunu LLM'lerle (ChatGPT, Claude veya Cursor gibi) kullanırken, kazınan veya çıkarılan tüm web içeriğini dikkatli bir şekilde ele almak kritik öneme sahiptir. Web verileri varsayılan olarak güvenilmezdir ve yanlış kullanım, uygulamanızı komut enjeksiyonu veya diğer güvenlik açıklarına maruz bırakabilir.

✅ Önerilen Uygulamalar

  • Ham kazınmış içeriği asla doğrudan LLM istemlerine aktarmayın. Ham HTML, JavaScript veya kullanıcı tarafından oluşturulan metin, gizli enjeksiyon yükleri içerebilir.
  • Çıkarılan tüm içeriği temizleyin ve doğrulayın. Alt akış mantığında veya AI modellerinde kullanmadan önce potansiyel olarak zararlı etiketleri ve komut dosyalarını kaldırın veya kaçış karakterleriyle işaretleyin.
  • Serbest biçimli metin yerine yapılandırılmış çıkarmayı tercih edin. Yalnızca güvendiğiniz içeriği çıkarmak için scrape_html, scrape_markdown veya bilinen güvenli seçicilerle hedeflenmiş browser_get_text gibi araçları kullanın.
  • Dinamik olarak oluşturulan sayfaları kazırken alan adı veya seçici beyaz listesi uygulayın ve veri akışını bilinen ve güvenilir kaynaklarla sınırlandırın.
  • Tarayıcı veya kazıma araçları aracılığıyla yapılan tüm giden istekleri günlüğe kaydedin ve izleyin, özellikle hassas veriler, belirteçler veya dahili ağ erişimiyle ilgileniyorsanız.

🚫 Kaçının

  • Kazınmış HTML'i doğrudan istemlere enjekte etmek
  • Kullanıcıların doğrulama olmadan rastgele URL'ler veya CSS seçicileri belirtmesine izin vermek
  • Gelecekteki istem kullanımı için filtrelenmemiş kazınmış içeriği saklamak

Topluluk

Bize Ulaşın

Sorular, öneriler veya iş birliği talepleri için bizimle şu yollarla iletişime geçmekten çekinmeyin: