Firecrawl MCP

आधिकारिक

LLM क्लाइंट जैसे Cursor और Claude में शक्तिशाली वेब स्क्रैपिंग और खोज क्षमताएँ जोड़ता है।

Firecrawl MCP के साथ आप क्या कर सकते हैं?

  • किसी भी URL को स्क्रैप करेंfirecrawl_scrape का उपयोग करके किसी पेज की सामग्री को मार्कडाउन या आपके द्वारा प्रदान किए गए स्कीमा से मेल खाते संरचित JSON के रूप में निकालें।
  • वेब खोजेंfirecrawl_search का उपयोग करके किसी क्वेरी से रैंक किए गए परिणाम प्राप्त करें, वैकल्पिक रूप से उसी कॉल में पेज की सामग्री भी लाएँ।
  • साइट URL खोजेंfirecrawl_map का उपयोग करके किसी साइट पर सभी अनुक्रमित URL की सूची बनाएं, बिना उनकी सामग्री लाए।
  • कई पेज क्रॉल करेंfirecrawl_crawl का उपयोग करके किसी साइट के अंतर्गत कई पेजों से सामग्री निकालें, जो limit और maxDiscoveryDepth द्वारा सीमित हो।
  • पेजों के साथ इंटरैक्ट करेंfirecrawl_interact का उपयोग करके पेज पढ़ने से पहले क्लिक करें, टाइप करें, या नेविगेट करें, और scrapeId के माध्यम से जारी रखें।
  • स्वायत्त अनुसंधान चलाएँfirecrawl_agent का उपयोग करके जब आप सटीक URL नहीं जानते हों, तो कई स्रोतों से संरचित डेटा एकत्र करें।

दस्तावेज़

Firecrawl MCP सर्वर

एक मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वर जो Firecrawl को MCP-संगत AI एजेंटों तक लाता है — खोजें, स्क्रेप करें, और लाइव वेब के साथ इंटरैक्ट करें, स्वच्छ, एजेंट-तैयार संदर्भ के लिए।

@vrknetha और @knacklabs को प्रारंभिक कार्यान्वयन के लिए बड़ा धन्यवाद!

विशेषताएँ

  • वेब खोजें और पूर्ण पृष्ठ सामग्री प्राप्त करें
  • कोडिंग एजेंटों के लिए बनाए गए इंडेक्स में खोजें: GitHub मुद्दे, मर्ज किए गए पुल रिक्वेस्ट, README, और दस्तावेज़
  • किसी भी URL को स्वच्छ, संरचित डेटा में स्क्रेप करें
  • पृष्ठों के साथ इंटरैक्ट करें — क्लिक करें, नेविगेट करें, और संचालित करें
  • स्वायत्त एजेंट के साथ गहन शोध
  • स्वचालित पुनः प्रयास और दर सीमा
  • क्लाउड और सेल्फ-होस्टेड समर्थन
  • SSE समर्थन

MCP.so के प्लेग्राउंड पर हमारे MCP सर्वर या Klavis AI पर आज़माएं।

इस सर्वर का उपयोग कब करें

  • firecrawl_scrape का उपयोग करें जब आपके पास ज्ञात URL हो और आप उसकी सामग्री मार्कडाउन या आपके द्वारा प्रदान किए गए स्कीमा से मेल खाते JSON के रूप में चाहते हैं।
  • firecrawl_map का उपयोग करें जब आपको साइट पर URL खोजने की आवश्यकता हो, बिना उनकी सामग्री प्राप्त किए।
  • firecrawl_crawl का उपयोग करें जब आपको साइट के अंतर्गत कई पृष्ठों से सामग्री चाहिए; इसे सीमित करने के लिए limit, includePaths/excludePaths, या maxDiscoveryDepth सेट करें।
  • firecrawl_search का उपयोग करें जब आप URL के बजाय क्वेरी से शुरू कर रहे हों और रैंक किए गए वेब परिणाम चाहते हों; यदि आप उसी कॉल में पृष्ठ सामग्री भी प्राप्त करना चाहते हैं तो scrapeOptions जोड़ें (केवल-खोज एंडपॉइंट कभी सामग्री नहीं प्राप्त करता)।
  • firecrawl_interact का उपयोग करें जब किसी पृष्ठ को पढ़ने से पहले क्लिक, टाइप, या नेविगेट क्रिया की आवश्यकता हो — नए पृष्ठ के लिए url पास करें या पहले से स्क्रेप किए गए पृष्ठ पर जारी रखने के लिए scrapeId पास करें।
  • firecrawl_monitor_* टूल का उपयोग करें जब एक ही पृष्ठ को एक बार प्राप्त करने के बजाय अंतर और परिवर्तन अलर्ट के साथ आवर्ती अनुसूची पर जांचने की आवश्यकता हो।
  • कुछ और विचार करें जब आपको अपने स्वयं के पुनः प्रयास और समाप्ति तर्क के साथ कई चरणों में ब्राउज़र सत्र खुला रखने की आवश्यकता हो: प्रत्येक firecrawl_interact कॉल एक prompt या code टर्न पूरा करता है और नियंत्रण लौटाता है — सत्र scrapeId के माध्यम से कॉल के बीच बना रह सकता है और firecrawl_interact_stop के साथ समाप्त होता है, लेकिन आप इसे एक कॉल के भीतर क्लाइंट पक्ष से चरण-दर-चरण इंटरैक्टिव रूप से चला नहीं सकते।

यह सर्वर 25 टूल सूचीबद्ध करता है जब पूर्ण प्रोफ़ाइल डिफ़ॉल्ट सेटिंग्स के साथ पंजीकृत होती है (फीडबैक टूल शामिल, स्थानीय कीलेस मोड में नहीं चल रहा)। FIRECRAWL_NO_SEARCH_FEEDBACK=1 और/या FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 सेट करने से संबंधित फीडबैक टूल हट जाते हैं और यह संख्या कम हो जाती है, जैसा कि स्थानीय कीलेस स्टार्टअप करता है। टूल-स्लॉट सीमा वाले क्लाइंट के लिए: होस्टेड कीलेस एंडपॉइंट (https://mcp.firecrawl.dev/v2/mcp, कोई API कुंजी नहीं) केवल 3 उजागर करता है — firecrawl_scrape, firecrawl_search, firecrawl_parse — और समर्पित केवल-खोज एंडपॉइंट (https://mcp.firecrawl.dev/v2/mcp-search) एक निश्चित 6 केवल-पठन टूल उजागर करता है।

स्थापना

होस्टेड MCP (कीलेस मुफ्त स्तर)

बिना किसी सेटअप के दूरस्थ होस्टेड सर्वर से कनेक्ट करें:

https://mcp.firecrawl.dev/v2/mcp

कीलेस मुफ्त स्तर पर, scrape, search, और parse बिना API कुंजी के काम करते हैं (दर-सीमित)। crawl, map, और agent जैसे अन्य टूल को अभी भी कुंजी की आवश्यकता होती है।

जब भी मानव साइन अप कर सकता है, OAuth या API कुंजी पसंद करें। यह पूर्ण टूल सेट और उच्च सीमाएँ अनलॉक करता है।

इंटरैक्टिव खाता कनेक्शन के लिए, अपने MCP क्लाइंट को इस सर्वर URL का उपयोग करने के लिए कॉन्फ़िगर करें। यह एक MCP एंडपॉइंट है, ब्राउज़र पृष्ठ नहीं; क्लाइंट के खाता-कनेक्शन प्रवाह का उपयोग करें और पुनः कनेक्ट करते समय दूसरा Firecrawl सर्वर प्रविष्टि न जोड़ें:

https://mcp.firecrawl.dev/v2/mcp-oauth

API-कुंजी कनेक्शन के लिए (उदाहरण के लिए, एक अनियंत्रित एकीकरण), सर्वर URL को इस प्रकार रखें:

https://mcp.firecrawl.dev/v2/mcp

फिर क्लाइंट की सुरक्षित हेडर या गुप्त सेटिंग को इसके साथ कॉन्फ़िगर करें:

Authorization: Bearer <FIRECRAWL_API_KEY>

API कुंजी को सर्वर URL में कभी न रखें। API कुंजी को एजेंट चैट में कभी न रखें। इसे सीधे क्लाइंट या गुप्त प्रबंधक में कॉन्फ़िगर करें। क्लाइंट-विशिष्ट निर्देशों के लिए होस्टेड MCP सेटअप गाइड और एजेंट ऑनबोर्डिंग गाइड देखें।

केवल-खोज एंडपॉइंट

एक केवल-पठन, केवल-खोज सतह भी यहाँ होस्ट की गई है:

https://mcp.firecrawl.dev/v2/mcp-search

यह छह केवल-पठन टूल का एक निश्चित सेट उजागर करता है: firecrawl_search, firecrawl_developer_search, और चार firecrawl_research_* टूल। यह कोई पृष्ठ-सामग्री प्राप्ति नहीं करता और इसकी अपनी OAuth पहचान है; उपरोक्त पूर्ण एंडपॉइंट अपरिवर्तित है। पूर्ण अनुबंध के लिए docs/search-profile.md देखें।

npx के साथ चलाना

env FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

मैन्युअल स्थापना

npm install -g firecrawl-mcp

Cursor पर चलाना

Cursor कॉन्फ़िगर करना 🖥️ नोट: Cursor संस्करण 0.45.6+ आवश्यक है सबसे अद्यतित कॉन्फ़िगरेशन निर्देशों के लिए, MCP सर्वर कॉन्फ़िगर करने पर आधिकारिक Cursor दस्तावेज़ देखें: Cursor MCP सर्वर कॉन्फ़िगरेशन गाइड

Cursor v0.48.6 में Firecrawl MCP कॉन्फ़िगर करने के लिए

  1. Cursor सेटिंग्स खोलें
  2. Features > MCP Servers पर जाएं
  3. "+ Add new global MCP server" पर क्लिक करें
  4. निम्नलिखित कोड दर्ज करें:
    {
      "mcpServers": {
        "firecrawl-mcp": {
          "command": "npx",
          "args": ["-y", "firecrawl-mcp"],
          "env": {
            "FIRECRAWL_API_KEY": "YOUR-API-KEY"
          }
        }
      }
    }
    

Cursor v0.45.6 में Firecrawl MCP कॉन्फ़िगर करने के लिए

  1. Cursor सेटिंग्स खोलें
  2. Features > MCP Servers पर जाएं
  3. "+ Add New MCP Server" पर क्लिक करें
  4. निम्नलिखित दर्ज करें:
    • नाम: "firecrawl-mcp" (या आपका पसंदीदा नाम)
    • प्रकार: "command"
    • कमांड: env FIRECRAWL_API_KEY=your-api-key npx -y firecrawl-mcp

यदि आप Windows का उपयोग कर रहे हैं और समस्याओं का सामना कर रहे हैं, तो cmd /c "set FIRECRAWL_API_KEY=your-api-key && npx -y firecrawl-mcp" आज़माएं

your-api-key को अपनी Firecrawl API कुंजी से बदलें। यदि आपके पास अभी तक एक नहीं है, तो आप खाता बना सकते हैं और इसे https://www.firecrawl.dev/app/api-keys से प्राप्त कर सकते हैं

जोड़ने के बाद, नए टूल देखने के लिए MCP सर्वर सूची को रीफ्रेश करें। Composer एजेंट स्वचालित रूप से Firecrawl MCP का उपयोग करेगा जब उपयुक्त हो, लेकिन आप अपनी वेब स्क्रेपिंग आवश्यकताओं का वर्णन करके इसे स्पष्ट रूप से अनुरोध कर सकते हैं। Command+L (Mac) के माध्यम से Composer तक पहुंचें, सबमिट बटन के बगल में "Agent" चुनें, और अपनी क्वेरी दर्ज करें।

Windsurf पर चलाना

इसे अपने ./codeium/windsurf/model_config.json में जोड़ें:

{
  "mcpServers": {
    "mcp-server-firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

स्ट्रीमेबल HTTP स्थानीय मोड के साथ चलाना

डिफ़ॉल्ट stdio ट्रांसपोर्ट के बजाय स्ट्रीमेबल HTTP का उपयोग करके सर्वर को स्थानीय रूप से चलाने के लिए:

env HTTP_STREAMABLE_SERVER=true FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

URL का उपयोग करें: http://localhost:3000/mcp

Smithery के माध्यम से स्थापना (विरासत)

Smithery के माध्यम से Claude Desktop के लिए Firecrawl को स्वचालित रूप से स्थापित करने के लिए:

npx -y @smithery/cli install @mendableai/mcp-server-firecrawl --client claude

VS Code पर चलाना

एक-क्लिक स्थापना के लिए, नीचे दिए गए स्थापना बटनों में से एक पर क्लिक करें...

Install with NPX in VS Code Install with NPX in VS Code Insiders

मैन्युअल स्थापना के लिए, VS Code में अपनी उपयोगकर्ता सेटिंग्स (JSON) फ़ाइल में निम्नलिखित JSON ब्लॉक जोड़ें। आप Ctrl + Shift + P दबाकर और Preferences: Open User Settings (JSON) टाइप करके ऐसा कर सकते हैं।

{
  "mcp": {
    "inputs": [
      {
        "type": "promptString",
        "id": "apiKey",
        "description": "Firecrawl API Key",
        "password": true
      }
    ],
    "servers": {
      "firecrawl": {
        "command": "npx",
        "args": ["-y", "firecrawl-mcp"],
        "env": {
          "FIRECRAWL_API_KEY": "${input:apiKey}"
        }
      }
    }
  }
}

वैकल्पिक रूप से, आप इसे अपने कार्यक्षेत्र में .vscode/mcp.json नामक फ़ाइल में जोड़ सकते हैं। यह आपको कॉन्फ़िगरेशन को दूसरों के साथ साझा करने की अनुमति देगा:

{
  "inputs": [
    {
      "type": "promptString",
      "id": "apiKey",
      "description": "Firecrawl API Key",
      "password": true
    }
  ],
  "servers": {
    "firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "${input:apiKey}"
      }
    }
  }
}

कॉन्फ़िगरेशन

पर्यावरण चर

क्लाउड API के लिए आवश्यक

  • FIRECRAWL_API_KEY: आपकी Firecrawl API कुंजी
    • क्लाउड API का उपयोग करते समय आवश्यक (डिफ़ॉल्ट)
    • FIRECRAWL_API_URL के साथ सेल्फ-होस्टेड इंस्टेंस का उपयोग करते समय वैकल्पिक
  • FIRECRAWL_API_URL (वैकल्पिक): सेल्फ-होस्टेड इंस्टेंस के लिए कस्टम API एंडपॉइंट
    • उदाहरण: https://firecrawl.your-domain.com
    • यदि प्रदान नहीं किया गया है, तो क्लाउड API का उपयोग किया जाएगा (API कुंजी आवश्यक)

MCP OAuth (बियरर एक्सेस टोकन)

होस्टेड Firecrawl firecrawl.dev पर प्राधिकरण सर्वर के माध्यम से OAuth एक्सेस टोकन (fco_…) जारी कर सकता है। यह MCP सर्वर जो भी क्रेडेंशियल हल करता है उसे Firecrawl API को Authorization: Bearer … के रूप में अग्रेषित करता है।

  • HTTP स्ट्रीम ट्रांसपोर्ट (CLOUD_SERVICE=true, HTTP_STREAMABLE_SERVER=true, या SSE_LOCAL=true): क्लाइंट को MCP अनुरोधों पर Authorization: Bearer <fco_access_token> भेजना चाहिए। जब दोनों मौजूद हों, तो OAuth बियरर टोकन x-firecrawl-api-key / x-api-key पर प्राथमिकता लेता है।
  • stdio: स्थिर एक्सेस टोकन के लिए FIRECRAWL_OAUTH_TOKEN का उपयोग करें, या API कुंजी के लिए FIRECRAWL_API_KEY का उपयोग करते रहें।

केवल एक्सेस टोकन (fco_…) का उपयोग करें। रिफ्रेश टोकन (fcr_…) को टोकन एंडपॉइंट पर विनिमय किया जाना चाहिए, स्क्रेप/खोज API को पारित नहीं किया जाना चाहिए।

केवल-खोज सतह (होस्टेड)

होस्टेड मोड में (CLOUD_SERVICE=true) एक दूसरा इन-प्रोसेस इंस्टेंस केवल-खोज एंडपॉइंट की सेवा करता है। बंडल सेवा का एक निश्चित तैनाती अनुबंध है: nginx /v2/mcp-search को स्थानीय पोर्ट 3001 पर इंस्टेंस पर रूट करता है, और OAuth संरक्षित-संसाधन पहचानकर्ता https://mcp.firecrawl.dev/v2/mcp-search है।

FIRECRAWL_MCP_SEARCH_ENABLED (डिफ़ॉल्ट true) समर्थित परिचालन टॉगल है; खोज इंस्टेंस को शुरू होने से रोकने के लिए इसे false पर सेट करें। Node प्रक्रिया अलग-अलग परीक्षणों के लिए FIRECRAWL_MCP_SEARCH_PORT, FIRECRAWL_MCP_SEARCH_ENDPOINT, और FIRECRAWL_MCP_SEARCH_RESOURCE_URL भी स्वीकार करती है। ये ओवरराइड बंडल nginx रूट या प्राधिकरण सर्वर अनुमत सूची को पुन: कॉन्फ़िगर नहीं करते हैं और होस्टेड तैनाती में स्वतंत्र रूप से उपयोग नहीं किए जाने चाहिए।

खोज इंस्टेंस को प्रत्येक अनुरोध के लिए प्रमाणीकरण की आवश्यकता होती है (tools/list सहित) और उन OAuth टोकन को अस्वीकार करता है जिनका दर्शक अपने स्वयं के संसाधन से मेल नहीं खाता।

कॉन्फ़िगरेशन उदाहरण

क्लाउड API उपयोग के लिए:

export FIRECRAWL_API_KEY=your-api-key

सेल्फ-होस्टेड इंस्टेंस के लिए:

# Required for self-hosted
export FIRECRAWL_API_URL=https://firecrawl.your-domain.com

# Optional authentication for self-hosted
export FIRECRAWL_API_KEY=your-api-key  # If your instance requires auth

Claude Desktop के साथ उपयोग

इसे अपने claude_desktop_config.json में जोड़ें:

{
  "mcpServers": {
    "mcp-server-firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "YOUR_API_KEY_HERE"
      }
    }
  }
}

टूल कैसे चुनें

अपने कार्य के लिए सही टूल चुनने के लिए इस गाइड का उपयोग करें:

  • यदि आप सटीक URL जानते हैं: scrape का उपयोग करें (संरचित डेटा के लिए JSON प्रारूप के साथ)
  • यदि आपके पास कई ज्ञात URL हैं: प्रत्येक URL के लिए scrape कॉल करें। यदि आपको विशेष रूप से एक बल्क API ऑपरेशन की आवश्यकता है, तो MCP के बाहर Firecrawl API बैच एंडपॉइंट का उपयोग करें।
  • यदि आपको साइट पर URL खोजने की आवश्यकता है: map का उपयोग करें
  • यदि आप जानकारी के लिए वेब खोजना चाहते हैं: search का उपयोग करें
  • यदि आपके पास प्रोग्रामिंग प्रश्न है (एक लाइब्रेरी, एक API अनुबंध, एक त्रुटि संदेश, एक ज्ञात बग): developer search का उपयोग करें
  • यदि आपको वैज्ञानिक पेपर चाहिए (बायोमेडिकल, जीवन-विज्ञान, नैदानिक, या arXiv साहित्य): research टूल का उपयोग करें — वे पेपर सार और पूर्ण पाठ खोजते हैं। search के साथ categories: ["research"] एक अलग चीज़ है: सामान्य वेब परिणामों पर एक वेबसाइट फ़िल्टर।
  • यदि आपको बहु-स्रोत शोध की आवश्यकता है जो संरचित डेटा लौटाता है, URL नहीं जानते हैं, या उत्तर कई साइटों पर फैला है (एक इकाई और उसके फ़ील्ड, एक सूची, एक डेटासेट): agent का उपयोग करें
  • यदि आप पूरी साइट या अनुभाग का विश्लेषण करना चाहते हैं: crawl का उपयोग करें (सीमाओं के साथ!)
  • यदि आपको इंटरैक्टिव ब्राउज़र स्वचालन की आवश्यकता है (क्लिक, टाइप, नेविगेट): नए पृष्ठ के लिए URL के साथ interact का उपयोग करें, या scrape + interact जब आप पहले से पृष्ठ स्क्रेप कर चुके हों या सख्त स्क्रेप नियंत्रण की आवश्यकता हो

त्वरित संदर्भ तालिका

टूलसबसे अच्छा के लिएरिटर्न
scrapeएकल पृष्ठ सामग्रीJSON (पसंदीदा) या मार्कडाउन
interactURL या स्क्रेप किए गए पृष्ठ के साथ इंटरैक्ट करेंनिष्पादन परिणाम + URL मोड के लिए scrapeId
mapसाइट पर URL खोजनाURL[]
crawlबहु-पृष्ठ निष्कर्षण (सीमाओं के साथ)आंतरिक पोलिंग के बाद अंतिम क्रॉल स्थिति/डेटा
parseफ़ाइलें और होस्टेड अपलोड संदर्भमार्कडाउन, JSON, या दस्तावेज़ आउटपुट
searchजानकारी के लिए वेब खोजresults[]
developerडेवलपर स्रोतों पर प्रोग्रामिंग प्रश्नpassages के साथ results[]
agentबहु-स्रोत शोध, अज्ञात या कई साइटेंJSON (संरचित डेटा)
monitorआवर्ती पृष्ठ जांचmonitor/check मेटाडेटा और अंतर
researchपेपर और GitHub रिपॉजिटरी शोधशोध परिणाम और रिपो मैच

प्रारूप चयन गाइड

scrape का उपयोग करते समय, सही प्रारूप चुनें:

  • JSON प्रारूप (अधिकांश मामलों के लिए अनुशंसित): जब आपको किसी पृष्ठ से विशिष्ट डेटा की आवश्यकता हो तो उपयोग करें। आपको जो निकालना है उसके आधार पर एक स्कीमा परिभाषित करें। यह प्रतिक्रियाओं को छोटा रखता है और संदर्भ विंडो ओवरफ्लो से बचाता है।
  • मार्कडाउन प्रारूप (कम उपयोग करें): केवल तभी जब आपको वास्तव में पूर्ण पृष्ठ सामग्री की आवश्यकता हो, जैसे कि संपूर्ण लेख को सारांशित करने या पृष्ठ संरचना का विश्लेषण करने के लिए।

उपलब्ध उपकरण

1. स्क्रैप टूल (firecrawl_scrape)

उन्नत विकल्पों के साथ एकल URL से सामग्री स्क्रैप करें।

इसके लिए सर्वोत्तम:

  • एकल पृष्ठ सामग्री निष्कर्षण, जब आप जानते हैं कि किस पृष्ठ में जानकारी है।

इसके लिए अनुशंसित नहीं:

  • कई पृष्ठों से सामग्री निकालना (ज्ञात URL के लिए बार-बार स्क्रैप कॉल का उपयोग करें, या URL खोजने के लिए पहले मैप + स्क्रैप करें, या पूर्ण पृष्ठ सामग्री के लिए क्रॉल करें)
  • जब आप सुनिश्चित नहीं हैं कि किस पृष्ठ में जानकारी है (खोज का उपयोग करें)

सामान्य गलतियाँ:

  • एक स्क्रैप कॉल में URL की सूची पास करना। MCP में प्रति URL एक बार स्क्रैप कॉल करें। यदि आपको विशेष रूप से एक बल्क API ऑपरेशन की आवश्यकता है, तो MCP के बाहर Firecrawl API बैच एंडपॉइंट का उपयोग करें।
  • डिफ़ॉल्ट रूप से मार्कडाउन प्रारूप का उपयोग करना (केवल आवश्यक चीज़ें निकालने के लिए JSON प्रारूप का उपयोग करें)।

सही प्रारूप चुनना:

  • JSON प्रारूप (पसंदीदा): अधिकांश उपयोग मामलों के लिए, केवल आवश्यक विशिष्ट डेटा निकालने के लिए स्कीमा के साथ JSON प्रारूप का उपयोग करें। यह प्रतिक्रियाओं को केंद्रित रखता है और संदर्भ विंडो ओवरफ्लो को रोकता है।
  • मार्कडाउन प्रारूप: केवल तभी जब कार्य को वास्तव में पूर्ण पृष्ठ सामग्री की आवश्यकता हो (जैसे, संपूर्ण लेख का सारांश, पृष्ठ संरचना का विश्लेषण)।

प्रॉम्प्ट उदाहरण:

"https://example.com/product. से उत्पाद विवरण प्राप्त करें"

उपयोग उदाहरण (JSON प्रारूप - पसंदीदा):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/product",
    "formats": [
      {
        "type": "json",
        "prompt": "Extract the product information",
        "schema": {
          "type": "object",
          "properties": {
            "name": { "type": "string" },
            "price": { "type": "number" },
            "description": { "type": "string" }
          },
          "required": ["name", "price"]
        }
      }
    ]
  }
}

उपयोग उदाहरण (मार्कडाउन प्रारूप - जब पूर्ण सामग्री की आवश्यकता हो):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/article",
    "formats": ["markdown"],
    "onlyMainContent": true
  }
}

उपयोग उदाहरण (ब्रांडिंग प्रारूप - ब्रांड पहचान निकालें):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com",
    "formats": ["branding"]
  }
}

ब्रांडिंग प्रारूप: डिज़ाइन विश्लेषण या शैली प्रतिकृति के लिए व्यापक ब्रांड पहचान (रंग, फ़ॉन्ट, टाइपोग्राफी, स्पेसिंग, लोगो, UI घटक) निकालता है। गोपनीयता: व्यक्तिगत रूप से पहचान योग्य जानकारी को हटाकर सामग्री लौटाने के लिए redactPII: true सेट करें।

रिटर्न:

  • JSON संरचित डेटा, मार्कडाउन, ब्रांडिंग प्रोफ़ाइल, या निर्दिष्ट अन्य प्रारूप।

2. मैप टूल (firecrawl_map)

साइट पर सभी अनुक्रमित URL खोजने के लिए किसी वेबसाइट को मैप करें।

इसके लिए सर्वोत्तम:

  • स्क्रैप करने का निर्णय लेने से पहले किसी वेबसाइट पर URL खोजना
  • वेबसाइट के विशिष्ट अनुभाग ढूंढना

इसके लिए अनुशंसित नहीं:

  • जब आप पहले से जानते हैं कि आपको किस विशिष्ट URL की आवश्यकता है (स्क्रैप का उपयोग करें)
  • जब आपको पृष्ठों की सामग्री की आवश्यकता हो (मैपिंग के बाद स्क्रैप का उपयोग करें)

सामान्य गलतियाँ:

  • URL खोजने के लिए मैप के बजाय क्रॉल का उपयोग करना

प्रॉम्प्ट उदाहरण:

"example.com पर सभी URL सूचीबद्ध करें।"

उपयोग उदाहरण:

{
  "name": "firecrawl_map",
  "arguments": {
    "url": "https://example.com"
  }
}

रिटर्न:

  • साइट पर पाए गए URL की सरणी

3. खोज टूल (firecrawl_search)

वेब खोजें और वैकल्पिक रूप से खोज परिणामों से सामग्री निकालें।

इसके लिए सर्वोत्तम:

  • कई वेबसाइटों पर विशिष्ट जानकारी ढूंढना, जब आप नहीं जानते कि किस वेबसाइट में जानकारी है।
  • जब आपको किसी क्वेरी के लिए सबसे प्रासंगिक सामग्री की आवश्यकता हो

इसके लिए अनुशंसित नहीं:

  • जब आप पहले से जानते हैं कि किस वेबसाइट को स्क्रैप करना है (स्क्रैप का उपयोग करें)
  • जब आपको एकल वेबसाइट के व्यापक कवरेज की आवश्यकता हो (मैप या क्रॉल का उपयोग करें)

सामान्य गलतियाँ:

  • खुले-अंत वाले प्रश्नों के लिए क्रॉल या मैप का उपयोग करना (इसके बजाय खोज का उपयोग करें)

उपयोग उदाहरण:

{
  "name": "firecrawl_search",
  "arguments": {
    "query": "remote work stipend policies at tech companies",
    "highlights": true,
    "limit": 5,
    "lang": "en",
    "country": "us",
    "scrapeOptions": {
      "formats": ["markdown"],
      "onlyMainContent": true,
      "redactPII": true
    }
  }
}

क्वेरी-प्रासंगिक हाइलाइट्स का अनुरोध करने के लिए highlights को true पर सेट करें या मूल खोज स्निपेट रखने के लिए false पर सेट करें। API के डिफ़ॉल्ट व्यवहार का उपयोग करने के लिए इसे छोड़ दें।

वैज्ञानिक पेपरों के लिए, अनुसंधान उपकरण देखें: वे पेपर सार और पूर्ण पाठ खोजते हैं, जबकि यहां categories: ["research"] सामान्य वेब परिणामों को अनुसंधान-संबद्ध वेबसाइटों तक फ़िल्टर करता है।

रिटर्न:

  • खोज परिणामों की सरणी (वैकल्पिक स्क्रैप की गई सामग्री के साथ), साथ ही एक id फ़ील्ड। परिणामों का उपयोग करने के बाद उस id को firecrawl_search_feedback पर पास करें ताकि 1 क्रेडिट वापस मिले (खोज की लागत 2 है) और खोज गुणवत्ता में सुधार हो।

प्रॉम्प्ट उदाहरण:

"तकनीकी कंपनियों में दूरस्थ कार्य भत्ता नीतियों की तुलना करें।"

3बी. खोज फीडबैक टूल (firecrawl_search_feedback)

पिछले firecrawl_search परिणाम पर संरचित फीडबैक भेजता है। प्रति खोज आईडी पहला फीडबैक 1 क्रेडिट वापस करता है और Firecrawl की खोज गुणवत्ता में सुधार करता है। प्रति खोज आईडी आइडेम्पोटेंट।

हर खोज के बाद इसे कॉल करें जिसका आप वास्तव में उपयोग करते हैं (या जो मदद नहीं की)। missingContent के साथ खराब/आंशिक फीडबैक अच्छे फीडबैक जितना ही मूल्यवान है।

ऑप्ट आउट: MCP सर्वर शुरू करते समय पर्यावरण में FIRECRAWL_NO_SEARCH_FEEDBACK=1 (या FIRECRAWL_DISABLE_SEARCH_FEEDBACK=1) सेट करें। firecrawl_search_feedback टूल पंजीकृत नहीं होगा, इसलिए एजेंट इसे कॉल नहीं कर सकते। टीम व्यवस्थापक सर्वर-साइड फीडबैक भी अक्षम कर सकते हैं; उस स्थिति में टूल पंजीकृत है लेकिन हमेशा feedbackErrorCode: "TEAM_OPTED_OUT" लौटाता है।

सबसे महत्वपूर्ण फ़ील्ड: missingContent। यह विशिष्ट सामग्री की एक सरणी है जिसे एजेंट खोजने की उम्मीद करता था लेकिन नहीं मिला। प्रति लापता विषय एक प्रविष्टि — ये टीमों में एकत्रित होते हैं और हमें बताते हैं कि आगे क्या अनुक्रमित करना है।

दैनिक रिफंड सीमा (प्रति टीम, प्रति UTC दिन, डिफ़ॉल्ट 100 क्रेडिट)। एक बार टीम का creditsRefundedToday dailyRefundCap तक पहुंच जाता है, आगे की सबमिशन अभी भी फीडबैक रिकॉर्ड करती हैं लेकिन क्रेडिट वापस नहीं करती हैं। प्रतिक्रिया dailyCapReached: true सेट करती है। एजेंटों को उस फ़्लैग को देखने पर शेष UTC दिन के लिए इस टूल को कॉल करना बंद कर देना चाहिए।

उपयोग उदाहरण:

{
  "name": "firecrawl_search_feedback",
  "arguments": {
    "searchId": "0193f6c5-1234-7890-abcd-1234567890ab",
    "rating": "good",
    "valuableSources": [
      {
        "url": "https://docs.firecrawl.dev/features/search",
        "reason": "Most up-to-date description of /search."
      }
    ],
    "missingContent": [
      {
        "topic": "Pricing for the search endpoint",
        "description": "No pricing tier table for /search specifically."
      },
      { "topic": "Per-team rate limits" }
    ],
    "querySuggestions": "Boost docs.firecrawl.dev for queries that mention 'firecrawl'"
  }
}

रिटर्न:

  • { success, feedbackId, creditsRefunded, alreadySubmitted? } JSON।

3सी. सामान्य फीडबैक टूल (firecrawl_feedback)

/v2/feedback के माध्यम से पूर्ण v2 एंडपॉइंट कार्य के लिए संरचित फीडबैक भेजता है। scrape, parse, map, या search कार्यों पर एंडपॉइंट-स्तरीय फीडबैक के लिए इसका उपयोग करें। विशेष रूप से खोज-परिणाम गुणवत्ता के लिए, firecrawl_search_feedback को प्राथमिकता दें क्योंकि इसमें खोज-विशिष्ट मार्गदर्शन शामिल है।

फीडबैक संक्षिप्त रखें: समस्या कोड, टैग, छोटे नोट, URL, पृष्ठ संख्याएं और छोटे मेटाडेटा ऑब्जेक्ट का उपयोग करें। कच्चे स्क्रैप/पार्स आउटपुट शामिल न करें।

ऑप्ट आउट: MCP सर्वर शुरू करते समय पर्यावरण में FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 (या FIRECRAWL_DISABLE_ENDPOINT_FEEDBACK=1) सेट करें। firecrawl_feedback टूल पंजीकृत नहीं होगा, इसलिए एजेंट इसे कॉल नहीं कर सकते।

उपयोग उदाहरण:

{
  "name": "firecrawl_feedback",
  "arguments": {
    "endpoint": "scrape",
    "jobId": "0193f6c5-1234-7890-abcd-1234567890ab",
    "rating": "partial",
    "issues": ["missing_markdown"],
    "tags": ["docs"],
    "note": "The pricing table was missing from the markdown output.",
    "url": "https://example.com/pricing",
    "pageNumbers": [1],
    "metadata": {
      "format": "markdown"
    }
  }
}

रिटर्न:

  • { success, feedbackId, creditsRefunded, creditsRefundedToday?, dailyRefundCap?, dailyCapReached?, alreadySubmitted?, warning? } JSON।

4. क्रॉल टूल (firecrawl_crawl)

एक क्रॉल कार्य शुरू करता है, टर्मिनल स्थिति तक पहुंचने तक पोल करता है, और अंतिम क्रॉल स्थिति/डेटा लौटाता है।

इसके लिए सर्वोत्तम:

  • कई संबंधित पृष्ठों से सामग्री निकालना, जब आपको व्यापक कवरेज की आवश्यकता हो।

इसके लिए अनुशंसित नहीं:

  • एकल पृष्ठ से सामग्री निकालना (स्क्रैप का उपयोग करें)
  • जब टोकन सीमाएं चिंता का विषय हों (कड़े नियंत्रण के लिए मैप + स्क्रैप का उपयोग करें)
  • जब आपको तेज़ परिणाम चाहिए (क्रॉलिंग धीमी हो सकती है)

चेतावनी: क्रॉल प्रतिक्रियाएं बहुत बड़ी हो सकती हैं और टोकन सीमा से अधिक हो सकती हैं। क्रॉल गहराई और पृष्ठों की संख्या सीमित करें, या कड़े नियंत्रण के लिए मैप + स्क्रैप का उपयोग करें।

सामान्य गलतियाँ:

  • सीमा या maxDiscoveryDepth बहुत अधिक सेट करना (टोकन ओवरफ्लो का कारण बनता है)
  • एकल पृष्ठ के लिए क्रॉल का उपयोग करना (इसके बजाय स्क्रैप का उपयोग करें)

प्रॉम्प्ट उदाहरण:

"example.com/blog के पहले दो स्तरों से सभी ब्लॉग पोस्ट प्राप्त करें।"

उपयोग उदाहरण:

{
  "name": "firecrawl_crawl",
  "arguments": {
    "url": "https://example.com/blog/*",
    "maxDiscoveryDepth": 2,
    "limit": 100,
    "allowExternalLinks": false,
    "deduplicateSimilarURLs": true
  }
}

रिटर्न:

  • आंतरिक पोलिंग के बाद अंतिम क्रॉल स्थिति और डेटा, जिसमें id, status, completed, total, creditsUsed, expiresAt, next, और data शामिल हैं। यदि आपको बाद में कार्य को फिर से जांचने की आवश्यकता है तो लौटाए गए id का उपयोग firecrawl_check_crawl_status के साथ करें।

5. क्रॉल स्थिति जांचें (firecrawl_check_crawl_status)

आईडी द्वारा मौजूदा क्रॉल कार्य की स्थिति और परिणाम जांचें।

{
  "name": "firecrawl_check_crawl_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

रिटर्न:

  • प्रतिक्रिया में क्रॉल कार्य की स्थिति शामिल है:

6. पार्स टूल (firecrawl_parse)

Firecrawl के /v2/parse एंडपॉइंट के साथ स्थानीय फ़ाइलें या होस्टेड अपलोड संदर्भ पार्स करें।

इसके लिए सर्वोत्तम: PDF, Word दस्तावेज़, स्प्रेडशीट, HTML फ़ाइलें और अन्य दस्तावेज़ जिन्हें मार्कडाउन या संरचित JSON आउटपुट की आवश्यकता होती है। होस्टेड MCP दो-चरणीय अपलोड-रेफ़ फ्लो का समर्थन करता है; स्थानीय प्रत्यक्ष फ़ाइल रीड के लिए स्व-होस्टेड FIRECRAWL_API_URL की आवश्यकता होती है।

इसके लिए अनुशंसित नहीं: दूरस्थ URL (स्क्रैप का उपयोग करें), एक कॉल में कई फ़ाइलें (प्रति फ़ाइल एक बार पार्स कॉल करें), या केवल ब्राउज़र-क्रियाएं जैसे स्क्रीनशॉट और क्लिक।

होस्टेड MCP फ्लो: होस्टेड MCP कॉलर के फ़ाइल सिस्टम को सीधे नहीं पढ़ सकता है। अल्पकालिक अपलोड कमांड और nextToolCall प्राप्त करने के लिए firecrawl_parse को filePath के साथ कॉल करें, फ़ाइल को स्थानीय रूप से अपलोड करें, फिर लौटाए गए uploadRef के साथ firecrawl_parse को फिर से कॉल करें। होस्टेड अपलोड URL मिंट करने के लिए Firecrawl प्रमाणीकरण या कुंजी-रहित पात्रता की आवश्यकता होती है। स्थानीय npx firecrawl-mcp मोड में, प्रत्यक्ष फ़ाइल पार्सिंग के लिए वर्तमान में स्व-होस्टेड Firecrawl API की ओर इशारा करते हुए FIRECRAWL_API_URL की आवश्यकता होती है; एक सादा क्लाउड API-कुंजी-केवल स्थानीय सर्वर इस टूल के माध्यम से फ़ाइलों को पढ़ और अपलोड नहीं कर सकता है।

उपयोग उदाहरण:

{
  "name": "firecrawl_parse",
  "arguments": {
    "filePath": "/absolute/path/to/document.pdf",
    "formats": ["markdown"],
    "parsers": ["pdf"],
    "zeroDataRetention": true
  }
}

रिटर्न: पार्स किया गया दस्तावेज़ सामग्री या nextToolCall के साथ होस्टेड अपलोड निर्देश।

7. स्क्रैप JSON के साथ संरचित डेटा

ज्ञात पृष्ठ से संरचित डेटा के लिए, प्रति URL एक बार firecrawl_scrape को formats: ["json"] के साथ कॉल करें। निष्कर्षण प्रॉम्प्ट और JSON स्कीमा को jsonOptions में रखें।

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/product",
    "formats": ["json"],
    "jsonOptions": {
      "prompt": "Extract the product name, price, and description.",
      "schema": {
        "type": "object",
        "properties": {
          "name": { "type": "string" },
          "price": { "type": "number" },
          "description": { "type": "string" }
        },
        "required": ["name", "price"]
      }
    }
  }
}

जब URL ज्ञात नहीं हैं या डेटा कई साइटों में फैला है, तो बहु-स्रोत अनुसंधान के लिए firecrawl_agent का उपयोग करें।

8. एजेंट टूल (firecrawl_agent)

स्वायत्त वेब अनुसंधान एजेंट जो संरचित डेटा लौटाता है जब आप URL नहीं जानते हैं या उत्तर कई साइटों में फैला है। आपको आवश्यक फ़ील्ड का वर्णन करें, वैकल्पिक रूप से JSON स्कीमा और सीड URL पास करें, और एजेंट खोजता है, नेविगेट करता है, पृष्ठ पढ़ता है, और स्रोतों में एकत्रित JSON लौटाता है। एक इकाई और उसके फ़ील्ड के लिए, सूचियों और डेटासेट के लिए, और उन पृष्ठों के लिए उपयोग करें जिन्हें डेटा तक पहुंचने के लिए नेविगेशन की आवश्यकता होती है। एक ज्ञात URL के लिए इसके बजाय JSON प्रारूप के साथ firecrawl_scrape का उपयोग करें।

यह कैसे काम करता है:

एजेंट वेब खोज करता है, लिंक का अनुसरण करता है, पृष्ठ पढ़ता है, और स्वायत्त रूप से डेटा एकत्र करता है। यह अतुल्यकालिक रूप से चलता है - यह तुरंत एक कार्य आईडी लौटाता है, और आप पूर्ण होने पर जांचने और परिणाम प्राप्त करने के लिए firecrawl_agent_status को पोल करते हैं।

अतुल्यकालिक वर्कफ़्लो:

  1. अपने प्रॉम्प्ट/स्कीमा के साथ firecrawl_agent कॉल करें → कार्य आईडी लौटाता है
  2. एजेंट के अनुसंधान करते समय अन्य कार्य करें (जटिल क्वेरी के लिए मिनट लग सकते हैं)
  3. प्रगति जांचने के लिए कार्य आईडी के साथ firecrawl_agent_status को पोल करें
  4. जब स्थिति "completed" हो, तो प्रतिक्रिया में निकाला गया डेटा शामिल होता है

इसके लिए सर्वोत्तम:

  • जटिल अनुसंधान कार्य जहां आप सटीक URL नहीं जानते हैं
  • बहु-स्रोत डेटा संग्रह
  • वेब पर बिखरी जानकारी ढूंढना
  • ऐसे कार्य जहां आप परिणामों की प्रतीक्षा करते समय अन्य कार्य कर सकते हैं

इसके लिए अनुशंसित नहीं:

  • सरल एकल-पृष्ठ स्क्रैपिंग जहां आप URL जानते हैं (JSON प्रारूप के साथ स्क्रैप का उपयोग करें - तेज़ और सस्ता)

तर्क:

  • prompt: आपके इच्छित डेटा का प्राकृतिक भाषा विवरण (आवश्यक, अधिकतम 10,000 वर्ण)
  • urls: एजेंट को विशिष्ट पृष्ठों पर केंद्रित करने के लिए वैकल्पिक URL सरणी
  • schema: संरचित आउटपुट के लिए वैकल्पिक JSON स्कीमा

प्रॉम्प्ट उदाहरण:

"Firecrawl के संस्थापकों और उनकी पृष्ठभूमि को खोजें"

उपयोग उदाहरण (एजेंट शुरू करें, फिर परिणामों के लिए पोल करें):

{
  "name": "firecrawl_agent",
  "arguments": {
    "prompt": "Find the top 5 AI startups founded in 2024 and their funding amounts",
    "schema": {
      "type": "object",
      "properties": {
        "startups": {
          "type": "array",
          "items": {
            "type": "object",
            "properties": {
              "name": { "type": "string" },
              "funding": { "type": "string" },
              "founded": { "type": "string" }
            }
          }
        }
      }
    }
  }
}

फिर लौटाए गए कार्य आईडी के साथ firecrawl_agent_status का उपयोग करके पोल करें।

उपयोग उदाहरण (URL के साथ - एजेंट विशिष्ट पृष्ठों पर केंद्रित होता है):

{
  "name": "firecrawl_agent",
  "arguments": {
    "urls": ["https://docs.firecrawl.dev", "https://firecrawl.dev/pricing"],
    "prompt": "Compare the features and pricing information from these pages"
  }
}

रिटर्न:

  • स्थिति जांच के लिए कार्य आईडी। परिणामों के लिए पोल करने के लिए firecrawl_agent_status का उपयोग करें।

9. एजेंट स्थिति जांचें (firecrawl_agent_status)

एजेंट कार्य की स्थिति जांचें और पूर्ण होने पर परिणाम प्राप्त करें। एजेंट शुरू करने के बाद परिणामों के लिए पोल करने के लिए इसका उपयोग करें।

पोलिंग पैटर्न: जटिल क्वेरी के लिए एजेंट अनुसंधान में मिनट लग सकते हैं। स्थिति "completed" या "failed" होने तक इस एंडपॉइंट को समय-समय पर (जैसे, हर 10-30 सेकंड) पोल करें।

{
  "name": "firecrawl_agent_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

संभावित स्थितियां:

  • processing: एजेंट अभी भी अनुसंधान कर रहा है - बाद में जांचें
  • completed: अनुसंधान समाप्त - प्रतिक्रिया में निकाला गया डेटा शामिल है
  • failed: एक त्रुटि हुई

10. इंटरैक्ट टूल (firecrawl_interact)

नए URL के साथ या उस पृष्ठ के साथ इंटरैक्ट करें जो पहले firecrawl_scrape द्वारा खोला गया था। इसके लिए सर्वोत्तम: डायनामिक पेजों पर क्लिक करना, टाइप करना, नेविगेट करना और स्थिति निकालना, बिना पुराने ब्राउज़र टूल्स को पुनर्स्थापित किए।

उपयोग विकल्प:

  • एक MCP कॉल में पेज को स्क्रैप और खोलने के लिए url पास करें।
  • मौजूदा स्क्रैप किए गए पेज के साथ इंटरैक्ट करना जारी रखने के लिए scrapeId पास करें।
  • url या scrapeId में से ठीक एक पास करें, साथ ही prompt या code में से कोई एक पास करें।

उपयोग उदाहरण:

{
  "name": "firecrawl_interact",
  "arguments": {
    "url": "https://example.com",
    "prompt": "Click the pricing link and summarize the visible plans"
  }
}

रिटर्न: इंटरैक्शन परिणाम और, URL मोड के लिए, अनुवर्ती या सफाई के लिए व्युत्पन्न scrapeId

11. इंटरैक्ट टूल रोकें (firecrawl_interact_stop)

जब आप इंटरैक्ट करना समाप्त कर लें तो स्क्रैप किए गए पेज के लिए इंटरैक्ट सत्र रोकें।

{
  "name": "firecrawl_interact_stop",
  "arguments": {
    "scrapeId": "scrape-id-here"
  }
}

12. अनुसंधान उपकरण (firecrawl_research_*)

अनुसंधान MCP टूल्स के माध्यम से पेपर और GitHub रिपॉजिटरी खोजें और निरीक्षण करें।

कवर: बायोमेडिकल, जीवन-विज्ञान और नैदानिक साहित्य (PubMed, bioRxiv, medRxiv) के साथ-साथ arXiv और अन्य वैज्ञानिक स्रोतों में पेपर सार और पूर्ण पाठ।

उपलब्ध अनुसंधान उपकरण:

  • firecrawl_research_search_papers: वैकल्पिक लेखक, श्रेणी और दिनांक फ़िल्टर के साथ प्राकृतिक-भाषा क्वेरी का उपयोग करके पेपर मेटाडेटा और सार खोजें।
  • firecrawl_research_inspect_paper: एक पेपर ID (arXiv, PMC, PMID, या DOI) के लिए विहित मेटाडेटा प्राप्त करें।
  • firecrawl_research_related_papers: उद्धरण ग्राफ के माध्यम से एक या अधिक एंकर पेपर से विस्तार करें।
  • firecrawl_research_read_paper: किसी विशिष्ट पेपर से पूर्ण-पाठ अंश पढ़ें।

इसके लिए सर्वोत्तम: साहित्य समीक्षा, पेपर खोज, और रिपॉजिटरी खोज वर्कफ़्लो जहां एजेंट को सामान्य वेब स्क्रैपिंग के बजाय एक केंद्रित अनुसंधान सतह की आवश्यकता होती है।

firecrawl_search के साथ categories: ["research"] एक अलग सतह है: यह सामान्य वेब परिणामों को अनुसंधान-संबद्ध वेबसाइटों पर फ़िल्टर करता है और पेपर रिकॉर्ड के बजाय पेज स्निपेट लौटाता है। इन टूल्स का उपयोग तब करें जब प्रश्न साहित्य के बारे में हो, और एक ही प्रश्न के कई अलग-अलग फ्रेमिंग पास करें — वे एक ही क्वेरी की तुलना में अलग-अलग पेपर सतह पर लाते हैं।

13. मॉनिटर उपकरण (firecrawl_monitor_*)

आवर्ती पेज मॉनिटर बनाएं और प्रबंधित करें। मॉनिटर निर्धारित स्क्रैप या क्रॉल चलाते हैं, प्रत्येक परिणाम को अंतिम संग्रहीत स्नैपशॉट के साथ अंतर करते हैं, और वेबहुक या ईमेल द्वारा सूचित कर सकते हैं।

इसके लिए सर्वोत्तम:

  • समय के साथ एक पेज या कुछ पेज देखना
  • सरल अंग्रेजी लक्ष्य का उपयोग करके सार्थक परिवर्तनों पर सतर्क करना
  • जांच इतिहास और पेज-स्तरीय अंतर ट्रैक करना

अनुशंसित निर्माण पैटर्न:

page या pages के साथ goal का उपयोग करें। MCP सर्वर 30-मिनट शेड्यूल के साथ मॉनिटर अनुरोध बनाता है और API स्वचालित रूप से सार्थक-परिवर्तन निर्णय सक्षम करता है।

सार्थक-परिवर्तन निर्णय स्वचालित रूप से चलता है जब goal सेट होता है। पेज वेबहुक monitor.page इवेंट पर isMeaningful और judgment उजागर करते हैं।

लक्ष्यों को संक्षिप्त 2-3 वाक्य मॉनिटर निर्देशों के रूप में लिखें। बताएं कि क्या अलर्ट ट्रिगर करना चाहिए, उपयोगकर्ता द्वारा दिया गया कोई भी दायरा संरक्षित करें, और केवल तभी इरादा-विशिष्ट बहिष्करण शामिल करें जब अनुरोध से स्पष्ट हो। सामान्य शोर जैसे व्हाइटस्पेस, केवल-फ़ॉर्मेटिंग परिवर्तन, अनुरोध ID, ट्रैकिंग पैरामीटर, सामान्य मेटाडेटा, और असंबंधित पेज क्रोम पहले से ही निर्णायक द्वारा संभाला जाता है, इसलिए इसे हर लक्ष्य में दोहराएं नहीं। यदि उपयोगकर्ता अस्पष्ट है, तो लक्ष्य को व्यापक रखें; यदि वे व्यापक निगरानी या "कोई भी परिवर्तन" मांगते हैं, तो उसे संरक्षित करें। यदि उपयोगकर्ता कहता है कि वे किसी चीज़ की परवाह नहीं करते हैं, तो उसे स्पष्ट रूप से शामिल करें।

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "page": "https://example.com/pricing",
    "goal": "Alert when pricing, packaging, or launch messaging changes."
  }
}

वेबहुक के साथ कई पेज:

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "pages": ["https://example.com/pricing", "https://example.com/changelog"],
    "goal": "Alert when pricing, packaging, or launch messaging changes.",
    "webhookUrl": "https://example.com/webhooks/firecrawl"
  }
}

उन्नत निर्माण अनुरोध:

जब आपको क्रॉल लक्ष्य, JSON परिवर्तन ट्रैकिंग, कस्टम प्रतिधारण, या स्पष्ट judgeEnabled नियंत्रण की आवश्यकता हो तो body पास करें।

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "body": {
      "name": "Docs monitor",
      "schedule": { "text": "hourly", "timezone": "UTC" },
      "goal": "Alert when docs pages add, remove, or materially change API behavior.",
      "targets": [{ "type": "crawl", "url": "https://example.com/docs" }]
    }
  }
}

अन्य मॉनिटर उपकरण:

  • firecrawl_monitor_list: मॉनिटर सूचीबद्ध करें।
  • firecrawl_monitor_get: एक मॉनिटर प्राप्त करें।
  • firecrawl_monitor_update: goal, judgeEnabled, webhook, और notification सहित फ़ील्ड अपडेट करें।
  • firecrawl_monitor_run: अभी एक जांच ट्रिगर करें।
  • firecrawl_monitor_delete: एक मॉनिटर हटाएं (विनाशकारी; केवल तभी कॉल करें जब उपयोगकर्ता इसे हटाने का इरादा रखता है)।
  • firecrawl_monitor_checks: जांच सूचीबद्ध करें, वैकल्पिक रूप से स्थिति द्वारा फ़िल्टर किया गया।
  • firecrawl_monitor_check: पेज-स्तरीय परिणाम प्राप्त करें, जिसमें diff, snapshot, judgment.meaningful, और judgment.meaningfulChanges शामिल हैं।

14. डेवलपर खोज उपकरण (firecrawl_developer_search)

कोडिंग एजेंटों के लिए निर्मित एक इंडेक्स खोजें। इंडेक्स GitHub मुद्दों, विलय किए गए पुल अनुरोधों, रिपॉजिटरी README, और क्यूरेटेड दस्तावेज़ीकरण साइटों को कवर करता है।

इसके लिए सर्वोत्तम: एक प्रोग्रामिंग प्रश्न — कोड व्यवहार, एक लाइब्रेरी या फ्रेमवर्क, एक API अनुबंध, एक त्रुटि संदेश, या एक ज्ञात बग।

तर्क:

{
  "name": "firecrawl_developer_search",
  "arguments": {
    "query": "how do I configure retries",
    "k": 10,
    "skills": "only"
  }
}
  • query (आवश्यक): डेवलपर प्रश्न या खोज वाक्यांश।
  • k: रैंक किए गए परिणामों की संख्या। डिफ़ॉल्ट 10 है और अधिकतम 100 है।
  • skills: अकेले एजेंट-कौशल फ़ाइलों को खोजने के लिए "only" पर सेट करें।

रिटर्न: रैंक किए गए परिणाम। प्रत्येक परिणाम में एक ID, एक स्रोत प्रकार (issue, pull_request, readme, या doc), एक URL, एक शीर्षक, और मार्कडाउन में मिलान किए गए अंश होते हैं।

firecrawl_search के साथ categories: ["developer"] वेब परिणामों के बगल में एक ही इंडेक्स खोजता है। इसके बजाय इस टूल का उपयोग करें जब आप मिलान किए गए अंश, skills फ़िल्टर, या प्रतिक्रिया में कोई वेब परिणाम नहीं चाहते हैं। खोज-केवल एंडपॉइंट दोनों टूल उजागर करता है, और वही विकल्प वहां लागू होता है।

लॉगिंग प्रणाली

सर्वर में व्यापक लॉगिंग शामिल है:

  • संचालन स्थिति और प्रगति
  • प्रदर्शन मेट्रिक्स
  • दर सीमा ट्रैकिंग
  • त्रुटि स्थितियाँ

उदाहरण लॉग संदेश:

[INFO] Firecrawl MCP Server initialized successfully
[INFO] Starting scrape for URL: https://example.com
[ERROR] Rate limit exceeded

त्रुटि प्रबंधन

सर्वर मजबूत त्रुटि प्रबंधन प्रदान करता है:

  • API दर-सीमा त्रुटियाँ MCP क्लाइंट को सतह पर लाई गईं
  • विस्तृत त्रुटि संदेश
  • नेटवर्क लचीलापन

उदाहरण त्रुटि प्रतिक्रिया:

{
  "content": [
    {
      "type": "text",
      "text": "Error: Rate limit exceeded"
    }
  ],
  "isError": true
}

विकास

# Install dependencies
npm install

# Build
npm run build

# Run tests
npm test

योगदान

  1. रिपॉजिटरी को फोर्क करें
  2. अपनी सुविधा शाखा बनाएं
  3. परीक्षण चलाएं: npm test
  4. एक पुल अनुरोध सबमिट करें

योगदानकर्ताओं को धन्यवाद

प्रारंभिक कार्यान्वयन के लिए @vrknetha, @cawstudios को धन्यवाद!

हमारे सर्वर को होस्ट करने के लिए MCP.so और Klavis AI को धन्यवाद और @gstarwd, @xiangkaiz और @zihaolin96 को हमारे सर्वर को एकीकृत करने के लिए धन्यवाद।

लाइसेंस

MIT लाइसेंस - विवरण के लिए LICENSE फ़ाइल देखें