Firecrawl MCP

आधिकारिक

LLM क्लाइंट जैसे Cursor और Claude में शक्तिशाली वेब स्क्रैपिंग और खोज क्षमताएँ जोड़ता है।

Firecrawl MCP के साथ आप क्या कर सकते हैं?

  • किसी भी URL को स्क्रैप करेंfirecrawl_scrape के साथ एक पेज से संरचित डेटा मांगें, और JSON स्कीमा का उपयोग करके ठीक वही निकालें जो आपको चाहिए।
  • वेब खोजेंfirecrawl_search का उपयोग करके कई साइटों पर जानकारी खोजें, वैकल्पिक सामग्री निष्कर्षण और क्वेरी-संबंधित हाइलाइट्स के साथ।
  • वेबसाइट का नक्शा बनाएं — यह तय करने से पहले कि कौन से पेज स्क्रैप करने हैं, firecrawl_map के साथ किसी साइट पर सभी अनुक्रमित URL खोजें।
  • कई पेज क्रॉल करेंfirecrawl_crawl चलाकर पूरी साइट सेक्शन से सामग्री निकालें, आउटपुट आकार नियंत्रित करने के लिए गहराई और पेज सीमाएँ निर्धारित करें।
  • पेजों के साथ इंटरैक्ट करेंfirecrawl_interact का उपयोग करके डायनामिक पेजों पर क्लिक करें, टाइप करें और नेविगेट करें, फिर परिणामी स्थिति निकालें।
  • स्वायत्त शोध चलाएं — जटिल बहु-स्रोत शोध के लिए firecrawl_agent लॉन्च करें, फिर संरचित परिणामों के लिए firecrawl_agent_status को पोल करें।

दस्तावेज़

Firecrawl MCP सर्वर

एक मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वर जो Firecrawl को MCP-संगत AI एजेंटों तक पहुंचाता है — लाइव वेब पर खोजें, स्क्रेप करें, और इंटरैक्ट करें, ताकि स्वच्छ, एजेंट-तैयार संदर्भ मिल सके।

@vrknetha और @knacklabs को प्रारंभिक कार्यान्वयन के लिए बहुत धन्यवाद!

विशेषताएँ

  • वेब खोजें और पूर्ण पृष्ठ सामग्री प्राप्त करें
  • कोडिंग एजेंटों के लिए बनाए गए इंडेक्स में खोजें: GitHub issues, मर्ज किए गए pull requests, READMEs, और दस्तावेज़
  • किसी भी URL को स्वच्छ, संरचित डेटा में स्क्रेप करें
  • पृष्ठों के साथ इंटरैक्ट करें — क्लिक करें, नेविगेट करें, और संचालित करें
  • स्वायत्त एजेंट के साथ गहन शोध
  • स्वचालित पुनर्प्रयास और दर सीमा
  • क्लाउड और सेल्फ-होस्टेड समर्थन
  • SSE समर्थन

MCP.so के प्लेग्राउंड पर हमारे MCP सर्वर या Klavis AI पर इसे आज़माएं।

स्थापना

होस्टेड MCP (कीलैस मुफ्त स्तर)

बिना किसी सेटअप के दूरस्थ होस्टेड सर्वर से कनेक्ट करें:

https://mcp.firecrawl.dev/v2/mcp

कीलैस मुफ्त स्तर पर, scrape, search, और parse बिना API कुंजी के काम करते हैं (दर-सीमित)। अन्य उपकरण जैसे crawl, map, और agent को अभी भी कुंजी की आवश्यकता होती है।

जब भी मानव साइन अप कर सकता है, OAuth या API कुंजी को प्राथमिकता दें। यह पूर्ण उपकरण सेट और उच्च सीमाएँ अनलॉक करता है।

इंटरैक्टिव खाता कनेक्शन के लिए, अपने MCP क्लाइंट को इस सर्वर URL का उपयोग करने के लिए कॉन्फ़िगर करें। यह एक MCP एंडपॉइंट है, ब्राउज़र पृष्ठ नहीं; क्लाइंट के खाता-कनेक्शन प्रवाह का उपयोग करें और पुनः कनेक्ट करते समय दूसरा Firecrawl सर्वर प्रविष्टि न जोड़ें:

https://mcp.firecrawl.dev/v2/mcp-oauth

API-कुंजी कनेक्शन के लिए (उदाहरण के लिए, एक अनअटेंडेड एकीकरण), सर्वर URL को इस प्रकार रखें:

https://mcp.firecrawl.dev/v2/mcp

फिर क्लाइंट की सुरक्षित हेडर या गुप्त सेटिंग को इसके साथ कॉन्फ़िगर करें:

Authorization: Bearer <FIRECRAWL_API_KEY>

API कुंजी को कभी भी सर्वर URL में न डालें। API कुंजी को कभी भी एजेंट चैट में न डालें। इसे सीधे क्लाइंट या गुप्त प्रबंधक में कॉन्फ़िगर करें। क्लाइंट-विशिष्ट निर्देशों के लिए होस्टेड MCP सेटअप गाइड और एजेंट ऑनबोर्डिंग गाइड देखें।

केवल-खोज एंडपॉइंट

एक केवल-पठनीय, केवल-खोज सतह भी यहाँ होस्ट की गई है:

https://mcp.firecrawl.dev/v2/mcp-search

यह छह केवल-पठनीय उपकरणों का एक निश्चित सेट उजागर करता है: firecrawl_search और पाँच firecrawl_research_* उपकरण। यह कोई पृष्ठ-सामग्री लाने का कार्य नहीं करता है और इसकी अपनी OAuth पहचान है; उपरोक्त पूर्ण एंडपॉइंट अपरिवर्तित है। पूर्ण अनुबंध के लिए docs/search-profile.md देखें।

npx के साथ चलाना

env FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

मैन्युअल स्थापना

npm install -g firecrawl-mcp

Cursor पर चलाना

Cursor कॉन्फ़िगर करना 🖥️ नोट: Cursor संस्करण 0.45.6+ आवश्यक है सबसे अद्यतित कॉन्फ़िगरेशन निर्देशों के लिए, कृपया MCP सर्वर कॉन्फ़िगर करने पर आधिकारिक Cursor दस्तावेज़ देखें: Cursor MCP सर्वर कॉन्फ़िगरेशन गाइड

Cursor v0.48.6 में Firecrawl MCP कॉन्फ़िगर करने के लिए

  1. Cursor सेटिंग्स खोलें
  2. Features > MCP Servers पर जाएं
  3. "+ Add new global MCP server" पर क्लिक करें
  4. निम्नलिखित कोड दर्ज करें:
    {
      "mcpServers": {
        "firecrawl-mcp": {
          "command": "npx",
          "args": ["-y", "firecrawl-mcp"],
          "env": {
            "FIRECRAWL_API_KEY": "YOUR-API-KEY"
          }
        }
      }
    }
    

Cursor v0.45.6 में Firecrawl MCP कॉन्फ़िगर करने के लिए

  1. Cursor सेटिंग्स खोलें
  2. Features > MCP Servers पर जाएं
  3. "+ Add New MCP Server" पर क्लिक करें
  4. निम्नलिखित दर्ज करें:
    • नाम: "firecrawl-mcp" (या आपका पसंदीदा नाम)
    • प्रकार: "command"
    • कमांड: env FIRECRAWL_API_KEY=your-api-key npx -y firecrawl-mcp

यदि आप Windows का उपयोग कर रहे हैं और समस्याओं का सामना कर रहे हैं, तो cmd /c "set FIRECRAWL_API_KEY=your-api-key && npx -y firecrawl-mcp" आज़माएं

your-api-key को अपनी Firecrawl API कुंजी से बदलें। यदि आपके पास अभी तक एक नहीं है, तो आप एक खाता बना सकते हैं और इसे https://www.firecrawl.dev/app/api-keys से प्राप्त कर सकते हैं

जोड़ने के बाद, नए उपकरण देखने के लिए MCP सर्वर सूची को रीफ्रेश करें। Composer एजेंट स्वचालित रूप से Firecrawl MCP का उपयोग करेगा जब उपयुक्त हो, लेकिन आप अपनी वेब स्क्रेपिंग आवश्यकताओं का वर्णन करके इसे स्पष्ट रूप से अनुरोध कर सकते हैं। Command+L (Mac) के माध्यम से Composer तक पहुंचें, सबमिट बटन के आगे "Agent" चुनें, और अपना प्रश्न दर्ज करें।

Windsurf पर चलाना

अपने ./codeium/windsurf/model_config.json में यह जोड़ें:

{
  "mcpServers": {
    "mcp-server-firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "YOUR_API_KEY"
      }
    }
  }
}

स्ट्रीमेबल HTTP लोकल मोड के साथ चलाना

डिफ़ॉल्ट stdio ट्रांसपोर्ट के बजाय स्ट्रीमेबल HTTP का उपयोग करके सर्वर को स्थानीय रूप से चलाने के लिए:

env HTTP_STREAMABLE_SERVER=true FIRECRAWL_API_KEY=fc-YOUR_API_KEY npx -y firecrawl-mcp

URL का उपयोग करें: http://localhost:3000/mcp

Smithery के माध्यम से स्थापना (लेगेसी)

Smithery के माध्यम से Claude Desktop के लिए Firecrawl को स्वचालित रूप से स्थापित करने के लिए:

npx -y @smithery/cli install @mendableai/mcp-server-firecrawl --client claude

VS Code पर चलाना

एक-क्लिक स्थापना के लिए, नीचे दिए गए इंस्टॉल बटनों में से एक पर क्लिक करें...

Install with NPX in VS Code Install with NPX in VS Code Insiders

मैन्युअल स्थापना के लिए, VS Code में अपनी उपयोगकर्ता सेटिंग्स (JSON) फ़ाइल में निम्नलिखित JSON ब्लॉक जोड़ें। आप Ctrl + Shift + P दबाकर और Preferences: Open User Settings (JSON) टाइप करके ऐसा कर सकते हैं।

{
  "mcp": {
    "inputs": [
      {
        "type": "promptString",
        "id": "apiKey",
        "description": "Firecrawl API Key",
        "password": true
      }
    ],
    "servers": {
      "firecrawl": {
        "command": "npx",
        "args": ["-y", "firecrawl-mcp"],
        "env": {
          "FIRECRAWL_API_KEY": "${input:apiKey}"
        }
      }
    }
  }
}

वैकल्पिक रूप से, आप इसे अपने कार्यक्षेत्र में .vscode/mcp.json नामक फ़ाइल में जोड़ सकते हैं। यह आपको कॉन्फ़िगरेशन को दूसरों के साथ साझा करने की अनुमति देगा:

{
  "inputs": [
    {
      "type": "promptString",
      "id": "apiKey",
      "description": "Firecrawl API Key",
      "password": true
    }
  ],
  "servers": {
    "firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "${input:apiKey}"
      }
    }
  }
}

कॉन्फ़िगरेशन

पर्यावरण चर

क्लाउड API के लिए आवश्यक

  • FIRECRAWL_API_KEY: आपकी Firecrawl API कुंजी
    • क्लाउड API (डिफ़ॉल्ट) का उपयोग करते समय आवश्यक
    • FIRECRAWL_API_URL के साथ सेल्फ-होस्टेड इंस्टेंस का उपयोग करते समय वैकल्पिक
  • FIRECRAWL_API_URL (वैकल्पिक): सेल्फ-होस्टेड इंस्टेंस के लिए कस्टम API एंडपॉइंट
    • उदाहरण: https://firecrawl.your-domain.com
    • यदि प्रदान नहीं किया गया है, तो क्लाउड API का उपयोग किया जाएगा (API कुंजी आवश्यक है)

MCP OAuth (Bearer एक्सेस टोकन)

होस्टेड Firecrawl firecrawl.dev पर प्राधिकरण सर्वर के माध्यम से OAuth एक्सेस टोकन (fco_…) जारी कर सकता है। यह MCP सर्वर जो भी क्रेडेंशियल हल करता है उसे Firecrawl API को Authorization: Bearer … के रूप में अग्रेषित करता है।

  • HTTP स्ट्रीम ट्रांसपोर्ट (CLOUD_SERVICE=true, HTTP_STREAMABLE_SERVER=true, या SSE_LOCAL=true): क्लाइंट को MCP अनुरोधों पर Authorization: Bearer <fco_access_token> भेजना चाहिए। जब दोनों मौजूद हों, तो OAuth bearer टोकन x-firecrawl-api-key / x-api-key पर प्राथमिकता लेता है।
  • stdio: स्थिर एक्सेस टोकन के लिए FIRECRAWL_OAUTH_TOKEN का उपयोग करें, या API कुंजी के लिए FIRECRAWL_API_KEY का उपयोग करते रहें।

केवल एक्सेस टोकन (fco_…) का उपयोग करें। रिफ्रेश टोकन (fcr_…) को टोकन एंडपॉइंट पर विनिमय किया जाना चाहिए, स्क्रेप/खोज API को पारित नहीं किया जाना चाहिए।

केवल-खोज सतह (होस्टेड)

होस्टेड मोड में (CLOUD_SERVICE=true) एक दूसरा इन-प्रोसेस इंस्टेंस केवल-खोज एंडपॉइंट की सेवा करता है। बंडल सेवा का एक निश्चित तैनाती अनुबंध है: nginx /v2/mcp-search को स्थानीय पोर्ट 3001 पर इंस्टेंस पर रूट करता है, और OAuth संरक्षित-संसाधन पहचानकर्ता https://mcp.firecrawl.dev/v2/mcp-search है।

FIRECRAWL_MCP_SEARCH_ENABLED (डिफ़ॉल्ट true) समर्थित परिचालन टॉगल है; खोज इंस्टेंस को शुरू होने से रोकने के लिए इसे false पर सेट करें। Node प्रक्रिया अलग-अलग परीक्षणों के लिए FIRECRAWL_MCP_SEARCH_PORT, FIRECRAWL_MCP_SEARCH_ENDPOINT, और FIRECRAWL_MCP_SEARCH_RESOURCE_URL भी स्वीकार करती है। ये ओवरराइड बंडल nginx रूट या प्राधिकरण सर्वर अनुमतिसूची को पुन: कॉन्फ़िगर नहीं करते हैं और होस्टेड तैनाती में स्वतंत्र रूप से उपयोग नहीं किए जाने चाहिए।

खोज इंस्टेंस को प्रत्येक अनुरोध के लिए प्रमाणीकरण की आवश्यकता होती है (tools/list सहित) और उन OAuth टोकन को अस्वीकार करता है जिनका दर्शक अपने स्वयं के संसाधन से मेल नहीं खाता।

कॉन्फ़िगरेशन उदाहरण

क्लाउड API उपयोग के लिए:

export FIRECRAWL_API_KEY=your-api-key

सेल्फ-होस्टेड इंस्टेंस के लिए:

# Required for self-hosted
export FIRECRAWL_API_URL=https://firecrawl.your-domain.com

# Optional authentication for self-hosted
export FIRECRAWL_API_KEY=your-api-key  # If your instance requires auth

Claude Desktop के साथ उपयोग

अपने claude_desktop_config.json में यह जोड़ें:

{
  "mcpServers": {
    "mcp-server-firecrawl": {
      "command": "npx",
      "args": ["-y", "firecrawl-mcp"],
      "env": {
        "FIRECRAWL_API_KEY": "YOUR_API_KEY_HERE"
      }
    }
  }
}

उपकरण कैसे चुनें

अपने कार्य के लिए सही उपकरण चुनने के लिए इस गाइड का उपयोग करें:

  • यदि आप सटीक URL जानते हैं जो आप चाहते हैं: scrape का उपयोग करें (संरचित डेटा के लिए JSON प्रारूप के साथ)
  • यदि आपके पास कई ज्ञात URL हैं: प्रत्येक URL के लिए scrape को कॉल करें। यदि आपको विशेष रूप से एक बल्क API ऑपरेशन की आवश्यकता है, तो MCP के बाहर Firecrawl API बैच एंडपॉइंट का उपयोग करें।
  • यदि आपको किसी साइट पर URL खोजने की आवश्यकता है: map का उपयोग करें
  • यदि आप जानकारी के लिए वेब खोजना चाहते हैं: search का उपयोग करें
  • यदि आपके पास प्रोग्रामिंग प्रश्न है (एक लाइब्रेरी, एक API अनुबंध, एक त्रुटि संदेश, एक ज्ञात बग): developer search का उपयोग करें
  • यदि आपको वैज्ञानिक पेपर चाहिए (बायोमेडिकल, जीवन-विज्ञान, नैदानिक, या arXiv साहित्य): research उपकरण का उपयोग करें — वे पेपर सार और पूर्ण पाठ खोजते हैं। search के साथ categories: ["research"] एक अलग चीज़ है: सामान्य वेब परिणामों पर एक वेबसाइट फ़िल्टर।
  • यदि आपको कई अज्ञात स्रोतों में जटिल शोध की आवश्यकता है: agent का उपयोग करें
  • यदि आप पूरी साइट या अनुभाग का विश्लेषण करना चाहते हैं: crawl का उपयोग करें (सीमाओं के साथ!)
  • यदि आपको इंटरैक्टिव ब्राउज़र स्वचालन की आवश्यकता है (क्लिक, टाइप, नेविगेट): एक नए पृष्ठ के लिए URL के साथ interact का उपयोग करें, या scrape + interact जब आप पहले से ही पृष्ठ को स्क्रेप कर चुके हैं या कड़े स्क्रेप नियंत्रण की आवश्यकता है

त्वरित संदर्भ तालिका

उपकरणसबसे अच्छा किसके लिएरिटर्न
scrapeएकल पृष्ठ सामग्रीJSON (पसंदीदा) या markdown
interactURL या स्क्रेप किए गए पृष्ठ के साथ इंटरैक्ट करेंनिष्पादन परिणाम + URL मोड के लिए scrapeId
mapकिसी साइट पर URL खोजनाURL[]
crawlबहु-पृष्ठ निष्कर्षण (सीमाओं के साथ)आंतरिक पोलिंग के बाद अंतिम crawl स्थिति/डेटा
parseफ़ाइलें और होस्टेड अपलोड संदर्भmarkdown, JSON, या दस्तावेज़ आउटपुट
searchजानकारी के लिए वेब खोजresults[]
developerडेवलपर स्रोतों पर प्रोग्रामिंग प्रश्नpassages के साथ results[]
agentजटिल बहु-स्रोत शोधJSON (संरचित डेटा)
monitorआवर्ती पृष्ठ जाँचmonitor/check मेटाडेटा और diffs
researchपेपर और GitHub रिपॉजिटरी शोधresearch परिणाम और repo मिलान

प्रारूप चयन गाइड

scrape का उपयोग करते समय, सही प्रारूप चुनें:

  • JSON प्रारूप (अधिकांश मामलों के लिए अनुशंसित): जब आपको किसी पृष्ठ से विशिष्ट डेटा की आवश्यकता हो तो उपयोग करें। आपको जो निकालने की आवश्यकता है उसके आधार पर एक स्कीमा परिभाषित करें। यह प्रतिक्रियाओं को छोटा रखता है और संदर्भ विंडो अतिप्रवाह से बचाता है।
  • Markdown प्रारूप (कम उपयोग करें): केवल जब आपको वास्तव में पूर्ण पृष्ठ सामग्री की आवश्यकता हो, जैसे सारांश के लिए पूरा लेख पढ़ना या पृष्ठ संरचना का विश्लेषण करना।

उपलब्ध उपकरण

1. स्क्रेप उपकरण (firecrawl_scrape)

उन्नत विकल्पों के साथ एकल URL से सामग्री स्क्रेप करें।

सबसे अच्छा किसके लिए:

  • एकल पृष्ठ सामग्री निष्कर्षण, जब आप जानते हैं कि किस पृष्ठ में जानकारी है।

अनुशंसित नहीं:

  • कई पृष्ठों से सामग्री निकालना (ज्ञात URL के लिए बार-बार scrape कॉल का उपयोग करें, या पहले URL खोजने के लिए map + scrape, या पूर्ण पृष्ठ सामग्री के लिए crawl)
  • जब आप सुनिश्चित नहीं हैं कि किस पृष्ठ में जानकारी है (search का उपयोग करें)

सामान्य गलतियाँ:

  • एक scrape कॉल में URL की सूची पास करना। MCP में प्रति URL एक बार scrape कॉल करें। यदि आपको विशेष रूप से एक बल्क API ऑपरेशन की आवश्यकता है, तो MCP के बाहर Firecrawl API बैच एंडपॉइंट का उपयोग करें।
  • डिफ़ॉल्ट रूप से markdown प्रारूप का उपयोग करना (केवल आपकी आवश्यकता को निकालने के लिए JSON प्रारूप का उपयोग करें)।

सही प्रारूप चुनना:

  • JSON प्रारूप (पसंदीदा): अधिकांश उपयोग मामलों के लिए, केवल आवश्यक विशिष्ट डेटा निकालने के लिए स्कीमा के साथ JSON प्रारूप का उपयोग करें। यह प्रतिक्रियाओं को केंद्रित रखता है और संदर्भ विंडो अतिप्रवाह को रोकता है।
  • Markdown प्रारूप: केवल जब कार्य को वास्तव में पूर्ण पृष्ठ सामग्री की आवश्यकता होती है (जैसे, पूरे लेख का सारांश, पृष्ठ संरचना का विश्लेषण)।

प्रॉम्प्ट उदाहरण:

"https://example.com/product. से उत्पाद विवरण प्राप्त करें"

उपयोग उदाहरण (JSON प्रारूप - पसंदीदा):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/product",
    "formats": [
      {
        "type": "json",
        "prompt": "Extract the product information",
        "schema": {
          "type": "object",
          "properties": {
            "name": { "type": "string" },
            "price": { "type": "number" },
            "description": { "type": "string" }
          },
          "required": ["name", "price"]
        }
      }
    ]
  }
}

उपयोग उदाहरण (markdown प्रारूप - जब पूर्ण सामग्री आवश्यक हो):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/article",
    "formats": ["markdown"],
    "onlyMainContent": true
  }
}

उपयोग उदाहरण (ब्रांडिंग प्रारूप - ब्रांड पहचान निकालें):

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com",
    "formats": ["branding"]
  }
}

ब्रांडिंग प्रारूप: डिज़ाइन विश्लेषण या शैली प्रतिकृति के लिए व्यापक ब्रांड पहचान (रंग, फ़ॉन्ट, टाइपोग्राफी, स्पेसिंग, लोगो, UI घटक) निकालता है। गोपनीयता: व्यक्तिगत रूप से पहचान योग्य जानकारी के साथ सामग्री लौटाने के लिए redactPII: true सेट करें।

रिटर्न:

  • JSON संरचित डेटा, markdown, ब्रांडिंग प्रोफ़ाइल, या निर्दिष्ट अन्य प्रारूप।

2. मैप उपकरण (firecrawl_map)

साइट पर सभी अनुक्रमित URL खोजने के लिए एक वेबसाइट मैप करें।

सबसे अच्छा किसके लिए:

  • किसी वेबसाइट को स्क्रैप करने का निर्णय लेने से पहले उस पर URL खोजना
  • वेबसाइट के विशिष्ट अनुभाग ढूंढना

इसके लिए अनुशंसित नहीं है:

  • जब आप पहले से जानते हों कि आपको कौन सा विशिष्ट URL चाहिए (scrape का उपयोग करें)
  • जब आपको पृष्ठों की सामग्री चाहिए (mapping के बाद scrape का उपयोग करें)

सामान्य गलतियाँ:

  • URL खोजने के लिए map के बजाय crawl का उपयोग करना

प्रॉम्प्ट उदाहरण:

"example.com पर सभी URL सूचीबद्ध करें।"

उपयोग उदाहरण:

{
  "name": "firecrawl_map",
  "arguments": {
    "url": "https://example.com"
  }
}

रिटर्न:

  • साइट पर पाए गए URL की सरणी

3. खोज उपकरण (firecrawl_search)

वेब खोजें और वैकल्पिक रूप से खोज परिणामों से सामग्री निकालें।

इसके लिए सर्वोत्तम:

  • कई वेबसाइटों पर विशिष्ट जानकारी ढूंढना, जब आप नहीं जानते कि किस वेबसाइट पर जानकारी है।
  • जब आपको किसी क्वेरी के लिए सबसे प्रासंगिक सामग्री चाहिए

इसके लिए अनुशंसित नहीं है:

  • जब आप पहले से जानते हों कि किस वेबसाइट को स्क्रैप करना है (scrape का उपयोग करें)
  • जब आपको किसी एक वेबसाइट का व्यापक कवरेज चाहिए (map या crawl का उपयोग करें)

सामान्य गलतियाँ:

  • खुले-अंत वाले प्रश्नों के लिए crawl या map का उपयोग करना (इसके बजाय search का उपयोग करें)

उपयोग उदाहरण:

{
  "name": "firecrawl_search",
  "arguments": {
    "query": "remote work stipend policies at tech companies",
    "highlights": true,
    "limit": 5,
    "lang": "en",
    "country": "us",
    "scrapeOptions": {
      "formats": ["markdown"],
      "onlyMainContent": true,
      "redactPII": true
    }
  }
}

क्वेरी-प्रासंगिक हाइलाइट्स का अनुरोध करने के लिए highlights को true पर सेट करें या मूल खोज स्निपेट रखने के लिए false पर सेट करें। API के डिफ़ॉल्ट व्यवहार का उपयोग करने के लिए इसे छोड़ दें।

वैज्ञानिक पत्रों के लिए, Research Tools देखें: वे पेपर एब्सट्रैक्ट और पूर्ण पाठ खोजते हैं, जबकि यहाँ categories: ["research"] सामान्य वेब परिणामों को शोध-संबद्ध वेबसाइटों तक फ़िल्टर करता है।

रिटर्न:

  • खोज परिणामों की सरणी (वैकल्पिक स्क्रैप की गई सामग्री के साथ), साथ ही एक id फ़ील्ड। परिणामों का उपयोग करने के बाद उस id को firecrawl_search_feedback पर पास करें ताकि 1 क्रेडिट वापस मिल सके (search की लागत 2 है) और खोज गुणवत्ता में सुधार हो सके।

प्रॉम्प्ट उदाहरण:

"तकनीकी कंपनियों में दूरस्थ कार्य भत्ता नीतियों की तुलना करें।"

3बी. खोज फ़ीडबैक उपकरण (firecrawl_search_feedback)

पिछले firecrawl_search परिणाम पर संरचित फ़ीडबैक भेजता है। प्रति खोज आईडी पहला फ़ीडबैक 1 क्रेडिट वापस करता है और Firecrawl की खोज गुणवत्ता में सुधार करता है। प्रति खोज आईडी आइडेम्पोटेंट।

हर उस खोज के बाद इसे कॉल करें जिसका आप वास्तव में उपयोग करते हैं (या जो मदद नहीं की)। missingContent के साथ खराब/आंशिक फ़ीडबैक अच्छे फ़ीडबैक जितना ही मूल्यवान है।

ऑप्ट आउट: MCP सर्वर शुरू करते समय पर्यावरण में FIRECRAWL_NO_SEARCH_FEEDBACK=1 (या FIRECRAWL_DISABLE_SEARCH_FEEDBACK=1) सेट करें। firecrawl_search_feedback उपकरण पंजीकृत नहीं होगा, इसलिए एजेंट इसे कॉल नहीं कर सकते। टीम व्यवस्थापक सर्वर-साइड फ़ीडबैक भी अक्षम कर सकते हैं; उस स्थिति में उपकरण पंजीकृत है लेकिन हमेशा feedbackErrorCode: "TEAM_OPTED_OUT" लौटाता है।

सबसे महत्वपूर्ण फ़ील्ड: missingContent। यह विशिष्ट सामग्री की एक सरणी है जिसे एजेंट को खोजने की उम्मीद थी लेकिन नहीं मिली। प्रति लापता विषय एक प्रविष्टि — ये टीमों में एकत्रित होती हैं और हमें बताती हैं कि आगे क्या अनुक्रमित करना है।

दैनिक रिफंड सीमा (प्रति टीम, प्रति UTC दिन, डिफ़ॉल्ट 100 क्रेडिट)। एक बार टीम का creditsRefundedToday dailyRefundCap तक पहुँच जाता है, आगे की सबमिशन अभी भी फ़ीडबैक रिकॉर्ड करती हैं लेकिन क्रेडिट रिफंड नहीं करतीं। प्रतिक्रिया dailyCapReached: true सेट करती है। एजेंटों को उस दिन के बाकी UTC दिन के लिए इस उपकरण को कॉल करना बंद कर देना चाहिए जब वे वह फ़्लैग देखते हैं।

उपयोग उदाहरण:

{
  "name": "firecrawl_search_feedback",
  "arguments": {
    "searchId": "0193f6c5-1234-7890-abcd-1234567890ab",
    "rating": "good",
    "valuableSources": [
      {
        "url": "https://docs.firecrawl.dev/features/search",
        "reason": "Most up-to-date description of /search."
      }
    ],
    "missingContent": [
      {
        "topic": "Pricing for the search endpoint",
        "description": "No pricing tier table for /search specifically."
      },
      { "topic": "Per-team rate limits" }
    ],
    "querySuggestions": "Boost docs.firecrawl.dev for queries that mention 'firecrawl'"
  }
}

रिटर्न:

  • { success, feedbackId, creditsRefunded, alreadySubmitted? } JSON।

3सी. सामान्य फ़ीडबैक उपकरण (firecrawl_feedback)

/v2/feedback के माध्यम से पूर्ण v2 एंडपॉइंट कार्य के लिए संरचित फ़ीडबैक भेजता है। scrape, parse, map, या search कार्यों पर एंडपॉइंट-स्तरीय फ़ीडबैक के लिए इसका उपयोग करें। खोज-परिणाम गुणवत्ता के लिए विशेष रूप से, firecrawl_search_feedback को प्राथमिकता दें क्योंकि इसमें खोज-विशिष्ट मार्गदर्शन शामिल है।

फ़ीडबैक संक्षिप्त रखें: मुद्दा कोड, टैग, छोटे नोट, URL, पृष्ठ संख्याएँ और छोटे मेटाडेटा ऑब्जेक्ट का उपयोग करें। कच्चे scrape/parse आउटपुट शामिल न करें।

ऑप्ट आउट: MCP सर्वर शुरू करते समय पर्यावरण में FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 (या FIRECRAWL_DISABLE_ENDPOINT_FEEDBACK=1) सेट करें। firecrawl_feedback उपकरण पंजीकृत नहीं होगा, इसलिए एजेंट इसे कॉल नहीं कर सकते।

उपयोग उदाहरण:

{
  "name": "firecrawl_feedback",
  "arguments": {
    "endpoint": "scrape",
    "jobId": "0193f6c5-1234-7890-abcd-1234567890ab",
    "rating": "partial",
    "issues": ["missing_markdown"],
    "tags": ["docs"],
    "note": "The pricing table was missing from the markdown output.",
    "url": "https://example.com/pricing",
    "pageNumbers": [1],
    "metadata": {
      "format": "markdown"
    }
  }
}

रिटर्न:

  • { success, feedbackId, creditsRefunded, creditsRefundedToday?, dailyRefundCap?, dailyCapReached?, alreadySubmitted?, warning? } JSON।

4. क्रॉल उपकरण (firecrawl_crawl)

एक क्रॉल कार्य शुरू करता है, टर्मिनल स्थिति तक पहुँचने तक पोल करता है, और अंतिम क्रॉल स्थिति/डेटा लौटाता है।

इसके लिए सर्वोत्तम:

  • कई संबंधित पृष्ठों से सामग्री निकालना, जब आपको व्यापक कवरेज की आवश्यकता हो।

इसके लिए अनुशंसित नहीं है:

  • एकल पृष्ठ से सामग्री निकालना (scrape का उपयोग करें)
  • जब टोकन सीमाएँ चिंता का विषय हों (कड़े नियंत्रण के लिए map + scrape का उपयोग करें)
  • जब आपको तेज़ परिणाम चाहिए (क्रॉलिंग धीमी हो सकती है)

चेतावनी: क्रॉल प्रतिक्रियाएँ बहुत बड़ी हो सकती हैं और टोकन सीमा से अधिक हो सकती हैं। क्रॉल गहराई और पृष्ठों की संख्या सीमित करें, या कड़े नियंत्रण के लिए map + scrape का उपयोग करें।

सामान्य गलतियाँ:

  • limit या maxDiscoveryDepth बहुत अधिक सेट करना (टोकन ओवरफ्लो का कारण बनता है)
  • एकल पृष्ठ के लिए crawl का उपयोग करना (इसके बजाय scrape का उपयोग करें)

प्रॉम्प्ट उदाहरण:

"example.com/blog के पहले दो स्तरों से सभी ब्लॉग पोस्ट प्राप्त करें।"

उपयोग उदाहरण:

{
  "name": "firecrawl_crawl",
  "arguments": {
    "url": "https://example.com/blog/*",
    "maxDiscoveryDepth": 2,
    "limit": 100,
    "allowExternalLinks": false,
    "deduplicateSimilarURLs": true
  }
}

रिटर्न:

  • आंतरिक पोलिंग के बाद अंतिम क्रॉल स्थिति और डेटा, जिसमें id, status, completed, total, creditsUsed, expiresAt, next और data शामिल हैं। यदि आपको बाद में कार्य को फिर से जाँचने की आवश्यकता हो तो लौटाए गए id का उपयोग firecrawl_check_crawl_status के साथ करें।

5. क्रॉल स्थिति जाँचें (firecrawl_check_crawl_status)

आईडी द्वारा मौजूदा क्रॉल कार्य की स्थिति और परिणाम जाँचें।

{
  "name": "firecrawl_check_crawl_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

रिटर्न:

  • प्रतिक्रिया में क्रॉल कार्य की स्थिति शामिल है:

6. पार्स उपकरण (firecrawl_parse)

Firecrawl के /v2/parse एंडपॉइंट के साथ स्थानीय फ़ाइलें या होस्टेड अपलोड संदर्भ पार्स करें।

इसके लिए सर्वोत्तम: PDF, Word दस्तावेज़, स्प्रेडशीट, HTML फ़ाइलें और अन्य दस्तावेज़ जिन्हें मार्कडाउन या संरचित JSON आउटपुट की आवश्यकता होती है। होस्टेड MCP दो-चरणीय अपलोड-रेफ़ फ्लो का समर्थन करता है; स्थानीय प्रत्यक्ष फ़ाइल पढ़ने के लिए सेल्फ-होस्टेड FIRECRAWL_API_URL की आवश्यकता होती है।

इसके लिए अनुशंसित नहीं है: दूरस्थ URL (scrape का उपयोग करें), एक कॉल में कई फ़ाइलें (प्रति फ़ाइल एक बार parse कॉल करें), या केवल ब्राउज़र-क्रियाएँ जैसे स्क्रीनशॉट और क्लिक।

होस्टेड MCP फ्लो: होस्टेड MCP कॉलर के फ़ाइल सिस्टम को सीधे नहीं पढ़ सकता। अल्पकालिक अपलोड कमांड और nextToolCall प्राप्त करने के लिए firecrawl_parse को filePath के साथ कॉल करें, फ़ाइल को स्थानीय रूप से अपलोड करें, फिर लौटाए गए uploadRef के साथ firecrawl_parse को फिर से कॉल करें। होस्टेड अपलोड URL मिंट करने के लिए Firecrawl प्रमाणीकरण या कीलेस पात्रता की आवश्यकता होती है। स्थानीय npx firecrawl-mcp मोड में, प्रत्यक्ष फ़ाइल पार्सिंग के लिए वर्तमान में सेल्फ-होस्टेड Firecrawl API की ओर इशारा करते हुए FIRECRAWL_API_URL की आवश्यकता होती है; एक सादा क्लाउड API-कुंजी-केवल स्थानीय सर्वर इस उपकरण के माध्यम से फ़ाइलें पढ़ और अपलोड नहीं कर सकता।

उपयोग उदाहरण:

{
  "name": "firecrawl_parse",
  "arguments": {
    "filePath": "/absolute/path/to/document.pdf",
    "formats": ["markdown"],
    "parsers": ["pdf"],
    "zeroDataRetention": true
  }
}

रिटर्न: पार्स किए गए दस्तावेज़ की सामग्री या nextToolCall के साथ होस्टेड अपलोड निर्देश।

7. Scrape JSON के साथ संरचित डेटा

किसी ज्ञात पृष्ठ से संरचित डेटा के लिए, प्रति URL एक बार firecrawl_scrape को formats: ["json"] के साथ कॉल करें। निष्कर्षण प्रॉम्प्ट और JSON स्कीमा को jsonOptions में रखें।

{
  "name": "firecrawl_scrape",
  "arguments": {
    "url": "https://example.com/product",
    "formats": ["json"],
    "jsonOptions": {
      "prompt": "Extract the product name, price, and description.",
      "schema": {
        "type": "object",
        "properties": {
          "name": { "type": "string" },
          "price": { "type": "number" },
          "description": { "type": "string" }
        },
        "required": ["name", "price"]
      }
    }
  }
}

अज्ञात URL या बहु-स्रोत अनुसंधान के लिए, Scrape से पहले firecrawl_search या firecrawl_agent का उपयोग करें।

8. एजेंट उपकरण (firecrawl_agent)

स्वायत्त वेब अनुसंधान एजेंट। यह एक अलग AI एजेंट परत है जो स्वतंत्र रूप से इंटरनेट ब्राउज़ करता है, जानकारी खोजता है, पृष्ठों के माध्यम से नेविगेट करता है, और आपकी क्वेरी के आधार पर संरचित डेटा निकालता है।

यह कैसे काम करता है:

एजेंट वेब खोज करता है, लिंक का अनुसरण करता है, पृष्ठ पढ़ता है, और स्वायत्त रूप से डेटा एकत्र करता है। यह अतुल्यकालिक रूप से चलता है - यह तुरंत एक कार्य आईडी लौटाता है, और आप पूर्ण होने पर जाँचने और परिणाम प्राप्त करने के लिए firecrawl_agent_status को पोल करते हैं।

अतुल्यकालिक वर्कफ़्लो:

  1. अपने प्रॉम्प्ट/स्कीमा के साथ firecrawl_agent कॉल करें → कार्य आईडी लौटाता है
  2. एजेंट के अनुसंधान करते समय अन्य कार्य करें (जटिल क्वेरी के लिए मिनट लग सकते हैं)
  3. प्रगति जाँचने के लिए कार्य आईडी के साथ firecrawl_agent_status को पोल करें
  4. जब स्थिति "completed" हो, तो प्रतिक्रिया में निकाला गया डेटा शामिल होता है

इसके लिए सर्वोत्तम:

  • जटिल अनुसंधान कार्य जहाँ आप सटीक URL नहीं जानते
  • बहु-स्रोत डेटा संग्रह
  • वेब पर बिखरी जानकारी ढूंढना
  • ऐसे कार्य जहाँ आप परिणामों की प्रतीक्षा करते हुए अन्य कार्य कर सकते हैं

इसके लिए अनुशंसित नहीं है:

  • सरल एकल-पृष्ठ स्क्रैपिंग जहाँ आप URL जानते हैं (JSON प्रारूप के साथ scrape का उपयोग करें - तेज़ और सस्ता)

तर्क:

  • prompt: आपके इच्छित डेटा का प्राकृतिक भाषा विवरण (आवश्यक, अधिकतम 10,000 वर्ण)
  • urls: एजेंट को विशिष्ट पृष्ठों पर केंद्रित करने के लिए URL की वैकल्पिक सरणी
  • schema: संरचित आउटपुट के लिए वैकल्पिक JSON स्कीमा

प्रॉम्प्ट उदाहरण:

"Firecrawl के संस्थापकों और उनकी पृष्ठभूमि को खोजें"

उपयोग उदाहरण (एजेंट शुरू करें, फिर परिणामों के लिए पोल करें):

{
  "name": "firecrawl_agent",
  "arguments": {
    "prompt": "Find the top 5 AI startups founded in 2024 and their funding amounts",
    "schema": {
      "type": "object",
      "properties": {
        "startups": {
          "type": "array",
          "items": {
            "type": "object",
            "properties": {
              "name": { "type": "string" },
              "funding": { "type": "string" },
              "founded": { "type": "string" }
            }
          }
        }
      }
    }
  }
}

फिर लौटाए गए कार्य आईडी का उपयोग करके firecrawl_agent_status के साथ पोल करें।

उपयोग उदाहरण (URL के साथ - एजेंट विशिष्ट पृष्ठों पर केंद्रित होता है):

{
  "name": "firecrawl_agent",
  "arguments": {
    "urls": ["https://docs.firecrawl.dev", "https://firecrawl.dev/pricing"],
    "prompt": "Compare the features and pricing information from these pages"
  }
}

रिटर्न:

  • स्थिति जाँच के लिए कार्य आईडी। परिणामों के लिए पोल करने हेतु firecrawl_agent_status का उपयोग करें।

9. एजेंट स्थिति जाँचें (firecrawl_agent_status)

एजेंट कार्य की स्थिति जाँचें और पूर्ण होने पर परिणाम प्राप्त करें। एजेंट शुरू करने के बाद परिणामों के लिए पोल करने हेतु इसका उपयोग करें।

पोलिंग पैटर्न: एजेंट अनुसंधान जटिल क्वेरी के लिए मिनट ले सकता है। स्थिति "completed" या "failed" होने तक इस एंडपॉइंट को समय-समय पर (जैसे, हर 10-30 सेकंड) पोल करें।

{
  "name": "firecrawl_agent_status",
  "arguments": {
    "id": "550e8400-e29b-41d4-a716-446655440000"
  }
}

संभावित स्थितियाँ:

  • processing: एजेंट अभी भी अनुसंधान कर रहा है - बाद में जाँचें
  • completed: अनुसंधान समाप्त - प्रतिक्रिया में निकाला गया डेटा शामिल है
  • failed: एक त्रुटि हुई

10. इंटरैक्ट उपकरण (firecrawl_interact)

एक नए URL के साथ या उस पृष्ठ के साथ इंटरैक्ट करें जो पहले firecrawl_scrape द्वारा खोला गया था।

इसके लिए सर्वोत्तम: पुराने ब्राउज़र उपकरणों को पुनर्स्थापित किए बिना गतिशील पृष्ठों से क्लिक करना, टाइप करना, नेविगेट करना और स्थिति निकालना।

उपयोग विकल्प:

  • एक MCP कॉल में इंटरैक्शन के लिए पृष्ठ को स्क्रैप और खोलने हेतु url पास करें।
  • मौजूदा स्क्रैप किए गए पृष्ठ के साथ इंटरैक्ट करना जारी रखने के लिए scrapeId पास करें।
  • url या scrapeId में से ठीक एक, साथ ही prompt या code में से एक पास करें।

उपयोग उदाहरण:

{
  "name": "firecrawl_interact",
  "arguments": {
    "url": "https://example.com",
    "prompt": "Click the pricing link and summarize the visible plans"
  }
}

रिटर्न: इंटरैक्शन परिणाम और, URL मोड के लिए, अनुवर्ती या सफाई के लिए व्युत्पन्न scrapeId

11. इंटरैक्ट रोकें उपकरण (firecrawl_interact_stop)

जब आप इंटरैक्ट करना समाप्त कर लें तो स्क्रैप किए गए पृष्ठ के लिए इंटरैक्ट सत्र रोकें।

{
  "name": "firecrawl_interact_stop",
  "arguments": {
    "scrapeId": "scrape-id-here"
  }
}

12. अनुसंधान उपकरण (firecrawl_research_*)

अनुसंधान MCP उपकरणों के माध्यम से पेपर और GitHub रिपॉजिटरी खोजें और निरीक्षण करें।

कवर करता है: बायोमेडिकल, जीवन-विज्ञान और नैदानिक साहित्य (PubMed, bioRxiv, medRxiv) के साथ-साथ arXiv और अन्य वैज्ञानिक स्रोतों में पेपर एब्सट्रैक्ट और पूर्ण पाठ।

उपलब्ध अनुसंधान उपकरण:

  • firecrawl_research_search_papers: प्राकृतिक-भाषा क्वेरी के साथ पेपर मेटाडेटा और एब्सट्रैक्ट खोजें, वैकल्पिक लेखक, श्रेणी और दिनांक फ़िल्टर के साथ।
  • firecrawl_research_inspect_paper: एक पेपर आईडी (arXiv, PMC, PMID, या DOI) के लिए विहित मेटाडेटा प्राप्त करें।
  • firecrawl_research_related_papers: उद्धरण ग्राफ के माध्यम से एक या अधिक एंकर पेपर से विस्तार करें।
  • firecrawl_research_read_paper: किसी विशिष्ट पेपर से पूर्ण-पाठ अंश पढ़ें।
  • firecrawl_research_search_github: अनुक्रमित सार्वजनिक GitHub मुद्दा, पुल-अनुरोध और README सामग्री खोजें।

इसके लिए सर्वोत्तम: साहित्य समीक्षा, पेपर लुकअप और रिपॉजिटरी खोज वर्कफ़्लो जहाँ एजेंट को सामान्य वेब स्क्रैपिंग के बजाय एक केंद्रित अनुसंधान सतह की आवश्यकता होती है।

firecrawl_search के साथ categories: ["research"] एक अलग सतह है: यह सामान्य वेब परिणामों को शोध-संबद्ध वेबसाइटों तक फ़िल्टर करता है और पेपर रिकॉर्ड के बजाय पृष्ठ स्निपेट लौटाता है। इन उपकरणों का उपयोग तब करें जब प्रश्न साहित्य के बारे में ही हो, और उसी प्रश्न के कई अलग-अलग फ्रेमिंग पास करें — वे एकल क्वेरी की तुलना में अलग-अलग पेपर सतह करते हैं।

13. मॉनिटर उपकरण (firecrawl_monitor_*)

आवर्ती पृष्ठ मॉनिटर बनाएं और प्रबंधित करें। मॉनिटर अनुसूचित स्क्रैप या क्रॉल चलाते हैं, प्रत्येक परिणाम को अंतिम बनाए रखे गए स्नैपशॉट के विरुद्ध अंतर करते हैं, और वेबहुक या ईमेल द्वारा सूचित कर सकते हैं।

इसके लिए सर्वोत्तम:

  • समय के साथ एक पृष्ठ या कुछ पृष्ठ देखना
  • सादे-अंग्रेज़ी लक्ष्य का उपयोग करके सार्थक परिवर्तनों पर सतर्क करना
  • जाँच इतिहास और पृष्ठ-स्तरीय अंतर ट्रैक करना

अनुशंसित निर्माण पैटर्न: page या pages का उपयोग goal के साथ करें। MCP सर्वर 30 मिनट के शेड्यूल के साथ मॉनिटर अनुरोध बनाता है और API स्वचालित रूप से सार्थक-परिवर्तन निर्णय सक्षम करता है।

जब goal सेट होता है तो सार्थक-परिवर्तन निर्णय स्वचालित रूप से चलता है। पेज वेबहुक monitor.page इवेंट्स पर isMeaningful और judgment उजागर करते हैं।

लक्ष्यों को संक्षिप्त 2-3 वाक्यों की मॉनिटर निर्देशों के रूप में लिखें। बताएं कि किस चीज़ से अलर्ट ट्रिगर होना चाहिए, उपयोगकर्ता द्वारा दिया गया कोई भी दायरा संरक्षित करें, और केवल तभी इंटेंट-विशिष्ट बहिष्करण शामिल करें जब अनुरोध से स्पष्ट हो। सामान्य शोर जैसे व्हाइटस्पेस, केवल-फ़ॉर्मेटिंग परिवर्तन, अनुरोध आईडी, ट्रैकिंग पैरामीटर, सामान्य मेटाडेटा, और असंबंधित पेज क्रोम पहले से ही जज द्वारा संभाला जाता है, इसलिए इसे हर लक्ष्य में दोहराएं नहीं। यदि उपयोगकर्ता अस्पष्ट है, तो लक्ष्य को व्यापक रखें; यदि वे व्यापक निगरानी या "कोई भी परिवर्तन" मांगते हैं, तो उसे संरक्षित करें। यदि उपयोगकर्ता कहता है कि उन्हें किसी चीज़ की परवाह नहीं है, तो उसे स्पष्ट रूप से शामिल करें।

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "page": "https://example.com/pricing",
    "goal": "Alert when pricing, packaging, or launch messaging changes."
  }
}

वेबहुक के साथ कई पेज:

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "pages": ["https://example.com/pricing", "https://example.com/changelog"],
    "goal": "Alert when pricing, packaging, or launch messaging changes.",
    "webhookUrl": "https://example.com/webhooks/firecrawl"
  }
}

उन्नत निर्माण अनुरोध:

जब आपको क्रॉल लक्ष्य, JSON परिवर्तन ट्रैकिंग, कस्टम प्रतिधारण, या स्पष्ट judgeEnabled नियंत्रण की आवश्यकता हो तो body पास करें।

{
  "name": "firecrawl_monitor_create",
  "arguments": {
    "body": {
      "name": "Docs monitor",
      "schedule": { "text": "hourly", "timezone": "UTC" },
      "goal": "Alert when docs pages add, remove, or materially change API behavior.",
      "targets": [{ "type": "crawl", "url": "https://example.com/docs" }]
    }
  }
}

अन्य मॉनिटर उपकरण:

  • firecrawl_monitor_list: मॉनिटर सूचीबद्ध करें।
  • firecrawl_monitor_get: एक मॉनिटर प्राप्त करें।
  • firecrawl_monitor_update: goal, judgeEnabled, webhook, और notification सहित फ़ील्ड अपडेट करें।
  • firecrawl_monitor_run: अभी एक जाँच ट्रिगर करें।
  • firecrawl_monitor_delete: एक मॉनिटर हटाएं (विनाशकारी; केवल तभी कॉल करें जब उपयोगकर्ता इसे हटाने का इरादा रखता है)।
  • firecrawl_monitor_checks: जाँच सूचीबद्ध करें, वैकल्पिक रूप से स्थिति द्वारा फ़िल्टर किया गया।
  • firecrawl_monitor_check: पेज-स्तरीय परिणाम प्राप्त करें, जिसमें diff, snapshot, judgment.meaningful, और judgment.meaningfulChanges शामिल हैं।

14. डेवलपर खोज उपकरण (firecrawl_developer_search)

कोडिंग एजेंटों के लिए बनाए गए इंडेक्स को खोजें। इंडेक्स GitHub मुद्दों, विलय किए गए पुल अनुरोधों, रिपॉजिटरी README, और क्यूरेटेड दस्तावेज़ीकरण साइटों को कवर करता है।

इसके लिए सर्वोत्तम: एक प्रोग्रामिंग प्रश्न — कोड व्यवहार, एक लाइब्रेरी या फ्रेमवर्क, एक API अनुबंध, एक त्रुटि संदेश, या एक ज्ञात बग।

तर्क:

{
  "name": "firecrawl_developer_search",
  "arguments": {
    "query": "how do I configure retries",
    "k": 10,
    "skills": "only"
  }
}
  • query (आवश्यक): डेवलपर प्रश्न या खोज वाक्यांश।
  • k: रैंक किए गए परिणामों की संख्या। डिफ़ॉल्ट 10 है और अधिकतम 100 है।
  • skills: केवल एजेंट-कौशल फ़ाइलों को खोजने के लिए "only" पर सेट करें।

रिटर्न: रैंक किए गए परिणाम। प्रत्येक परिणाम में एक आईडी, एक स्रोत प्रकार (issue, pull_request, readme, या doc), एक URL, एक शीर्षक, और मार्कडाउन में मिलान किए गए अंश होते हैं।

firecrawl_search को categories: ["developer"] के साथ वेब परिणामों के बगल में समान इंडेक्स खोजता है। इस उपकरण का उपयोग तब करें जब आप अंश चाहते हैं और कोई वेब परिणाम नहीं। केवल-खोज एंडपॉइंट इस उपकरण को उजागर नहीं करता है; यह अपने निश्चित छह उपकरणों का सेट रखता है, और firecrawl_search वहां डेवलपर इंडेक्स तक पहुंचता है।

लॉगिंग प्रणाली

सर्वर में व्यापक लॉगिंग शामिल है:

  • संचालन स्थिति और प्रगति
  • प्रदर्शन मेट्रिक्स
  • दर सीमा ट्रैकिंग
  • त्रुटि स्थितियाँ

उदाहरण लॉग संदेश:

[INFO] Firecrawl MCP Server initialized successfully
[INFO] Starting scrape for URL: https://example.com
[ERROR] Rate limit exceeded

त्रुटि प्रबंधन

सर्वर मजबूत त्रुटि प्रबंधन प्रदान करता है:

  • API दर-सीमा त्रुटियाँ MCP क्लाइंट को सतह पर लाई गईं
  • विस्तृत त्रुटि संदेश
  • नेटवर्क लचीलापन

उदाहरण त्रुटि प्रतिक्रिया:

{
  "content": [
    {
      "type": "text",
      "text": "Error: Rate limit exceeded"
    }
  ],
  "isError": true
}

विकास

# Install dependencies
npm install

# Build
npm run build

# Run tests
npm test

योगदान

  1. रिपॉजिटरी को फोर्क करें
  2. अपनी फीचर शाखा बनाएं
  3. परीक्षण चलाएं: npm test
  4. पुल अनुरोध सबमिट करें

योगदानकर्ताओं को धन्यवाद

प्रारंभिक कार्यान्वयन के लिए @vrknetha, @cawstudios को धन्यवाद!

हमारे सर्वर को होस्ट करने के लिए MCP.so और Klavis AI को धन्यवाद और @gstarwd, @xiangkaiz और @zihaolin96 को एकीकृत करने के लिए धन्यवाद।

लाइसेंस

MIT लाइसेंस - विवरण के लिए LICENSE फ़ाइल देखें