Tools
Firecrawl
OpenClaw Firecrawl का तीन तरीकों से उपयोग कर सकता है:
web_searchप्रदाता के रूप में- स्पष्ट Plugin टूल के रूप में:
firecrawl_searchऔरfirecrawl_scrape web_fetchके लिए फ़ॉलबैक एक्सट्रैक्टर के रूप में
यह एक होस्टेड एक्सट्रैक्शन/खोज सेवा है जो बॉट से बचाव और कैशिंग का समर्थन करती है, जिससे JS-प्रधान साइटों या सामान्य HTTP फ़ेच को अवरुद्ध करने वाले पेजों पर सहायता मिलती है।
Plugin इंस्टॉल करें
आधिकारिक Plugin इंस्टॉल करें, फिर Gateway पुनः आरंभ करें:
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartबिना कुंजी की पहुँच और API कुंजियाँ
Firecrawl दो web_search प्रदाताओं को पंजीकृत करता है:
- Firecrawl खोज (
firecrawl) — आपकी कुंजी के साथ होस्टेड/v2/searchAPI का उपयोग करता है; कुंजी मौजूद होने पर इसका स्वतः पता लगाया जाता है। - Firecrawl खोज (निःशुल्क) (
firecrawl-free) — होस्टेड बिना-कुंजी वाले स्टार्टर टियर का उपयोग करता है, API कुंजी आवश्यक नहीं है। यह केवल स्पष्ट सहमति से उपलब्ध है और कभी स्वतः चयनित नहीं होता, क्योंकि इसे चुनने पर आपकी खोज क्वेरी Firecrawl के निःशुल्क टियर को भेजी जाती हैं।
स्पष्ट रूप से चयनित Firecrawl web_fetch फ़ॉलबैक भी बिना कुंजी के काम करता है। स्पष्ट firecrawl_search और firecrawl_scrape टूल के लिए API कुंजी आवश्यक है। अधिक सीमाओं के लिए gateway परिवेश में FIRECRAWL_API_KEY जोड़ें या इसे कॉन्फ़िगर करें।
Firecrawl खोज कॉन्फ़िगर करें
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}टिप्पणियाँ:
- ऑनबोर्डिंग या
openclaw configure --section webमें Firecrawl चुनने से इंस्टॉल किया गया Firecrawl Plugin स्वतः सक्षम हो जाता है। - API कुंजी के बिना चलाने के लिए ऑनबोर्डिंग में Firecrawl खोज (निःशुल्क) चुनें (या
provider: "firecrawl-free"सेट करें)। कुंजी वाला Firecrawl खोज प्रदाताplugins.entries.firecrawl.config.webSearch.apiKeyयाFIRECRAWL_API_KEYभेजता है। - Firecrawl के साथ
web_search,queryऔरcountका समर्थन करता है। sources,categoriesया परिणाम स्क्रैपिंग जैसे Firecrawl-विशिष्ट नियंत्रणों के लिएfirecrawl_searchका उपयोग करें।baseUrlका डिफ़ॉल्ट होस्टेड Firecrawlhttps://api.firecrawl.devहै। स्वयं-होस्टेड ओवरराइड की अनुमति केवल निजी/आंतरिक एंडपॉइंट के लिए है; HTTP केवल उन्हीं निजी लक्ष्यों के लिए स्वीकार किया जाता है।FIRECRAWL_BASE_URL, Firecrawl खोज और स्क्रैप के बेस URL के लिए साझा परिवेश फ़ॉलबैक है।- Firecrawl खोज अनुरोधों का डिफ़ॉल्ट टाइमआउट 30 सेकंड है;
firecrawl_searchकाtimeoutSecondsपैरामीटर प्रत्येक कॉल के लिए इसे ओवरराइड करता है।
Firecrawl web_fetch फ़ॉलबैक कॉन्फ़िगर करें
{ tools: { web: { fetch: { provider: "firecrawl", // स्पष्ट चयन बिना-कुंजी वाला फ़ॉलबैक सक्षम करता है }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}टिप्पणियाँ:
- स्पष्ट रूप से चयनित Firecrawl
web_fetchफ़ॉलबैक API कुंजी के बिना काम करता है। कॉन्फ़िगर होने पर OpenClaw अधिक सीमाओं के लिएplugins.entries.firecrawl.config.webFetch.apiKeyयाFIRECRAWL_API_KEYभेजता है। - ऑनबोर्डिंग या
openclaw configure --section webके दौरान Firecrawl चुनने से Plugin सक्षम होता है औरweb_fetchके लिए Firecrawl चयनित होता है, बशर्ते कोई अन्य फ़ेच प्रदाता पहले से कॉन्फ़िगर न हो। firecrawl_scrapeके लिए API कुंजी आवश्यक है।maxAgeMsनियंत्रित करता है कि कैश किए गए परिणाम कितने पुराने हो सकते हैं (ms)। डिफ़ॉल्ट 172,800,000 ms (2 दिन) है।onlyMainContentका डिफ़ॉल्टtrueहै;timeoutSecondsका डिफ़ॉल्ट 60 है।- पुराना
tools.web.fetch.firecrawl.*औरtools.web.search.firecrawl.*कॉन्फ़िगरेशनopenclaw doctor --fixद्वारा स्वतः माइग्रेट किया जाता है। - Firecrawl स्क्रैप/बेस URL ओवरराइड खोज के समान होस्टेड/निजी नियम का पालन करते हैं: सार्वजनिक होस्टेड ट्रैफ़िक
https://api.firecrawl.devका उपयोग करता है; स्वयं-होस्टेड ओवरराइड को निजी/आंतरिक एंडपॉइंट पर रिज़ॉल्व होना चाहिए। firecrawl_scrape, स्पष्ट Firecrawl स्क्रैप कॉल के लिएweb_fetchलक्ष्य-सुरक्षा अनुबंध के अनुरूप, स्पष्ट रूप से निजी, लूपबैक, मेटाडेटा और गैर-HTTP(S) लक्ष्य URL को Firecrawl पर अग्रेषित करने से पहले अस्वीकार करता है।
firecrawl_scrape आवश्यक API कुंजी सहित समान plugins.entries.firecrawl.config.webFetch.* सेटिंग और परिवेश चर का पुनः उपयोग करता है।
स्वयं-होस्टेड Firecrawl
Firecrawl को स्वयं चलाते समय plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl या FIRECRAWL_BASE_URL सेट करें। OpenClaw केवल लूपबैक, निजी नेटवर्क, .local, .internal या .localhost लक्ष्यों के लिए http:// स्वीकार करता है। सार्वजनिक कस्टम होस्ट अस्वीकार किए जाते हैं, ताकि Firecrawl API कुंजियाँ गलती से मनमाने एंडपॉइंट को न भेजी जाएँ।
Firecrawl Plugin टूल
firecrawl_search
सामान्य web_search के बजाय Firecrawl-विशिष्ट खोज नियंत्रणों की आवश्यकता होने पर इसका उपयोग करें। API कुंजी आवश्यक है।
पैरामीटर:
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(केवल होस्टनाम; परस्पर अपवर्जित)tbs(समय फ़िल्टर, उदाहरण के लिएqdr:d,qdr:w,sbd:1)locationऔरcountry(भौगोलिक लक्ष्यीकरण)scrapeResultstimeoutSeconds
firecrawl_scrape
JS-प्रधान या बॉट-संरक्षित पेजों के लिए इसका उपयोग करें, जहाँ सामान्य web_fetch कम प्रभावी है।
पैरामीटर:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
स्टेल्थ / बॉट से बचाव
firecrawl_scrape और web_fetch Firecrawl फ़ॉलबैक का डिफ़ॉल्ट proxy: "auto" तथा storeInCache: true है, जब तक कॉलर उन पैरामीटर को ओवरराइड नहीं करता। firecrawl_search और web_search Firecrawl प्रदाता में proxy/storeInCache नियंत्रण नहीं हैं; स्टेल्थ प्रॉक्सी मोड केवल स्क्रैप/फ़ेच अनुरोधों पर लागू होता है।
Firecrawl का proxy मोड बॉट से बचाव को नियंत्रित करता है (basic, stealth या auto)। यदि मूल प्रयास विफल हो जाता है, तो auto स्टेल्थ प्रॉक्सी के साथ पुनः प्रयास करता है, जिसमें केवल मूल स्क्रैपिंग की तुलना में अधिक क्रेडिट लग सकते हैं।
web_fetch Firecrawl का उपयोग कैसे करता है
web_fetch एक्सट्रैक्शन क्रम:
- Readability (स्थानीय)
- कॉन्फ़िगर किया गया फ़ेच प्रदाता, जैसे Firecrawl (चयनित होने पर या कॉन्फ़िगर किए गए क्रेडेंशियल से स्वतः पता लगने पर)
- मूल HTML सफ़ाई (अंतिम फ़ॉलबैक)
चयन नियंत्रण tools.web.fetch.provider है। यदि इसे छोड़ दिया जाता है, तो OpenClaw उपलब्ध क्रेडेंशियल से पहले तैयार वेब-फ़ेच प्रदाता का स्वतः पता लगाता है। आधिकारिक Firecrawl Plugin वह फ़ॉलबैक प्रदान करता है।
संबंधित
- वेब खोज का अवलोकन -- सभी प्रदाता और स्वतः पहचान
- वेब फ़ेच -- Firecrawl फ़ॉलबैक वाला web_fetch टूल
- Tavily -- खोज + एक्सट्रैक्ट टूल