Tools
Firecrawl
OpenClaw może korzystać z Firecrawl na trzy sposoby:
- jako dostawcy
web_search - jako jawnie wywoływanych narzędzi pluginu:
firecrawl_searchifirecrawl_scrape - jako awaryjnego ekstraktora dla
web_fetch
Jest to hostowana usługa wyodrębniania i wyszukiwania, która obsługuje omijanie zabezpieczeń przed botami oraz buforowanie, co pomaga w przypadku witryn intensywnie korzystających z JavaScriptu lub stron blokujących zwykłe żądania HTTP.
Instalowanie pluginu
Zainstaluj oficjalny plugin, a następnie uruchom ponownie Gateway:
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartDostęp bez klucza i klucze API
Firecrawl rejestruje dwóch dostawców web_search:
- Firecrawl Search (
firecrawl) — korzysta z hostowanego API/v2/searchz podanym kluczem; jest automatycznie wykrywany, gdy klucz jest dostępny. - Firecrawl Search (Free) (
firecrawl-free) — korzysta z hostowanego, bezpłatnego poziomu początkowego bez klucza; klucz API nie jest wymagany. Wymaga jawnego włączenia i nigdy nie jest wybierany automatycznie, ponieważ jego wybranie powoduje wysyłanie zapytań wyszukiwania do bezpłatnego poziomu usługi Firecrawl.
Jawnie wybrane rozwiązanie awaryjne Firecrawl web_fetch również nie wymaga klucza. Jawnie wywoływane narzędzia firecrawl_search i firecrawl_scrape wymagają klucza API. Dodaj
FIRECRAWL_API_KEY w środowisku Gateway lub skonfiguruj go, aby uzyskać wyższe limity.
Konfigurowanie wyszukiwania Firecrawl
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}Uwagi:
- Wybranie Firecrawl podczas wdrażania lub w
openclaw configure --section webautomatycznie włącza zainstalowany plugin Firecrawl. - Wybierz Firecrawl Search (Free) podczas wdrażania (lub ustaw
provider: "firecrawl-free"), aby działać bez klucza API. Dostawca Firecrawl Search korzystający z klucza wysyłaplugins.entries.firecrawl.config.webSearch.apiKeylubFIRECRAWL_API_KEY. web_searchz Firecrawl obsługujequeryicount.- Aby korzystać z ustawień właściwych dla Firecrawl, takich jak
sources,categorieslub pobieranie wyników, użyjfirecrawl_search. baseUrldomyślnie korzysta z hostowanej usługi Firecrawl pod adresemhttps://api.firecrawl.dev. Nadpisania dla samodzielnie hostowanych instancji są dozwolone tylko w przypadku prywatnych lub wewnętrznych punktów końcowych; protokół HTTP jest akceptowany wyłącznie dla takich prywatnych celów.FIRECRAWL_BASE_URLjest współdzieloną zmienną środowiskową używaną awaryjnie dla bazowych adresów URL wyszukiwania i pobierania Firecrawl.- Domyślny limit czasu żądań wyszukiwania Firecrawl wynosi 30 sekund; parametr
timeoutSecondsnarzędziafirecrawl_searchnadpisuje go dla poszczególnych wywołań.
Konfigurowanie rozwiązania awaryjnego Firecrawl dla web_fetch
{ tools: { web: { fetch: { provider: "firecrawl", // jawny wybór włącza rozwiązanie awaryjne bez klucza }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}Uwagi:
- Jawnie wybrane rozwiązanie awaryjne Firecrawl
web_fetchdziała bez klucza API. Jeśli skonfigurowano klucz, OpenClaw wysyłaplugins.entries.firecrawl.config.webFetch.apiKeylubFIRECRAWL_API_KEY, aby uzyskać wyższe limity. - Wybranie Firecrawl podczas wdrażania lub w
openclaw configure --section webwłącza plugin i wybiera Firecrawl dlaweb_fetch, chyba że skonfigurowano już innego dostawcę pobierania. firecrawl_scrapewymaga klucza API.maxAgeMsokreśla maksymalny wiek wyników w pamięci podręcznej (ms). Wartość domyślna to 172,800,000 ms (2 dni).onlyMainContentma wartość domyślnątrue; wartością domyślnątimeoutSecondsjest 60.- Starsza konfiguracja
tools.web.fetch.firecrawl.*itools.web.search.firecrawl.*jest automatycznie migrowana przezopenclaw doctor --fix. - Nadpisania adresów URL pobierania i bazowego Firecrawl podlegają tej samej regule dotyczącej usług hostowanych i prywatnych co wyszukiwanie: publiczny ruch hostowany korzysta z
https://api.firecrawl.dev; nadpisania dla samodzielnie hostowanych instancji muszą wskazywać prywatne lub wewnętrzne punkty końcowe. firecrawl_scrapeodrzuca oczywiste prywatne, zwrotne, metadanych oraz inne niż HTTP(S) docelowe adresy URL przed przekazaniem ich do Firecrawl, zgodnie z kontraktem bezpieczeństwa celówweb_fetchdotyczącym jawnych wywołań pobierania Firecrawl.
firecrawl_scrape ponownie wykorzystuje te same ustawienia plugins.entries.firecrawl.config.webFetch.* i zmienne środowiskowe, w tym wymagany klucz API.
Samodzielnie hostowany Firecrawl
Ustaw plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl lub FIRECRAWL_BASE_URL, jeśli Firecrawl działa na własnej infrastrukturze. OpenClaw akceptuje http:// wyłącznie dla celów zwrotnych, w sieci prywatnej, .local, .internal lub .localhost. Niestandardowe hosty publiczne są odrzucane, aby klucze API Firecrawl nie zostały przypadkowo wysłane do dowolnych punktów końcowych.
Narzędzia pluginu Firecrawl
firecrawl_search
Użyj tego narzędzia, aby korzystać z ustawień wyszukiwania właściwych dla Firecrawl zamiast ogólnego narzędzia web_search. Wymaga klucza API.
Parametry:
querycount(1-100)sourcescategoriesincludeDomains/excludeDomains(tylko nazwy hostów; wzajemnie się wykluczają)tbs(filtr czasu, na przykładqdr:d,qdr:w,sbd:1)locationicountry(kierowanie geograficzne)scrapeResultstimeoutSeconds
firecrawl_scrape
Użyj tego narzędzia w przypadku stron intensywnie korzystających z JavaScriptu lub chronionych przed botami, dla których zwykłe narzędzie web_fetch jest niewystarczające.
Parametry:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Tryb stealth / omijanie zabezpieczeń przed botami
firecrawl_scrape i rozwiązanie awaryjne Firecrawl web_fetch domyślnie używają proxy: "auto" wraz z storeInCache: true, chyba że wywołujący nadpisze te parametry. firecrawl_search i dostawca Firecrawl web_search nie mają ustawień proxy/storeInCache; tryb proxy stealth ma zastosowanie wyłącznie do żądań pobierania.
Tryb proxy usługi Firecrawl steruje omijaniem zabezpieczeń przed botami (basic, stealth lub auto). auto ponawia próbę przy użyciu serwerów proxy stealth, jeśli podstawowa próba się nie powiedzie, co może zużyć więcej kredytów niż pobieranie wyłącznie w trybie podstawowym.
Jak web_fetch korzysta z Firecrawl
Kolejność wyodrębniania web_fetch:
- Readability (lokalnie)
- Skonfigurowany dostawca pobierania, taki jak Firecrawl (gdy został wybrany lub automatycznie wykryty na podstawie skonfigurowanych danych uwierzytelniających)
- Podstawowe oczyszczanie HTML (ostatnie rozwiązanie awaryjne)
Ustawieniem wyboru jest tools.web.fetch.provider. Jeśli zostanie pominięte, OpenClaw automatycznie wykrywa pierwszego gotowego dostawcę pobierania stron internetowych na podstawie dostępnych danych uwierzytelniających. Oficjalny plugin Firecrawl zapewnia to rozwiązanie awaryjne.
Powiązane
- Omówienie wyszukiwania w sieci -- wszyscy dostawcy i automatyczne wykrywanie
- Pobieranie z sieci -- narzędzie web_fetch z rozwiązaniem awaryjnym Firecrawl
- Tavily -- narzędzia wyszukiwania i wyodrębniania