Tools
Firecrawl
OpenClaw kann Firecrawl auf drei Arten verwenden:
- als
web_search-Provider - als explizite Plugin-Tools:
firecrawl_searchundfirecrawl_scrape - als Fallback-Extraktor für
web_fetch
Es handelt sich um einen gehosteten Extraktions-/Suchdienst, der Bot-Umgehung und Caching unterstützt. Dies ist bei stark JavaScript-basierten Websites oder Seiten hilfreich, die einfache HTTP-Abrufe blockieren.
Plugin installieren
Installieren Sie das offizielle Plugin und starten Sie anschließend den Gateway neu:
openclaw plugins install @openclaw/firecrawl-pluginopenclaw gateway restartSchlüsselloser Zugriff und API-Schlüssel
Firecrawl registriert zwei web_search-Provider:
- Firecrawl-Suche (
firecrawl) — verwendet die gehostete/v2/search-API mit Ihrem Schlüssel; wird automatisch erkannt, wenn ein Schlüssel vorhanden ist. - Firecrawl-Suche (kostenlos) (
firecrawl-free) — verwendet die gehostete schlüssellose Einstiegsstufe, kein API-Schlüssel erforderlich. Sie ist nur per Opt-in verfügbar und wird nie automatisch ausgewählt, da bei ihrer Auswahl Ihre Suchanfragen an die kostenlose Stufe von Firecrawl gesendet werden.
Der explizit ausgewählte Firecrawl-Fallback web_fetch funktioniert ebenfalls schlüssellos. Die
expliziten Tools firecrawl_search und firecrawl_scrape erfordern einen API-Schlüssel. Fügen Sie
FIRECRAWL_API_KEY zur Gateway-Umgebung hinzu oder konfigurieren Sie ihn für höhere Limits.
Firecrawl-Suche konfigurieren
{ tools: { web: { search: { provider: "firecrawl", }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webSearch: { apiKey: "FIRECRAWL_API_KEY_HERE", baseUrl: "https://api.firecrawl.dev", }, }, }, }, },}Hinweise:
- Die Auswahl von Firecrawl beim Onboarding oder in
openclaw configure --section webaktiviert das installierte Firecrawl-Plugin automatisch. - Wählen Sie beim Onboarding Firecrawl-Suche (kostenlos) aus (oder legen Sie
provider: "firecrawl-free"fest), um ohne API-Schlüssel schlüssellos zu arbeiten. Der schlüsselbasierte Provider Firecrawl-Suche sendetplugins.entries.firecrawl.config.webSearch.apiKeyoderFIRECRAWL_API_KEY. web_searchmit Firecrawl unterstütztqueryundcount.- Verwenden Sie für Firecrawl-spezifische Steuerelemente wie
sources,categoriesoder das Scraping von Ergebnissenfirecrawl_search. baseUrlverwendet standardmäßig das gehostete Firecrawl unterhttps://api.firecrawl.dev. Selbst gehostete Überschreibungen sind nur für private/interne Endpunkte zulässig; HTTP wird ausschließlich für solche privaten Ziele akzeptiert.FIRECRAWL_BASE_URList der gemeinsame Umgebungs-Fallback für die Basis-URLs der Firecrawl-Suche und des Scrapings.- Firecrawl-Suchanfragen haben standardmäßig ein Zeitlimit von 30 Sekunden; der Parameter
timeoutSecondsvonfirecrawl_searchüberschreibt es pro Aufruf.
Firecrawl-Fallback für web_fetch konfigurieren
{ tools: { web: { fetch: { provider: "firecrawl", // Explizite Auswahl aktiviert den schlüssellosen Fallback }, }, }, plugins: { entries: { firecrawl: { enabled: true, config: { webFetch: { baseUrl: "https://api.firecrawl.dev", onlyMainContent: true, maxAgeMs: 172800000, timeoutSeconds: 60, }, }, }, }, },}Hinweise:
- Der explizit ausgewählte Firecrawl-Fallback
web_fetchfunktioniert ohne API-Schlüssel. Wenn konfiguriert, sendet OpenClaw für höhere Limitsplugins.entries.firecrawl.config.webFetch.apiKeyoderFIRECRAWL_API_KEY. - Die Auswahl von Firecrawl beim Onboarding oder in
openclaw configure --section webaktiviert das Plugin und wählt Firecrawl fürweb_fetchaus, sofern nicht bereits ein anderer Abruf-Provider konfiguriert ist. firecrawl_scrapeerfordert einen API-Schlüssel.maxAgeMssteuert, wie alt zwischengespeicherte Ergebnisse sein dürfen (ms). Der Standardwert beträgt 172.800.000 ms (2 Tage).onlyMainContentverwendet standardmäßigtrue;timeoutSecondsverwendet standardmäßig 60.- Die veraltete Konfiguration
tools.web.fetch.firecrawl.*undtools.web.search.firecrawl.*wird vonopenclaw doctor --fixautomatisch migriert. - Überschreibungen der Firecrawl-Scraping-/Basis-URL unterliegen derselben Regel für gehostete/private Ziele wie die Suche: Öffentlicher gehosteter Datenverkehr verwendet
https://api.firecrawl.dev; selbst gehostete Überschreibungen müssen in private/interne Endpunkte aufgelöst werden. firecrawl_scrapelehnt offensichtliche private, Loopback-, Metadaten- und Nicht-HTTP(S)-Ziel-URLs ab, bevor sie an Firecrawl weitergeleitet werden. Dies entspricht dem Zielsicherheitsvertrag vonweb_fetchfür explizite Firecrawl-Scraping-Aufrufe.
firecrawl_scrape verwendet dieselben plugins.entries.firecrawl.config.webFetch.*-Einstellungen und Umgebungsvariablen einschließlich des erforderlichen API-Schlüssels.
Selbst gehostetes Firecrawl
Legen Sie plugins.entries.firecrawl.config.webSearch.baseUrl, plugins.entries.firecrawl.config.webFetch.baseUrl oder FIRECRAWL_BASE_URL fest, wenn Sie Firecrawl selbst betreiben. OpenClaw akzeptiert http:// nur für Loopback-, private Netzwerk-, .local-, .internal- oder .localhost-Ziele. Öffentliche benutzerdefinierte Hosts werden abgelehnt, damit Firecrawl-API-Schlüssel nicht versehentlich an beliebige Endpunkte gesendet werden.
Firecrawl-Plugin-Tools
firecrawl_search
Verwenden Sie dieses Tool, wenn Sie statt des generischen web_search Firecrawl-spezifische Suchsteuerungen benötigen. Erfordert einen API-Schlüssel.
Parameter:
querycount(1–100)sourcescategoriesincludeDomains/excludeDomains(nur Hostnamen; schließen sich gegenseitig aus)tbs(Zeitfilter, zum Beispielqdr:d,qdr:w,sbd:1)locationundcountry(Geo-Targeting)scrapeResultstimeoutSeconds
firecrawl_scrape
Verwenden Sie dieses Tool für stark JavaScript-basierte oder Bot-geschützte Seiten, bei denen ein einfacher web_fetch unzureichend ist.
Parameter:
urlextractModemaxCharsonlyMainContentmaxAgeMsproxystoreInCachetimeoutSeconds
Tarnmodus/Bot-Umgehung
firecrawl_scrape und der Firecrawl-Fallback web_fetch verwenden standardmäßig proxy: "auto" zusammen mit storeInCache: true, sofern der Aufrufer diese Parameter nicht überschreibt. firecrawl_search und der Firecrawl-Provider web_search verfügen über keine Steuerelemente für proxy/storeInCache; der Tarnproxy-Modus gilt nur für Scraping-/Abrufanfragen.
Der Modus proxy von Firecrawl steuert die Bot-Umgehung (basic, stealth oder auto). auto versucht es mit Tarnproxies erneut, wenn ein einfacher Versuch fehlschlägt. Dies kann mehr Guthaben verbrauchen als ausschließlich einfaches Scraping.
Wie web_fetch Firecrawl verwendet
Extraktionsreihenfolge von web_fetch:
- Readability (lokal)
- Konfigurierter Abruf-Provider wie Firecrawl (wenn ausgewählt oder automatisch anhand konfigurierter Anmeldedaten erkannt)
- Grundlegende HTML-Bereinigung (letzter Fallback)
Die Auswahloption ist tools.web.fetch.provider. Wenn Sie sie weglassen, erkennt OpenClaw anhand der verfügbaren Anmeldedaten automatisch den ersten einsatzbereiten Web-Abruf-Provider. Das offizielle Firecrawl-Plugin stellt diesen Fallback bereit.
Verwandte Themen
- Übersicht über die Websuche -- alle Provider und automatische Erkennung
- Webabruf -- web_fetch-Tool mit Firecrawl-Fallback
- Tavily -- Such- und Extraktionstools