Providers

xAI

OpenClaw enthält ein gebündeltes xai-Provider-Plugin für Grok-Modelle. Der empfohlene Weg ist Grok OAuth mit einem berechtigten SuperGrok- oder X-Premium- Abonnement. Gateway, Konfiguration, Routing und Tools bleiben lokal; nur Grok- Anfragen werden an die API von xAI gesendet.

OAuth erfordert weder einen xAI-API-Schlüssel noch die Grok-Build-App. xAI zeigt möglicherweise dennoch Grok Build auf dem Zustimmungsbildschirm an, da OpenClaw den gemeinsam genutzten OAuth-Client von xAI verwendet.

Einrichtung

  • Neuinstallation

    Führen Sie das Onboarding mit Daemon-Installation aus und wählen Sie dann im Schritt für Modell/Authentifizierung xAI/Grok OAuth aus:

    bash
    openclaw onboard --install-daemon

    Wählen Sie auf einem VPS oder über SSH direkt xAI OAuth aus; dabei wird eine Gerätecode-Verifizierung verwendet und kein localhost-Callback benötigt:

    bash
    openclaw onboard --install-daemon --auth-choice xai-oauth
  • Vorhandene Installation

    Melden Sie sich nur bei xAI an; führen Sie nicht das vollständige Onboarding erneut aus, nur um Grok zu verbinden:

    bash
    openclaw models auth login --provider xai --method oauth

    Legen Sie Grok separat als Standardmodell fest:

    bash
    openclaw models set xai/grok-4.3

    Führen Sie das vollständige Onboarding nur erneut aus, wenn Sie bewusst Gateway, Daemon, Kanal, Arbeitsbereich oder andere Einrichtungsoptionen ändern möchten.

  • API-Schlüssel-Pfad

    Die Einrichtung per API-Schlüssel funktioniert weiterhin für Schlüssel aus der xAI Console und für Medienoberflächen, die eine schlüsselgestützte Provider-Konfiguration benötigen:

    bash
    openclaw models auth login --provider xai --method api-keyexport XAI_API_KEY=xai-...
  • Modell auswählen

    json5
    {  agents: { defaults: { model: { primary: "xai/grok-4.3" } } },}
  • OAuth-Fehlerbehebung

    • Verwenden Sie für SSH, Docker, VPS oder andere Remote-Einrichtungen openclaw models auth login --provider xai --method oauth; dabei wird eine Gerätecode-Verifizierung und kein localhost-Callback verwendet.

    • Wenn die Anmeldung erfolgreich ist, Grok aber nicht das Standardmodell ist, führen Sie openclaw models set xai/grok-4.3 aus.

    • Prüfen Sie die gespeicherten xAI-Authentifizierungsprofile:

      bash
      openclaw models auth list --provider xaiopenclaw models status
    • xAI entscheidet, welche Konten OAuth-API-Token erhalten können. Wenn ein Konto nicht berechtigt ist, verwenden Sie den API-Schlüssel-Pfad oder prüfen Sie das Abonnement bei xAI.

    Integrierter Katalog

    Auswählbare IDs in der Modellauswahl. Das Plugin löst für vorhandene Konfigurationen weiterhin ältere IDs für Grok 3, Grok 4, Grok 4 Fast, Grok 4.1 Fast und Grok Code auf; siehe Legacy-Kompatibilität und veränderliche Aliasse.

    Familie Modell-IDs
    Grok 4.5 grok-4.5 (Aliasse: grok-4.5-latest, grok-build-latest)
    Grok Build 0.1 grok-build-0.1
    Grok 4.3 grok-4.3 (Aliasse: grok-4.3-latest, grok-latest)
    Grok 4.20 grok-4.20-0309-reasoning, grok-4.20-0309-non-reasoning

    Die Kontext- und Tokenkosten-Metadaten des Katalogs orientieren sich an den aktuellen Modellseiten und der Preisseite von xAI. xAI berechnet höhere Tarife, wenn eine Anfrage den dokumentierten Schwellenwert für lange Kontexte überschreitet; die pauschalen Kostenfelder im OpenClaw-Katalog erfassen die Tarife für kurze Kontexte. Grok Build, die separate CLI für Programmieragenten von xAI, ist unter x.ai/cli verfügbar und verwendet derzeit Grok 4.5.

    Funktionsumfang

    Das gebündelte Plugin bildet unterstützte xAI-APIs auf die gemeinsamen Provider- und Tool-Verträge von OpenClaw ab. Funktionen, die nicht in den gemeinsamen Vertrag passen, sind nachfolgend oder unter den bekannten Einschränkungen aufgeführt.

    xAI-Funktion OpenClaw-Oberfläche Status
    Chat / Responses xai/<model>-Modell-Provider Ja
    Serverseitige Websuche web_search-Provider grok Ja
    Serverseitige X-Suche x_search-Tool Ja
    Serverseitige Codeausführung code_execution-Tool Ja
    Bilder image_generate Ja
    Videos video_generate Ja
    Batch-Text-to-Speech tts.provider: "xai" / tts Ja
    Streaming-TTS textToSpeechStream Ja, über wss://api.x.ai/v1/tts (keine Echtzeitsprachübertragung)
    Batch-Speech-to-Text tools.media.audio-Medienverständnis Ja
    Streaming-Speech-to-Text Voice Call streaming.provider: "xai" Ja
    Echtzeitsprache Talk talk.realtime.provider: "xai" Ja; Gateway-Relay für native Talk-Nodes
    Dateien / Batches Nur generische Modell-API-Kompatibilität Kein erstklassiges OpenClaw-Tool

    Legacy-Kompatibilität des Schnellmodus

    /fast on oder agents.defaults.models["xai/<model>"].params.fastMode: true schreibt ältere xAI-Konfigurationen weiterhin wie folgt um. Diese Ziel-IDs werden nur aus Kompatibilitätsgründen beibehalten; verwenden Sie für neue Konfigurationen aktuelle auswählbare Modelle.

    Quellmodell Ziel im Schnellmodus
    grok-3 grok-3-fast
    grok-3-mini grok-3-mini-fast
    grok-4 grok-4-fast
    grok-4-0709 grok-4-fast

    Legacy-Kompatibilität und veränderliche Aliasse

    Ältere Aliasse werden wie folgt normalisiert:

    Legacy-Alias Normalisierte ID
    grok-code-fast-1, grok-code-fast, grok-code-fast-1-0825 grok-build-0.1

    Die datierten 0309-IDs sind die auswählbaren Katalogeinträge. OpenClaw sendet alle anderen aktuellen Grok-4.20-Aliasse unverändert, sodass xAI die Kontrolle über die Semantik stabiler, neuester, Beta-, experimenteller und datierter Aliasse behält. Der globale Alias grok-latest bleibt ebenfalls unverändert erhalten.

    xAI hat die folgenden exakten IDs eingestellt. OpenClaw behält sie als ausgeblendete Kompatibilitätszeilen für ausgelieferte Konfigurationen bei, mit den Einschränkungen und Preisen ihrer aktuellen Weiterleitungsziele:

    Eingestellte IDs Aktuelles Verhalten
    grok-4-1-fast-reasoning, grok-4-fast-reasoning, grok-4-0709 Grok 4.3 mit low-Reasoning
    grok-4-1-fast-non-reasoning, grok-4-fast-non-reasoning, grok-3 Grok 4.3 mit deaktiviertem Reasoning
    grok-code-fast-1 Grok Build 0.1
    grok-imagine-image-pro Grok Imagine Image Quality

    openclaw doctor --fix aktualisiert persistierte xAI-Standardwerte für Server-Tools und den eingestellten Quality-Bild-Slug, entfernt veraltete generierte Katalogzeilen und repariert veraltete Kontextmetadaten aktiver 4.20-Zeilen. Aktive 4.20- Aliasse vom Typ beta-latest werden dabei nicht auf einen datierten Snapshot festgelegt.

    Funktionen

    Websuche

    Der gebündelte grok-Provider für die Websuche bevorzugt xAI OAuth und greift anschließend auf XAI_API_KEY oder einen Websuchschlüssel eines Plugins zurück:

    bash
    openclaw models auth login --provider xai --method oauthopenclaw config set tools.web.search.provider grok
    Videogenerierung

    Das gebündelte xai-Plugin registriert die Videogenerierung über das gemeinsame video_generate-Tool.

    • Standardmodell: xai/grok-imagine-video
    • Zusätzliches Modell: xai/grok-imagine-video-1.5
    • Klassische Modi: Text-zu-Video, Bild-zu-Video, Generierung anhand von Referenzbildern, Remote-Videobearbeitung und Remote-Videoverlängerung
    • Video-1.5-Modus: nur Bild-zu-Video, mit genau einem Bild für den ersten Frame
    • Seitenverhältnisse: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3; bei Auslassung übernehmen klassische Bild-zu-Video-Modi und Video 1.5 das Seitenverhältnis des Quellbilds
    • Auflösungen: klassisch 480P/720P; Video 1.5 unterstützt außerdem 1080P; alle Generierungsmodi verwenden standardmäßig 480P
    • Dauer: 1–15 Sekunden für Generierung/Bild-zu-Video, 1–10 Sekunden bei Verwendung klassischer reference_image-Rollen, 2–10 Sekunden für die klassische Verlängerung
    • Generierung anhand von Referenzbildern: Setzen Sie imageRoles für jedes bereitgestellte Bild auf reference_image; xAI akzeptiert bis zu 7 solcher Bilder
    • Videobearbeitung/-verlängerung übernimmt Seitenverhältnis und Auflösung des Eingabevideos; diese Vorgänge akzeptieren keine Geometrieüberschreibungen
    • Standardzeitüberschreitung für Vorgänge: 600 Sekunden, sofern nicht video_generate.timeoutMs oder agents.defaults.mediaModels.video.timeoutMs festgelegt ist

    Video 1.5 erkennt außerdem die xAI-Bezeichner grok-imagine-video-1.5-preview und grok-imagine-video-1.5-2026-05-30. OpenClaw leitet den ausgewählten Bezeichner unverändert weiter, wendet jedoch dieselbe Nur-Bild-Validierung an.

    So verwenden Sie xAI als Standard-Video-Provider:

    json5
    {  agents: {    defaults: {      videoGenerationModel: {        primary: "xai/grok-imagine-video",      },    },  },}
    Bildgenerierung

    Das gebündelte Plugin xai registriert die Bildgenerierung über das gemeinsame Tool image_generate.

    • Standardbildmodell: xai/grok-imagine-image
    • Zusätzliches Modell: xai/grok-imagine-image-quality
    • Modi: Text-zu-Bild und Bearbeitung eines Referenzbilds
    • Referenzeingaben: ein image oder bis zu drei images
    • Seitenverhältnisse: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, 19.5:9, 9:19.5, 20:9, 9:20
    • Auflösungen: 1K, 2K
    • Anzahl: bis zu 4 Bilder
    • Standardmäßiges Zeitlimit für Vorgänge: 600 Sekunden, sofern weder image_generate.timeoutMs noch agents.defaults.mediaModels.image.timeoutMs festgelegt ist

    OpenClaw fordert von xAI Bildantworten im Format b64_json an, damit generierte Medien gespeichert und über den normalen Pfad für Kanalanhänge zugestellt werden können. Lokale Referenzbilder werden in Daten-URLs umgewandelt; entfernte http(s)-Referenzen werden unverändert weitergeleitet.

    So verwenden Sie xAI als standardmäßigen Bild-Provider:

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "xai/grok-imagine-image",      },    },  },}
    Text-zu-Sprache

    Das gebündelte Plugin xai registriert Text-zu-Sprache über die gemeinsame Provider-Oberfläche tts.

    • Stimmen: authentifizierter Live-Katalog von xAI; Auflistung mit openclaw infer tts voices --provider xai
    • Offline-Fallback-Stimmen: ara, eve, leo, rex, sal
    • Standardstimme: eve
    • Benutzerdefinierte Stimmen-IDs des Kontos werden auch dann weitergeleitet, wenn sie in der Antwort des integrierten Katalogs fehlen
    • Formate: mp3, wav, pcm, mulaw, alaw
    • Sprache: BCP-47-Code oder auto
    • Geschwindigkeit: Provider-native Geschwindigkeitsüberschreibung
    • Das native Opus-Sprachnachrichtenformat wird nicht unterstützt

    So verwenden Sie xAI als standardmäßigen TTS-Provider:

    json5
    {  tts: {    provider: "xai",    providers: {      xai: {        voiceId: "eve",      },    },  },}
    Sprache-zu-Text

    Das gebündelte Plugin xai registriert Batch-Sprache-zu-Text über die Transkriptionsoberfläche der Medienanalyse von OpenClaw.

    • Endpunkt: xAI REST /v1/stt
    • Eingabepfad: Multipart-Upload einer Audiodatei
    • Modellauswahl: xAI wählt das Transkriptionsmodell intern aus; der Endpunkt verfügt über keine Modellauswahl
    • Wird überall dort verwendet, wo die Transkription eingehender Audiodaten tools.media.audio liest, einschließlich Segmenten aus Discord-Sprachkanälen und Kanal-Audioanhängen

    So erzwingen Sie xAI für die Transkription eingehender Audiodaten:

    json5
    {  tools: {    media: {      audio: {        models: [          {            type: "provider",            provider: "xai",          },        ],      },    },  },}

    Die Sprache kann über die gemeinsame Audiomedienkonfiguration oder je Transkriptionsanfrage angegeben werden. Prompt-Hinweise werden von der gemeinsamen OpenClaw- Oberfläche akzeptiert, die xAI-REST-STT-Integration leitet jedoch nur Datei und Sprache weiter, da nur diese dem aktuellen öffentlichen xAI-Endpunkt entsprechen.

    Streaming-Sprache-zu-Text

    Das gebündelte Plugin xai registriert außerdem einen Echtzeit-Transkriptions-Provider für Audiodaten aus Live-Sprachanrufen.

    • Endpunkt: xAI WebSocket wss://api.x.ai/v1/stt
    • Standardkodierung: mulaw
    • Standard-Abtastrate: 8000
    • Standard-Endpunkterkennung: 800ms
    • Zwischentranskripte: standardmäßig aktiviert

    Der Twilio-Medienstream von Voice Call sendet G.711-mu-law-Audioframes, daher leitet der xAI-Provider diese Frames ohne Transcodierung direkt weiter:

    json5
    {  plugins: {    entries: {      "voice-call": {        config: {          streaming: {            enabled: true,            provider: "xai",            providers: {              xai: {                apiKey: "${XAI_API_KEY}",                endpointingMs: 800,                language: "en",              },            },          },        },      },    },  },}

    Die Provider-eigene Konfiguration befindet sich unter plugins.entries.voice-call.config.streaming.providers.xai. Unterstützte Schlüssel sind apiKey, baseUrl, sampleRate, encoding (pcm, mulaw oder alaw), interimResults, endpointingMs und language.

    Echtzeit-Sprache (Talk)

    Das gebündelte Plugin xai registriert Echtzeitsitzungen des Grok Voice Agent für den Talk-Modus über den gemeinsamen Vertrag registerRealtimeVoiceProvider.

    • Endpunkt: wss://api.x.ai/v1/realtime?model=<voice-model>
    • Standardmodell: grok-voice-latest
    • Standardstimme: eve
    • Transport: gateway-relay (Relay-Pfade für iOS, Android und Control UI)
    • Audio: PCM16 24 kHz oder G.711 µ-law 8 kHz
    • Unterbrechung: Die xAI-Server-VAD unterbricht die Antwort; OpenClaw leert die Wiedergabewarteschlange und kürzt den nicht wiedergegebenen Provider-Verlauf

    Konfigurieren Sie Talk auf dem Gateway:

    json5
    {  talk: {    realtime: {      provider: "xai",      mode: "realtime",      transport: "gateway-relay",      brain: "agent-consult",      providers: {        xai: {          model: "grok-voice-latest",          voice: "eve",          // Nur aktivieren, wenn die sitzungsseitige Wiedergabe durch den Provider akzeptabel ist.          sessionResumption: false,        },      },    },  },  env: { XAI_API_KEY: "xai-..." },}

    Die Provider-eigene Konfiguration wird außerdem aus plugins.entries.voice-call.config.realtime.providers.xai aufgelöst, wenn Voice Call oder gemeinsame Echtzeitauswahlen dieselbe Provider-Zuordnung wiederverwenden. Unterstützte Schlüssel sind apiKey, baseUrl, model, voice, vadThreshold, silenceDurationMs, prefixPaddingMs, reasoningEffort und sessionResumption. reasoningEffort akzeptiert entsprechend der xAI Voice Agent API nur high oder none.

    Die Server-VAD von xAI erstellt immer Antworten und verarbeitet Audiounterbrechungen. Verwenden Sie consultRouting: "provider-direct"; erzwungenes Transkript-Routing und die Deaktivierung der Eingabe-Audiounterbrechung werden vom xAI-Voice-Agent-Protokoll nicht unterstützt.

    x_search-Konfiguration

    Das gebündelte xAI-Plugin stellt x_search als OpenClaw-Tool zum Durchsuchen von Inhalten auf X (ehemals Twitter) über Grok bereit.

    Konfigurationspfad: plugins.entries.xai.config.xSearch

    Schlüssel Typ Standard Beschreibung
    enabled boolean Automatisch für xAI-Modelle Deaktivieren oder für einen bekannten Nicht-xAI-Provider aktivieren
    model string grok-4.3 Für x_search-Anfragen verwendetes Modell
    baseUrl string - Überschreibung der Basis-URL für xAI Responses
    inlineCitations boolean - Inline-Zitate in Ergebnisse aufnehmen
    maxTurns number - Maximale Anzahl an Unterhaltungsschritten
    timeoutSeconds number 30 Anfragezeitlimit in Sekunden
    cacheTtlMinutes number 15 Cache-Gültigkeitsdauer in Minuten
    json5
    {  plugins: {    entries: {      xai: {        config: {          xSearch: {            enabled: true,            model: "grok-4.3",            baseUrl: "https://api.x.ai/v1",            inlineCitations: true,          },        },      },    },  },}
    Konfiguration der Codeausführung

    Das gebündelte xAI-Plugin stellt code_execution als OpenClaw-Tool für die entfernte Codeausführung in der Sandbox-Umgebung von xAI bereit.

    Konfigurationspfad: plugins.entries.xai.config.codeExecution

    Schlüssel Typ Standard Beschreibung
    enabled boolean Automatisch für xAI-Modelle Deaktivieren oder für einen bekannten Nicht-xAI-Provider aktivieren
    model string grok-4.3 Für Codeausführungsanfragen verwendetes Modell
    maxTurns number - Maximale Anzahl an Konversationsrunden
    timeoutSeconds number 30 Anfrage-Timeout in Sekunden
    json5
    {  plugins: {    entries: {      xai: {        config: {          codeExecution: {            enabled: true,            model: "grok-4.3",          },        },      },    },  },}
    Bekannte Einschränkungen
    • Für die xAI-Authentifizierung können ein API-Schlüssel, eine Umgebungsvariable, ein Fallback auf die Plugin-Konfiguration oder OAuth mit einem berechtigten xAI-Konto verwendet werden. OAuth verwendet eine Gerätecode-Verifizierung ohne localhost-Callback. xAI entscheidet, welche Konten OAuth-API-Token erhalten können, und auf der Einwilligungsseite kann Grok Build angezeigt werden, obwohl OpenClaw die Grok-Build-App nicht benötigt.
    • OpenClaw stellt die Multi-Agent-Modellfamilie von xAI derzeit nicht bereit. xAI stellt diese Modelle über die Responses API bereit, sie akzeptieren jedoch weder die clientseitigen noch die benutzerdefinierten Tools, die von der gemeinsamen Agent-Schleife von OpenClaw verwendet werden. Siehe die Einschränkungen für Multi-Agent-Systeme von xAI.
    • xAI Realtime Voice stellt derzeit nur den Gateway-Relay-Transport für Talk bereit. Vom Browser verwaltete Provider-WebSocket-Sitzungen sind noch nicht in die Control UI integriert.
    • xAI-Bild-quality, Bild-mask und zusätzliche ausschließlich native Seitenverhältnisse werden erst bereitgestellt, wenn das gemeinsame Tool image_generate über entsprechende Provider-übergreifende Steuerelemente verfügt.
    Erweiterte Hinweise
    • OpenClaw wendet xAI-spezifische Kompatibilitätskorrekturen für Tool-Schemas und Tool-Aufrufe automatisch im gemeinsamen Runner-Pfad an.
    • Native xAI-Anfragen verwenden standardmäßig tool_stream: true. Setzen Sie agents.defaults.models["xai/<model>"].params.tool_stream auf false, um dies zu deaktivieren.
    • Der mitgelieferte xAI-Wrapper entfernt nicht unterstützte Schema-Grenzen für die Anzahl enthaltener Elemente und nicht unterstützte effort-Payload-Schlüssel für Reasoning, bevor native xAI-Anfragen gesendet werden. Grok 4.5 unterstützt einen niedrigen, mittleren und hohen Aufwand (Standard: hoch). Grok 4.3 unterstützt keinen, niedrigen, mittleren und hohen Aufwand (Standard: niedrig). Andere Reasoning-fähige xAI-Modelle stellen keine konfigurierbare Aufwandssteuerung bereit, fordern jedoch weiterhin include: ["reasoning.encrypted_content"] an, damit vorheriges verschlüsseltes Reasoning in nachfolgenden Runden erneut verwendet werden kann.
    • web_search, x_search und code_execution werden als OpenClaw-Tools bereitgestellt. OpenClaw hängt nur die spezifische integrierte xAI-Funktion, die jedes Tool benötigt, an die Anfrage dieses Tools an, anstatt jedes native Tool an jede Chat-Runde anzuhängen.
    • Grok web_search liest plugins.entries.xai.config.webSearch.baseUrl. x_search liest plugins.entries.xai.config.xSearch.baseUrl und greift anschließend auf die Basis-URL der Grok-Websuche zurück.
    • x_search und code_execution gehören zum mitgelieferten xAI-Plugin, anstatt fest in der zentralen Modelllaufzeit codiert zu sein.
    • code_execution ist eine entfernte Ausführung in der xAI-Sandbox, keine lokale exec.

    Live-Tests

    Die xAI-Medienpfade werden durch Unit-Tests und optional aktivierbare Live-Testreihen abgedeckt. Exportieren Sie XAI_API_KEY in die Prozessumgebung, bevor Sie Live-Prüfungen ausführen.

    bash
    pnpm test extensions/xaiOPENCLAW_LIVE_TEST=1 OPENCLAW_LIVE_TEST_QUIET=1 pnpm test:live -- extensions/xai/xai.live.test.tsOPENCLAW_LIVE_TEST=1 OPENCLAW_LIVE_XAI_VIDEO=1 pnpm test:live -- extensions/xai/xai.live.test.ts -t "classic Grok Imagine"OPENCLAW_LIVE_TEST=1 OPENCLAW_LIVE_XAI_VIDEO=1 pnpm test:live -- extensions/xai/xai.live.test.ts -t "Grok Imagine Video 1.5"OPENCLAW_LIVE_TEST=1 OPENCLAW_LIVE_TEST_QUIET=1 pnpm test:live -- extensions/xai/x-search.live.test.tsOPENCLAW_LIVE_GATEWAY_MODELS="xai/grok-4.5,xai/grok-build-0.1,xai/grok-4.3,xai/grok-4.20-0309-reasoning,xai/grok-4.20-0309-non-reasoning" OPENCLAW_LIVE_GATEWAY_MAX_MODELS=0 OPENCLAW_LIVE_GATEWAY_SMOKE=0 pnpm test:live -- src/gateway/gateway-models.profiles.live.test.tsOPENCLAW_LIVE_TEST=1 OPENCLAW_LIVE_TEST_QUIET=1 OPENCLAW_LIVE_IMAGE_GENERATION_PROVIDERS=xai pnpm test:live -- test/image-generation.runtime.live.test.ts

    Die Provider-spezifische Live-Datei synthetisiert normales TTS und telefoniefreundliches PCM-TTS, transkribiert Audio über die xAI-Batch-STT, streamt dasselbe PCM über die xAI-Echtzeit-STT, erzeugt eine Text-zu-Bild-Ausgabe und bearbeitet ein Referenzbild. Die gemeinsame Bild-Live-Datei überprüft denselben xAI-Provider über die Laufzeitauswahl, das Fallback, die Normalisierung und den Medienanhangspfad von OpenClaw. Der optional aktivierbare Fall für Video 1.5 übermittelt ein generiertes Bild des ersten Frames in 1080P und überprüft den Download des fertiggestellten Videos.

    Verwandte Themen

    Was this useful?
    On this page

    On this page