Providers

NVIDIA

NVIDIA stellt offene Modelle kostenlos über eine OpenAI-kompatible API unter https://integrate.api.nvidia.com/v1 bereit. Die Authentifizierung erfolgt mit einem API-Schlüssel von build.nvidia.com. OpenClaw verwendet für den NVIDIA-Provider standardmäßig Nemotron 3 Ultra, NVIDIAs Reasoning-Modell mit insgesamt 550B / 55B aktiven Parametern für agentische Aufgaben mit langem Kontext.

Erste Schritte

  • API-Schlüssel abrufen

    Erstellen Sie einen API-Schlüssel unter build.nvidia.com.

  • Schlüssel exportieren und Onboarding ausführen

    bash
    export NVIDIA_API_KEY="nvapi-..."openclaw onboard --auth-choice nvidia-api-key
  • Ein NVIDIA-Modell festlegen

    bash
    openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55b
  • Übergeben Sie den Schlüssel für eine nicht interaktive Einrichtung direkt:

    bash
    openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."

    Konfigurationsbeispiel

    json5
    {  env: { NVIDIA_API_KEY: "nvapi-..." },  models: {    providers: {      nvidia: {        baseUrl: "https://integrate.api.nvidia.com/v1",        api: "openai-completions",      },    },  },  agents: {    defaults: {      model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" },    },  },}

    Empfohlener Katalog

    Wenn ein NVIDIA-API-Schlüssel konfiguriert ist, rufen die Einrichtungs- und Modellauswahlpfade NVIDIAs öffentlichen Katalog empfohlener Modelle von https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json ab und speichern das Ergebnis 24 Stunden lang im Cache (die ersten 32 Einträge werden als Zeilen für Freitexteingaben importiert). Neue empfohlene Modelle von build.nvidia.com erscheinen daher in den Einrichtungs- und Modellauswahloberflächen, ohne dass auf eine OpenClaw-Veröffentlichung gewartet werden muss. Wenn der Live-Feed verfügbar ist, ist das erste zurückgegebene Modell während der NVIDIA-Einrichtung vorausgewählt.

    Der Abruf verwendet eine feste HTTPS-Hostrichtlinie für assets.ngc.nvidia.com. Wenn kein NVIDIA-API-Schlüssel konfiguriert oder der Feed nicht verfügbar beziehungsweise fehlerhaft ist, greift OpenClaw auf den unten aufgeführten mitgelieferten Katalog und den mitgelieferten Standardwert zurück.

    Nemotron 3 Ultra

    Nemotron 3 Ultra ist das standardmäßige NVIDIA-Modell in OpenClaw. NVIDIAs Build-Seite für nvidia/nemotron-3-ultra-550b-a55b führt es als verfügbaren kostenlosen Endpunkt mit einer Kontextangabe von 1M Token auf.

    Die mitgelieferte Ultra-Zeile sendet standardmäßig chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, damit normale Chat-Ausgaben in der sichtbaren Antwort verbleiben, statt Reasoning-Text offenzulegen.

    Verwenden Sie Ultra als leistungsfähigste NVIDIA-Standardeinstellung. Lassen Sie Super ausgewählt, wenn Sie die kleinere Nemotron-3-Option verwenden möchten, oder wählen Sie eines der in NVIDIAs Katalog gehosteten Drittanbietermodelle, wenn dessen Kontext, Latenz oder Verhalten besser geeignet ist.

    Mitgelieferter Fallback-Katalog

    Die auswählbaren mitgelieferten Zeilen bilden eine Momentaufnahme von NVIDIAs Katalog empfohlener Modelle. Veraltete Kompatibilitätszeilen bleiben über ihre exakte Referenz auflösbar, werden jedoch nicht in Modellauswahlfeldern angezeigt.

    Modellreferenz Name Kontext Maximale Ausgabe
    nvidia/nvidia/nemotron-3-ultra-550b-a55b Nemotron 3 Ultra 550B 1,048,576 8,192
    nvidia/nvidia/nemotron-3-super-120b-a12b Nemotron 3 Super 120B 1,000,000 8,192
    nvidia/z-ai/glm-5.2 GLM 5.2 202,752 8,192
    nvidia/moonshotai/kimi-k2.6 Kimi K2.6 262,144 8,192
    nvidia/minimaxai/minimax-m3 Minimax M3 196,608 8,192
    nvidia/deepseek-ai/deepseek-v4-pro DeepSeek V4 Pro 262,144 16,384
    nvidia/qwen/qwen3.5-397b-a17b Qwen3.5 397B A17B 262,144 16,384

    Der vollständige Kompatibilitätskatalog enthält außerdem diese veröffentlichten Referenzen für bestehende Konfigurationen: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 und nvidia/minimaxai/minimax-m2.7. Sie bleiben über ihre exakte Referenz verfügbar, erscheinen jedoch nie im Onboarding oder in Modellauswahlfeldern.

    Erweiterte Konfiguration

    Automatisches Aktivierungsverhalten

    Der Provider wird automatisch aktiviert, wenn die Umgebungsvariable NVIDIA_API_KEY gesetzt ist oder während des Onboardings ein Schlüssel gespeichert wurde. Über den Schlüssel hinaus ist keine explizite Provider-Konfiguration erforderlich.

    Katalog und Preisgestaltung

    OpenClaw bevorzugt NVIDIAs öffentlichen Katalog empfohlener Modelle, wenn die NVIDIA-Authentifizierung konfiguriert ist, und speichert ihn 24 Stunden lang im Cache. Der mitgelieferte auswählbare Fallback ist eine statische Momentaufnahme von NVIDIAs Katalog empfohlener Modelle; veraltete Kompatibilitätszeilen mit exakten Referenzen werden in Modellauswahlfeldern ausgeblendet. Die Kosten sind im Quellcode standardmäßig auf 0 gesetzt, da NVIDIA derzeit für die aufgeführten Modelle kostenlosen API-Zugriff anbietet.

    OpenAI-kompatibler Endpunkt

    OpenClaw kommuniziert mit NVIDIA über den Adapter openai-completions und verwendet dabei die standardmäßige Chat-Completions-Route /v1. Alle OpenAI-kompatiblen Werkzeuge sollten mit der NVIDIA-Basis-URL ohne weitere Konfiguration funktionieren.

    Reasoning-Parameter für Nemotron 3 Ultra

    NVIDIAs Ultra-Beispielanfrage verwendet chat_template_kwargs.enable_thinking und reasoning_budget für die Reasoning-Ausgabe. Die mitgelieferte Ultra-Zeile von OpenClaw deaktiviert Template-Reasoning standardmäßig für die normale Chat-Nutzung. Wenn Sie die NVIDIA-Reasoning-Ausgabe aktivieren oder andere NVIDIA-spezifische Anfragefelder erzwingen müssen, legen Sie Parameter pro Modell fest und beschränken Sie Provider-spezifische Überschreibungen auf das NVIDIA-Modell:

    json5
    {  agents: {    defaults: {      models: {        "nvidia/nvidia/nemotron-3-ultra-550b-a55b": {          params: {            chat_template_kwargs: { enable_thinking: true },            extra_body: { reasoning_budget: 16384 },          },        },      },    },  },}

    params.chat_template_kwargs wird mit einem bereits in der Anfrage vorhandenen chat_template_kwargs zusammengeführt, statt das gesamte Objekt zu ersetzen. params.extra_body ist die abschließende OpenAI-kompatible Überschreibung des Anfragekörpers und überschreibt kollidierende Nutzlastschlüssel. Verwenden Sie sie daher nur für Felder, die NVIDIA für den ausgewählten Endpunkt dokumentiert.

    Langsame Antworten benutzerdefinierter Provider

    Einige von NVIDIA gehostete benutzerdefinierte Modelle können länger als der standardmäßige Modellinaktivitäts-Watchdog von ~120s benötigen, bevor sie das erste Antwortfragment ausgeben. Erhöhen Sie für benutzerdefinierte NVIDIA-Provider-Einträge das Provider-Zeitlimit statt des Zeitlimits der gesamten Agent-Laufzeit; timeoutSeconds gilt für HTTP-Anfragen des Providers und erhöht die Obergrenze des Inaktivitäts-/Stream-Watchdogs für diesen Provider:

    json5
    {  models: {    providers: {      "custom-integrate-api-nvidia-com": {        baseUrl: "https://integrate.api.nvidia.com/v1",        api: "openai-completions",        apiKey: "NVIDIA_API_KEY",        timeoutSeconds: 300,      },    },  },  agents: {    defaults: {      models: {        "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": {          params: { thinking: "off" },        },      },    },  },}

    Verwandte Themen

    Was this useful?
    On this page

    On this page