Providers
NVIDIA
NVIDIA stellt offene Modelle kostenlos über eine OpenAI-kompatible API unter
https://integrate.api.nvidia.com/v1 bereit. Die Authentifizierung erfolgt mit einem API-Schlüssel von
build.nvidia.com. OpenClaw
verwendet für den NVIDIA-Provider standardmäßig Nemotron 3 Ultra, NVIDIAs
Reasoning-Modell mit insgesamt 550B / 55B aktiven Parametern für agentische
Aufgaben mit langem Kontext.
Erste Schritte
API-Schlüssel abrufen
Erstellen Sie einen API-Schlüssel unter build.nvidia.com.
Schlüssel exportieren und Onboarding ausführen
export NVIDIA_API_KEY="nvapi-..."openclaw onboard --auth-choice nvidia-api-keyEin NVIDIA-Modell festlegen
openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55bÜbergeben Sie den Schlüssel für eine nicht interaktive Einrichtung direkt:
openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."Konfigurationsbeispiel
{ env: { NVIDIA_API_KEY: "nvapi-..." }, models: { providers: { nvidia: { baseUrl: "https://integrate.api.nvidia.com/v1", api: "openai-completions", }, }, }, agents: { defaults: { model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" }, }, },}Empfohlener Katalog
Wenn ein NVIDIA-API-Schlüssel konfiguriert ist, rufen die Einrichtungs- und
Modellauswahlpfade NVIDIAs öffentlichen Katalog empfohlener Modelle von
https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json ab und
speichern das Ergebnis 24 Stunden lang im Cache (die ersten 32 Einträge werden
als Zeilen für Freitexteingaben importiert). Neue empfohlene Modelle von
build.nvidia.com erscheinen daher in den Einrichtungs- und Modellauswahloberflächen,
ohne dass auf eine OpenClaw-Veröffentlichung gewartet werden muss. Wenn der
Live-Feed verfügbar ist, ist das erste zurückgegebene Modell während der
NVIDIA-Einrichtung vorausgewählt.
Der Abruf verwendet eine feste HTTPS-Hostrichtlinie für assets.ngc.nvidia.com. Wenn
kein NVIDIA-API-Schlüssel konfiguriert oder der Feed nicht verfügbar beziehungsweise
fehlerhaft ist, greift OpenClaw auf den unten aufgeführten mitgelieferten Katalog
und den mitgelieferten Standardwert zurück.
Nemotron 3 Ultra
Nemotron 3 Ultra ist das standardmäßige NVIDIA-Modell in OpenClaw. NVIDIAs Build-Seite für
nvidia/nemotron-3-ultra-550b-a55b
führt es als verfügbaren kostenlosen Endpunkt mit einer Kontextangabe von 1M Token auf.
Die mitgelieferte Ultra-Zeile sendet standardmäßig
chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true },
damit normale Chat-Ausgaben in der sichtbaren Antwort verbleiben, statt
Reasoning-Text offenzulegen.
Verwenden Sie Ultra als leistungsfähigste NVIDIA-Standardeinstellung. Lassen Sie Super ausgewählt, wenn Sie die kleinere Nemotron-3-Option verwenden möchten, oder wählen Sie eines der in NVIDIAs Katalog gehosteten Drittanbietermodelle, wenn dessen Kontext, Latenz oder Verhalten besser geeignet ist.
Mitgelieferter Fallback-Katalog
Die auswählbaren mitgelieferten Zeilen bilden eine Momentaufnahme von NVIDIAs Katalog empfohlener Modelle. Veraltete Kompatibilitätszeilen bleiben über ihre exakte Referenz auflösbar, werden jedoch nicht in Modellauswahlfeldern angezeigt.
| Modellreferenz | Name | Kontext | Maximale Ausgabe |
|---|---|---|---|
nvidia/nvidia/nemotron-3-ultra-550b-a55b |
Nemotron 3 Ultra 550B | 1,048,576 | 8,192 |
nvidia/nvidia/nemotron-3-super-120b-a12b |
Nemotron 3 Super 120B | 1,000,000 | 8,192 |
nvidia/z-ai/glm-5.2 |
GLM 5.2 | 202,752 | 8,192 |
nvidia/moonshotai/kimi-k2.6 |
Kimi K2.6 | 262,144 | 8,192 |
nvidia/minimaxai/minimax-m3 |
Minimax M3 | 196,608 | 8,192 |
nvidia/deepseek-ai/deepseek-v4-pro |
DeepSeek V4 Pro | 262,144 | 16,384 |
nvidia/qwen/qwen3.5-397b-a17b |
Qwen3.5 397B A17B | 262,144 | 16,384 |
Der vollständige Kompatibilitätskatalog enthält außerdem diese veröffentlichten
Referenzen für bestehende Konfigurationen: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1,
nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 und
nvidia/minimaxai/minimax-m2.7. Sie bleiben über ihre exakte Referenz verfügbar,
erscheinen jedoch nie im Onboarding oder in Modellauswahlfeldern.
Erweiterte Konfiguration
Automatisches Aktivierungsverhalten
Der Provider wird automatisch aktiviert, wenn die Umgebungsvariable NVIDIA_API_KEY
gesetzt ist oder während des Onboardings ein Schlüssel gespeichert wurde. Über den
Schlüssel hinaus ist keine explizite Provider-Konfiguration erforderlich.
Katalog und Preisgestaltung
OpenClaw bevorzugt NVIDIAs öffentlichen Katalog empfohlener Modelle, wenn die
NVIDIA-Authentifizierung konfiguriert ist, und speichert ihn 24 Stunden lang im Cache.
Der mitgelieferte auswählbare Fallback ist eine statische Momentaufnahme von NVIDIAs
Katalog empfohlener Modelle; veraltete Kompatibilitätszeilen mit exakten Referenzen
werden in Modellauswahlfeldern ausgeblendet. Die Kosten sind im Quellcode standardmäßig
auf 0 gesetzt, da NVIDIA derzeit für die aufgeführten Modelle
kostenlosen API-Zugriff anbietet.
OpenAI-kompatibler Endpunkt
OpenClaw kommuniziert mit NVIDIA über den Adapter openai-completions und verwendet
dabei die standardmäßige Chat-Completions-Route /v1. Alle
OpenAI-kompatiblen Werkzeuge sollten mit der NVIDIA-Basis-URL ohne weitere
Konfiguration funktionieren.
Reasoning-Parameter für Nemotron 3 Ultra
NVIDIAs Ultra-Beispielanfrage verwendet chat_template_kwargs.enable_thinking
und reasoning_budget für die Reasoning-Ausgabe. Die mitgelieferte Ultra-Zeile
von OpenClaw deaktiviert Template-Reasoning standardmäßig für die normale Chat-Nutzung.
Wenn Sie die NVIDIA-Reasoning-Ausgabe aktivieren oder andere NVIDIA-spezifische
Anfragefelder erzwingen müssen, legen Sie Parameter pro Modell fest und beschränken
Sie Provider-spezifische Überschreibungen auf das NVIDIA-Modell:
{ agents: { defaults: { models: { "nvidia/nvidia/nemotron-3-ultra-550b-a55b": { params: { chat_template_kwargs: { enable_thinking: true }, extra_body: { reasoning_budget: 16384 }, }, }, }, }, },}params.chat_template_kwargs wird mit einem bereits in der Anfrage vorhandenen
chat_template_kwargs zusammengeführt, statt das gesamte Objekt zu ersetzen.
params.extra_body ist die abschließende OpenAI-kompatible Überschreibung des
Anfragekörpers und überschreibt kollidierende Nutzlastschlüssel. Verwenden Sie
sie daher nur für Felder, die NVIDIA für den ausgewählten Endpunkt dokumentiert.
Langsame Antworten benutzerdefinierter Provider
Einige von NVIDIA gehostete benutzerdefinierte Modelle können länger als der
standardmäßige Modellinaktivitäts-Watchdog von ~120s benötigen, bevor sie das
erste Antwortfragment ausgeben. Erhöhen Sie für benutzerdefinierte
NVIDIA-Provider-Einträge das Provider-Zeitlimit statt des Zeitlimits der gesamten
Agent-Laufzeit; timeoutSeconds gilt für HTTP-Anfragen des Providers und erhöht
die Obergrenze des Inaktivitäts-/Stream-Watchdogs für diesen Provider:
{ models: { providers: { "custom-integrate-api-nvidia-com": { baseUrl: "https://integrate.api.nvidia.com/v1", api: "openai-completions", apiKey: "NVIDIA_API_KEY", timeoutSeconds: 300, }, }, }, agents: { defaults: { models: { "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": { params: { thinking: "off" }, }, }, }, },}