Get started
Baseten
Baseten-Modell-APIs bieten gehosteten, OpenAI-kompatiblen Zugriff auf Frontier-Modelle. Das offizielle externe Plugin verwendet authentifizierte Erkennung, sodass OpenClaw dem vollständigen Modellsatz folgt, der für Ihr Baseten-Konto aktiviert ist. Sein Offline-Fallback enthält jede Modell-API, die zum Zeitpunkt der Erstellung dieser OpenClaw-Version verfügbar war.
| Eigenschaft | Wert |
|---|---|
| Provider-ID | baseten |
| Plugin | offizielles externes Paket (@openclaw/baseten-provider) |
| Auth-Umgebungsvariable | BASETEN_API_KEY |
| Onboarding-Flag | --auth-choice baseten-api-key |
| Direktes CLI-Flag | --baseten-api-key <key> |
| API | OpenAI-kompatibel (openai-completions) |
| Basis-URL | https://inference.baseten.co/v1 |
| Standardmodell | baseten/thinkingmachines/inkling |
Plugin installieren
openclaw plugins install @openclaw/baseten-provideropenclaw gateway restartErste Schritte
Baseten-Konto und API-Schlüssel erstellen
Für den Basic-Tarif von Baseten fällt keine monatliche Plattformgebühr an; Modell-API-Aufrufe werden nach Nutzung abgerechnet. Erstellen Sie unter Baseten-API-Schlüsseleinstellungen einen Schlüssel und prüfen Sie die aktuellen Tarife auf der Preisseite.
Onboarding ausführen
openclaw onboard --auth-choice baseten-api-keyopenclaw onboard --non-interactive \--auth-choice baseten-api-key \--baseten-api-key "$BASETEN_API_KEY"export BASETEN_API_KEY=...Live-Katalog überprüfen
openclaw models list --provider basetenMit verwendbarer Authentifizierung fordert das Plugin GET /v1/models an und listet jedes für das Konto zurückgegebene Modell auf. Ohne Authentifizierung bleibt es offline und verwendet das gebündelte Fallback.
Inkling
Inkling von Thinking Machines Lab ist das Standardmodell. In OpenClaw unterstützt es Text- und Bildeingaben, Tool-Aufrufe, strukturierte Tool-Schemas, konfigurierbaren Reasoning-Aufwand, ein Kontextfenster mit 1.048M Token und bis zu 32k Ausgabe-Token:
{ agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, },}Verwenden Sie /model baseten/thinkingmachines/inkling, um einen bestehenden Chat umzustellen.
Gebündelter Fallback-Katalog
Der authentifizierte Live-Katalog ist maßgeblich. Diese Zeilen sorgen dafür, dass Einrichtung und Modellauswahl bereits vor erfolgreicher Erkennung verwendet werden können:
| Modellreferenz | Eingabe | Kontext | Max. Ausgabe |
|---|---|---|---|
baseten/deepseek-ai/DeepSeek-V4-Pro |
Text | 262k | 262k |
baseten/zai-org/GLM-4.7 |
Text | 200k | 200k |
baseten/zai-org/GLM-5 |
Text | 202k | 202k |
baseten/zai-org/GLM-5.1 |
Text | 202k | 202k |
baseten/zai-org/GLM-5.2 |
Text | 202k | 202k |
baseten/thinkingmachines/inkling |
Text, Bild | 1.048M | 32k |
baseten/moonshotai/Kimi-K2.5 |
Text, Bild | 262k | 262k |
baseten/moonshotai/Kimi-K2.6 |
Text, Bild | 262k | 262k |
baseten/moonshotai/Kimi-K2.7-Code |
Text, Bild | 262k | 262k |
baseten/nvidia/Nemotron-120B-A12B |
Text | 202k | 202k |
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B |
Text | 202k | 202k |
baseten/openai/gpt-oss-120b |
Text | 128k | 128k |
Alle gebündelten Modelle unterstützen Tool-Aufrufe und Reasoning. OpenClaw ordnet seine Denkstufen Modellen mit nativem reasoning_effort zu. Bei den optionalen GLM-, Kimi- und Nemotron-Modellen von Baseten ist das Denken standardmäßig deaktiviert; die meisten bieten eine binäre Aus-/Ein-Steuerung, während GLM 5.2 die Stufen aus, hoch und maximal bietet. OpenClaw übermittelt diese Auswahl über die Baseten-Steuerung chat_template_args.enable_thinking und bei GLM 5.2 über den validierten Top-Level-Parameter reasoning_effort.
Manuelle Konfiguration
Für die meisten Einrichtungen ist nur der API-Schlüssel erforderlich. So legen Sie den Provider ausdrücklich fest:
{ env: { BASETEN_API_KEY: "..." }, agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, }, models: { mode: "merge", providers: { baseten: { baseUrl: "https://inference.baseten.co/v1", apiKey: "${BASETEN_API_KEY}", api: "openai-completions", models: [ { id: "thinkingmachines/inkling", name: "Inkling", reasoning: true, input: ["text", "image"], contextWindow: 1048000, maxTokens: 32000, }, ], }, }, },}