Loslegen
Baseten
Baseten-Modell-APIs bieten gehosteten, OpenAI-kompatiblen Zugriff auf Frontier-Modelle. Das offizielle externe Plugin verwendet authentifizierte Erkennung, sodass OpenClaw den vollständigen Modellsatz übernimmt, der für Ihr Baseten-Konto aktiviert ist. Der Offline-Fallback enthält jede Modell-API, die beim Erstellen dieser OpenClaw-Version verfügbar war.
| Eigenschaft | Wert |
|---|---|
| Provider-ID | baseten |
| Plugin | offizielles externes Paket (@openclaw/baseten-provider) |
| Authentifizierungs-Umgebungsvariable | BASETEN_API_KEY |
| Onboarding-Flag | --auth-choice baseten-api-key |
| Direktes CLI-Flag | --baseten-api-key <key> |
| API | OpenAI-kompatibel (openai-completions) |
| Basis-URL | https://inference.baseten.co/v1 |
| Standardmodell | baseten/thinkingmachines/inkling |
Plugin installieren
openclaw plugins install @openclaw/baseten-provideropenclaw gateway restartErste Schritte
Baseten-Konto und API-Schlüssel erstellen
Für den Basic-Tarif von Baseten fällt keine monatliche Plattformgebühr an; Modell-API-Aufrufe werden nutzungsabhängig berechnet. Erstellen Sie unter Baseten API key settings einen Schlüssel und prüfen Sie die aktuellen Preise auf der Preisseite.
Onboarding ausführen
openclaw onboard --auth-choice baseten-api-keyopenclaw onboard --non-interactive \--auth-choice baseten-api-key \--baseten-api-key "$BASETEN_API_KEY"export BASETEN_API_KEY=...Live-Katalog überprüfen
openclaw models list --provider basetenBei verwendbarer Authentifizierung fordert das Plugin GET /v1/models an und listet jedes für das Konto zurückgegebene Modell auf. Ohne Authentifizierung bleibt es offline und verwendet den gebündelten Fallback.
Inkling
Inkling von Thinking Machines Lab ist das Standardmodell. In OpenClaw unterstützt es Text- und Bildeingaben, Tool-Aufrufe, strukturierte Tool-Schemata, konfigurierbaren Reasoning-Aufwand, ein Kontextfenster mit 1.048M Token und bis zu 32k Ausgabe-Token:
{ agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, },}Verwenden Sie /model baseten/thinkingmachines/inkling, um einen bestehenden Chat umzustellen.
Gebündelter Fallback-Katalog
Der authentifizierte Live-Katalog ist maßgeblich. Diese Zeilen sorgen dafür, dass Einrichtung und Modellauswahl auch vor erfolgreicher Erkennung nutzbar bleiben:
| Modellreferenz | Eingabe | Kontext | Max. Ausgabe |
|---|---|---|---|
baseten/deepseek-ai/DeepSeek-V4-Pro |
Text | 262k | 262k |
baseten/zai-org/GLM-4.7 |
Text | 200k | 200k |
baseten/zai-org/GLM-5 |
Text | 202k | 202k |
baseten/zai-org/GLM-5.1 |
Text | 202k | 202k |
baseten/zai-org/GLM-5.2 |
Text | 202k | 202k |
baseten/thinkingmachines/inkling |
Text, Bild | 1.048M | 32k |
baseten/moonshotai/Kimi-K2.5 |
Text, Bild | 262k | 262k |
baseten/moonshotai/Kimi-K2.6 |
Text, Bild | 262k | 262k |
baseten/moonshotai/Kimi-K2.7-Code |
Text, Bild | 262k | 262k |
baseten/nvidia/Nemotron-120B-A12B |
Text | 202k | 202k |
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B |
Text | 202k | 202k |
baseten/openai/gpt-oss-120b |
Text | 128k | 128k |
Alle gebündelten Modelle unterstützen Tool-Aufrufe und Reasoning. OpenClaw ordnet seine Denkstufen Modellen mit nativem reasoning_effort zu. Bei den optional aktivierbaren GLM-, Kimi- und Nemotron-Modellen von Baseten ist das Denken standardmäßig deaktiviert; die meisten bieten eine binäre Aus-/Ein-Steuerung, während GLM 5.2 die Stufen Aus, Hoch und Maximum bietet. OpenClaw übermittelt diese Auswahl über Basetens chat_template_args.enable_thinking-Steuerung und bei GLM 5.2 über den validierten Top-Level-Parameter reasoning_effort.
Manuelle Konfiguration
Für die meisten Einrichtungen ist nur der API-Schlüssel erforderlich. So legen Sie den Provider explizit fest:
{ env: { BASETEN_API_KEY: "..." }, agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, }, models: { mode: "merge", providers: { baseten: { baseUrl: "https://inference.baseten.co/v1", apiKey: "${BASETEN_API_KEY}", api: "openai-completions", models: [ { id: "thinkingmachines/inkling", name: "Inkling", reasoning: true, input: ["text", "image"], contextWindow: 1048000, maxTokens: 32000, }, ], }, }, },}