Get started
Baseten
Baseten Model API は、フロンティアモデルへのホスト型の OpenAI 互換アクセスを提供します。公式の外部 Plugin は認証済みディスカバリーを使用するため、OpenClaw は Baseten アカウントで有効になっている完全なモデルセットに追従します。オフラインフォールバックには、この OpenClaw リリースのビルド時に利用可能だったすべての Model API が含まれています。
| プロパティ | 値 |
|---|---|
| プロバイダー ID | baseten |
| Plugin | 公式外部パッケージ (@openclaw/baseten-provider) |
| 認証環境変数 | BASETEN_API_KEY |
| オンボーディングフラグ | --auth-choice baseten-api-key |
| 直接指定 CLI フラグ | --baseten-api-key <key> |
| API | OpenAI 互換 (openai-completions) |
| ベース URL | https://inference.baseten.co/v1 |
| デフォルトモデル | baseten/thinkingmachines/inkling |
Plugin のインストール
openclaw plugins install @openclaw/baseten-provideropenclaw gateway restartはじめに
Baseten アカウントと API キーを作成する
Baseten の Basic プランには月額プラットフォーム料金がなく、Model API 呼び出しは使用量に応じて課金されます。Baseten API key settings でキーを作成し、料金ページで現在の料金を確認してください。
オンボーディングを実行する
openclaw onboard --auth-choice baseten-api-keyopenclaw onboard --non-interactive \--auth-choice baseten-api-key \--baseten-api-key "$BASETEN_API_KEY"export BASETEN_API_KEY=...ライブカタログを確認する
openclaw models list --provider baseten使用可能な認証情報がある場合、Plugin は GET /v1/models をリクエストし、アカウントについて返されたすべてのモデルを一覧表示します。認証情報がない場合はオフラインのまま、バンドルされたフォールバックを使用します。
Inkling
Thinking Machines Lab の Inkling がデフォルトモデルです。OpenClaw では、テキストと画像の入力、ツール呼び出し、構造化ツールスキーマ、設定可能な推論エフォート、1.048M トークンのコンテキストウィンドウ、最大 32k 出力トークンをサポートします。
{ agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, },}既存のチャットを切り替えるには /model baseten/thinkingmachines/inkling を使用します。
バンドルされたフォールバックカタログ
認証済みライブカタログが正式な情報源です。以下の行により、ディスカバリーが成功する前でもセットアップとモデル選択を利用できます。
| モデル参照 | 入力 | コンテキスト | 最大出力 |
|---|---|---|---|
baseten/deepseek-ai/DeepSeek-V4-Pro |
テキスト | 262k | 262k |
baseten/zai-org/GLM-4.7 |
テキスト | 200k | 200k |
baseten/zai-org/GLM-5 |
テキスト | 202k | 202k |
baseten/zai-org/GLM-5.1 |
テキスト | 202k | 202k |
baseten/zai-org/GLM-5.2 |
テキスト | 202k | 202k |
baseten/thinkingmachines/inkling |
テキスト、画像 | 1.048M | 32k |
baseten/moonshotai/Kimi-K2.5 |
テキスト、画像 | 262k | 262k |
baseten/moonshotai/Kimi-K2.6 |
テキスト、画像 | 262k | 262k |
baseten/moonshotai/Kimi-K2.7-Code |
テキスト、画像 | 262k | 262k |
baseten/nvidia/Nemotron-120B-A12B |
テキスト | 202k | 202k |
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B |
テキスト | 202k | 202k |
baseten/openai/gpt-oss-120b |
テキスト | 128k | 128k |
バンドルされたすべてのモデルは、ツール呼び出しと推論をサポートします。OpenClaw は、その思考レベルをネイティブの reasoning_effort を持つモデルにマッピングします。Baseten のオプトイン式 GLM、Kimi、Nemotron モデルはデフォルトで思考がオフになっています。大部分はオフ/オンの二値制御を公開しますが、GLM 5.2 はオフ、高、最大を公開します。OpenClaw はこれらの選択を Baseten の chat_template_args.enable_thinking 制御を通じて送信し、GLM 5.2 については検証済みのトップレベル reasoning_effort パラメーターも使用します。
手動設定
ほとんどのセットアップでは API キーだけが必要です。プロバイダーを明示的に固定するには、次のように設定します。
{ env: { BASETEN_API_KEY: "..." }, agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, }, models: { mode: "merge", providers: { baseten: { baseUrl: "https://inference.baseten.co/v1", apiKey: "${BASETEN_API_KEY}", api: "openai-completions", models: [ { id: "thinkingmachines/inkling", name: "Inkling", reasoning: true, input: ["text", "image"], contextWindow: 1048000, maxTokens: 32000, }, ], }, }, },}