Get started

Baseten

Baseten Model API は、フロンティアモデルへのホスト型の OpenAI 互換アクセスを提供します。公式の外部 Plugin は認証済みディスカバリーを使用するため、OpenClaw は Baseten アカウントで有効になっている完全なモデルセットに追従します。オフラインフォールバックには、この OpenClaw リリースのビルド時に利用可能だったすべての Model API が含まれています。

プロパティ
プロバイダー ID baseten
Plugin 公式外部パッケージ (@openclaw/baseten-provider)
認証環境変数 BASETEN_API_KEY
オンボーディングフラグ --auth-choice baseten-api-key
直接指定 CLI フラグ --baseten-api-key <key>
API OpenAI 互換 (openai-completions)
ベース URL https://inference.baseten.co/v1
デフォルトモデル baseten/thinkingmachines/inkling

Plugin のインストール

bash
openclaw plugins install @openclaw/baseten-provideropenclaw gateway restart

はじめに

  • Baseten アカウントと API キーを作成する

    Baseten の Basic プランには月額プラットフォーム料金がなく、Model API 呼び出しは使用量に応じて課金されます。Baseten API key settings でキーを作成し、料金ページで現在の料金を確認してください。

  • オンボーディングを実行する

    Onboarding
    openclaw onboard --auth-choice baseten-api-key
    Direct flag
    openclaw onboard --non-interactive \--auth-choice baseten-api-key \--baseten-api-key "$BASETEN_API_KEY"
    Env only
    export BASETEN_API_KEY=...
  • ライブカタログを確認する

    bash
    openclaw models list --provider baseten

    使用可能な認証情報がある場合、Plugin は GET /v1/models をリクエストし、アカウントについて返されたすべてのモデルを一覧表示します。認証情報がない場合はオフラインのまま、バンドルされたフォールバックを使用します。

  • Inkling

    Thinking Machines Lab の Inkling がデフォルトモデルです。OpenClaw では、テキストと画像の入力、ツール呼び出し、構造化ツールスキーマ、設定可能な推論エフォート、1.048M トークンのコンテキストウィンドウ、最大 32k 出力トークンをサポートします。

    json5
    {  agents: {    defaults: {      model: { primary: "baseten/thinkingmachines/inkling" },    },  },}

    既存のチャットを切り替えるには /model baseten/thinkingmachines/inkling を使用します。

    バンドルされたフォールバックカタログ

    認証済みライブカタログが正式な情報源です。以下の行により、ディスカバリーが成功する前でもセットアップとモデル選択を利用できます。

    モデル参照 入力 コンテキスト 最大出力
    baseten/deepseek-ai/DeepSeek-V4-Pro テキスト 262k 262k
    baseten/zai-org/GLM-4.7 テキスト 200k 200k
    baseten/zai-org/GLM-5 テキスト 202k 202k
    baseten/zai-org/GLM-5.1 テキスト 202k 202k
    baseten/zai-org/GLM-5.2 テキスト 202k 202k
    baseten/thinkingmachines/inkling テキスト、画像 1.048M 32k
    baseten/moonshotai/Kimi-K2.5 テキスト、画像 262k 262k
    baseten/moonshotai/Kimi-K2.6 テキスト、画像 262k 262k
    baseten/moonshotai/Kimi-K2.7-Code テキスト、画像 262k 262k
    baseten/nvidia/Nemotron-120B-A12B テキスト 202k 202k
    baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B テキスト 202k 202k
    baseten/openai/gpt-oss-120b テキスト 128k 128k

    バンドルされたすべてのモデルは、ツール呼び出しと推論をサポートします。OpenClaw は、その思考レベルをネイティブの reasoning_effort を持つモデルにマッピングします。Baseten のオプトイン式 GLM、Kimi、Nemotron モデルはデフォルトで思考がオフになっています。大部分はオフ/オンの二値制御を公開しますが、GLM 5.2 はオフ、高、最大を公開します。OpenClaw はこれらの選択を Baseten の chat_template_args.enable_thinking 制御を通じて送信し、GLM 5.2 については検証済みのトップレベル reasoning_effort パラメーターも使用します。

    手動設定

    ほとんどのセットアップでは API キーだけが必要です。プロバイダーを明示的に固定するには、次のように設定します。

    json5
    {  env: { BASETEN_API_KEY: "..." },  agents: {    defaults: {      model: { primary: "baseten/thinkingmachines/inkling" },    },  },  models: {    mode: "merge",    providers: {      baseten: {        baseUrl: "https://inference.baseten.co/v1",        apiKey: "${BASETEN_API_KEY}",        api: "openai-completions",        models: [          {            id: "thinkingmachines/inkling",            name: "Inkling",            reasoning: true,            input: ["text", "image"],            contextWindow: 1048000,            maxTokens: 32000,          },        ],      },    },  },}

    関連項目

    Was this useful?
    On this page

    On this page