Providers

Volcengine(Doubao)

Volcengine プロバイダーを使用すると、Volcano Engine でホストされている Doubao モデルおよびサードパーティモデルにアクセスできます。一般用途とコーディング用途には、それぞれ個別のエンドポイントが用意されています。同じバンドル Plugin により、Volcengine Speech も TTS プロバイダーとして登録されます。

詳細
プロバイダー volcengine(一般 + TTS)、volcengine-plan(コーディング)
モデル認証 VOLCANO_ENGINE_API_KEY
TTS 認証 VOLCENGINE_TTS_API_KEY または BYTEPLUS_SEED_SPEECH_API_KEY
API OpenAI 互換モデル、BytePlus Seed Speech TTS

はじめに

  • API キーを設定する

    対話形式のオンボーディングを実行します。

    bash
    openclaw onboard --auth-choice volcengine-api-key

    これにより、1 つの API キーから一般用(volcengine)とコーディング用(volcengine-plan)の両プロバイダーが登録されます。

  • デフォルトモデルを設定する

    json5
    {  agents: {    defaults: {      model: { primary: "volcengine-plan/ark-code-latest" },    },  },}
  • モデルが利用可能であることを確認する

    bash
    openclaw models list --provider volcengineopenclaw models list --provider volcengine-plan
  • プロバイダーとエンドポイント

    プロバイダー エンドポイント 用途
    volcengine ark.cn-beijing.volces.com/api/v3 一般モデル
    volcengine-plan ark.cn-beijing.volces.com/api/coding/v3 コーディングモデル

    組み込みカタログ

    一般(volcengine)

    モデル参照 名前 入力 コンテキスト
    volcengine/deepseek-v3-2-251201 DeepSeek V3.2 テキスト、画像 128,000
    volcengine/doubao-seed-1-8-251228 Doubao Seed 1.8 テキスト、画像 256,000
    volcengine/doubao-seed-code-preview-251028 doubao-seed-code-preview-251028 テキスト、画像 256,000
    volcengine/glm-4-7-251222 GLM 4.7 テキスト、画像 200,000
    volcengine/kimi-k2-5-260127 Kimi K2.5 テキスト、画像 256,000

    コーディング(volcengine-plan)

    モデル参照 名前 入力 コンテキスト
    volcengine-plan/ark-code-latest Ark Coding Plan テキスト 256,000
    volcengine-plan/doubao-seed-code Doubao Seed Code テキスト 256,000

    両カタログは静的であり(/models 検出呼び出しは行われません)、OpenAI 互換のストリーミング使用量計測をサポートしています。Volcengine のツール呼び出し API は対象のキーワードを拒否するため、両プロバイダーのツールスキーマから minLengthmaxLengthminItemsmaxItemsminContains、および maxContains キーワードが自動的に削除されます。

    テキスト読み上げ

    Volcengine TTS は BytePlus Seed Speech HTTP API(voice.ap-southeast-1.bytepluses.com)を使用し、OpenAI 互換の Doubao モデル API キーとは別に設定します。BytePlus コンソールで Seed Speech > Settings > API Keys を開き、API キーをコピーしてから、次のように設定します。

    bash
    export VOLCENGINE_TTS_API_KEY="byteplus_seed_speech_api_key"export VOLCENGINE_TTS_RESOURCE_ID="seed-tts-1.0"

    次に、openclaw.json で有効にします。

    json5
    {  tts: {    auto: "always",    provider: "volcengine",    providers: {      volcengine: {        apiKey: "byteplus_seed_speech_api_key",        voice: "en_female_anna_mars_bigtts",        speedRatio: 1.0,      },    },  },}

    tts.providers.volcengine で使用可能なフィールドは、apiKeyvoicespeedRatio(0.2-3.0)、emotionclusterresourceIdappKey、および baseUrl です。音声設定の上書きが許可されている場合、!emotion=<value> はインライン音声ディレクティブとしても機能します。

    ボイスメモの送信先に対して、OpenClaw はプロバイダー固有の ogg_opus を要求します。通常の音声添付ファイルに対しては、mp3 を要求します。プロバイダーエイリアスの bytedancedoubao も、この音声プロバイダーに解決されます。

    デフォルトのリソース ID は seed-tts-1.0 です。これは、新しく作成された Seed Speech API キーに BytePlus がデフォルトで付与する利用資格です。プロジェクトに TTS 2.0 の利用資格がある場合は、VOLCENGINE_TTS_RESOURCE_ID=seed-tts-2.0 を設定します。

    古い Speech Console アプリケーション向けに、従来の AppID/トークン認証も引き続きサポートされています。

    bash
    export VOLCENGINE_TTS_APPID="speech_app_id"export VOLCENGINE_TTS_TOKEN="speech_access_token"export VOLCENGINE_TTS_CLUSTER="volcano_tts"

    その他のオプションの TTS 環境変数として、VOLCENGINE_TTS_VOICEVOLCENGINE_TTS_APP_KEY、および VOLCENGINE_TTS_BASE_URL があり、設定されている場合は対応する tts.providers.volcengine 設定フィールドを上書きします。

    高度な設定

    オンボーディング後のデフォルトモデル

    openclaw onboard --auth-choice volcengine-api-key は、一般用の volcengine カタログも登録しながら、volcengine-plan/ark-code-latest をデフォルトモデルとして設定します。

    モデル選択のフォールバック動作

    オンボーディングまたは設定時のモデル選択において、Volcengine の認証選択では volcengine/*volcengine-plan/* の両方の行が優先されます。これらのモデルがまだ読み込まれていない場合、OpenClaw はプロバイダーに絞り込まれた空のモデル選択画面を表示せず、フィルターされていないカタログにフォールバックします。

    デーモンプロセス用の環境変数

    Gateway がデーモン(launchd/systemd)として実行される場合は、VOLCANO_ENGINE_API_KEYVOLCENGINE_TTS_API_KEYBYTEPLUS_SEED_SPEECH_API_KEYVOLCENGINE_TTS_APPIDVOLCENGINE_TTS_TOKEN などのモデルおよび TTS の環境変数を、そのプロセスから利用できるようにしてください(たとえば、~/.openclaw/.env 内、または env.shellEnv 経由)。

    関連情報

    Was this useful?
    On this page

    On this page