Get started
Baseten
API โมเดลของ Baseten ให้บริการการเข้าถึงโมเดลแนวหน้าที่โฮสต์ไว้และเข้ากันได้กับ OpenAI Plugin ภายนอกอย่างเป็นทางการใช้การค้นหาที่ผ่านการยืนยันตัวตน ดังนั้น OpenClaw จึงใช้ชุดโมเดลทั้งหมดที่เปิดใช้งานสำหรับบัญชี Baseten ของคุณ ส่วนรายการสำรองแบบออฟไลน์ประกอบด้วย Model API ทุกรายการที่พร้อมใช้งานในขณะที่สร้าง OpenClaw รุ่นนี้
| คุณสมบัติ | ค่า |
|---|---|
| รหัสผู้ให้บริการ | baseten |
| Plugin | แพ็กเกจภายนอกอย่างเป็นทางการ (@openclaw/baseten-provider) |
| ตัวแปรสภาพแวดล้อมสำหรับการยืนยันตัวตน | BASETEN_API_KEY |
| แฟล็กการเริ่มต้นใช้งาน | --auth-choice baseten-api-key |
| แฟล็ก CLI โดยตรง | --baseten-api-key <key> |
| API | เข้ากันได้กับ OpenAI (openai-completions) |
| URL ฐาน | https://inference.baseten.co/v1 |
| โมเดลเริ่มต้น | baseten/thinkingmachines/inkling |
ติดตั้ง Plugin
openclaw plugins install @openclaw/baseten-provideropenclaw gateway restartเริ่มต้นใช้งาน
สร้างบัญชี Baseten และคีย์ API
แผน Basic ของ Baseten ไม่มีค่าธรรมเนียมแพลตฟอร์มรายเดือน ส่วนการเรียกใช้ Model API คิดราคาตามการใช้งาน สร้างคีย์ในการตั้งค่าคีย์ API ของ Baseten และตรวจสอบอัตราปัจจุบันในหน้าราคา
ดำเนินการเริ่มต้นใช้งาน
openclaw onboard --auth-choice baseten-api-keyopenclaw onboard --non-interactive \--auth-choice baseten-api-key \--baseten-api-key "$BASETEN_API_KEY"export BASETEN_API_KEY=...ตรวจสอบแค็ตตาล็อกสด
openclaw models list --provider basetenเมื่อมีข้อมูลยืนยันตัวตนที่ใช้งานได้ Plugin จะร้องขอ GET /v1/models และแสดงทุกรุ่นโมเดลที่ส่งคืนสำหรับบัญชีนั้น หากไม่มีข้อมูลยืนยันตัวตน ระบบจะทำงานแบบออฟไลน์ต่อไปและใช้รายการสำรองที่รวมมาให้
Inkling
Inkling ของ Thinking Machines Lab เป็นโมเดลเริ่มต้น ใน OpenClaw โมเดลนี้รองรับอินพุตข้อความและรูปภาพ การเรียกใช้เครื่องมือ สคีมาเครื่องมือแบบมีโครงสร้าง ระดับความพยายามในการให้เหตุผลที่กำหนดค่าได้ หน้าต่างบริบทขนาด 1.048M โทเค็น และโทเค็นเอาต์พุตสูงสุด 32k:
{ agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, },}ใช้ /model baseten/thinkingmachines/inkling เพื่อสลับโมเดลในการแชตที่มีอยู่
แค็ตตาล็อกสำรองที่รวมมาให้
แค็ตตาล็อกสดที่ผ่านการยืนยันตัวตนเป็นแหล่งข้อมูลที่เชื่อถือได้ แถวเหล่านี้ช่วยให้การตั้งค่าและการเลือกโมเดลยังใช้งานได้ก่อนที่การค้นหาจะสำเร็จ:
| การอ้างอิงโมเดล | อินพุต | บริบท | เอาต์พุตสูงสุด |
|---|---|---|---|
baseten/deepseek-ai/DeepSeek-V4-Pro |
ข้อความ | 262k | 262k |
baseten/zai-org/GLM-4.7 |
ข้อความ | 200k | 200k |
baseten/zai-org/GLM-5 |
ข้อความ | 202k | 202k |
baseten/zai-org/GLM-5.1 |
ข้อความ | 202k | 202k |
baseten/zai-org/GLM-5.2 |
ข้อความ | 202k | 202k |
baseten/thinkingmachines/inkling |
ข้อความ, รูปภาพ | 1.048M | 32k |
baseten/moonshotai/Kimi-K2.5 |
ข้อความ, รูปภาพ | 262k | 262k |
baseten/moonshotai/Kimi-K2.6 |
ข้อความ, รูปภาพ | 262k | 262k |
baseten/moonshotai/Kimi-K2.7-Code |
ข้อความ, รูปภาพ | 262k | 262k |
baseten/nvidia/Nemotron-120B-A12B |
ข้อความ | 202k | 202k |
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B |
ข้อความ | 202k | 202k |
baseten/openai/gpt-oss-120b |
ข้อความ | 128k | 128k |
โมเดลที่รวมมาให้ทั้งหมดรองรับการเรียกใช้เครื่องมือและการให้เหตุผล OpenClaw จับคู่ระดับการคิดของตนกับโมเดลที่มี reasoning_effort ในตัว โมเดล GLM, Kimi และ Nemotron แบบเลือกรับของ Baseten ปิดการคิดไว้โดยค่าเริ่มต้น โดยส่วนใหญ่มีตัวควบคุมแบบไบนารี ปิด/เปิด ขณะที่ GLM 5.2 มีตัวเลือกปิด สูง และสูงสุด OpenClaw ส่งตัวเลือกเหล่านี้ผ่านตัวควบคุม chat_template_args.enable_thinking ของ Baseten และสำหรับ GLM 5.2 จะส่งผ่านพารามิเตอร์ระดับบนสุด reasoning_effort ที่ผ่านการตรวจสอบแล้ว
การกำหนดค่าด้วยตนเอง
การตั้งค่าส่วนใหญ่ต้องใช้เพียงคีย์ API หากต้องการระบุผู้ให้บริการไว้อย่างชัดเจน:
{ env: { BASETEN_API_KEY: "..." }, agents: { defaults: { model: { primary: "baseten/thinkingmachines/inkling" }, }, }, models: { mode: "merge", providers: { baseten: { baseUrl: "https://inference.baseten.co/v1", apiKey: "${BASETEN_API_KEY}", api: "openai-completions", models: [ { id: "thinkingmachines/inkling", name: "Inkling", reasoning: true, input: ["text", "image"], contextWindow: 1048000, maxTokens: 32000, compat: { supportsStore: false, supportsDeveloperRole: false, supportsUsageInStreaming: true, supportsStrictMode: true, supportsTools: true, supportsReasoningEffort: true, supportedReasoningEfforts: ["none", "minimal", "low", "medium", "high", "xhigh"], reasoningEffortMap: { off: "none", none: "none", adaptive: "xhigh", max: "xhigh", }, maxTokensField: "max_tokens", }, }, ], }, }, },}