Providers
Z.AI
Z.AI는 GLM 모델용 API 플랫폼입니다. GLM용 REST API를 제공하며
인증에는 API 키를 사용합니다. Z.AI 콘솔에서 API 키를 생성하십시오.
OpenClaw는 Z.AI API 키와 함께 zai 제공자를 사용합니다.
| 속성 | 값 |
|---|---|
| 제공자 | zai |
| 패키지 | @openclaw/zai-provider |
| 인증 | ZAI_API_KEY (레거시 별칭: Z_AI_API_KEY) |
| API | Z.AI 채팅 완성(Bearer 인증) |
GLM 모델
GLM은 별도의 제공자가 아니라 모델 제품군입니다. OpenClaw에서 GLM 모델은
zai/glm-5.2 같은 참조를 사용합니다. 제공자는 zai이고 모델 ID는 glm-5.2입니다.
시작하기
먼저 제공자 Plugin을 설치하십시오.
openclaw plugins install @openclaw/zai-provider엔드포인트 자동 감지
권장 대상: 대부분의 사용자. OpenClaw는 API 키로 지원되는 Z.AI 엔드포인트를 탐색하고 올바른 기본 URL을 자동으로 적용합니다.
온보딩 실행
openclaw onboard --auth-choice zai-api-key모델이 목록에 표시되는지 확인
openclaw models list --all --provider zai명시적 지역 엔드포인트
권장 대상: 특정 Coding Plan 또는 일반 API 인터페이스를 강제로 사용하려는 사용자.
올바른 온보딩 옵션 선택
# Coding Plan 글로벌(Coding Plan 사용자에게 권장)openclaw onboard --auth-choice zai-coding-global # Coding Plan CN(중국 지역)openclaw onboard --auth-choice zai-coding-cn # 일반 APIopenclaw onboard --auth-choice zai-global # 일반 API CN(중국 지역)openclaw onboard --auth-choice zai-cn모델이 목록에 표시되는지 확인
openclaw models list --all --provider zai엔드포인트
| 온보딩 옵션 | 기본 URL | 기본 모델 |
|---|---|---|
zai-global |
https://api.z.ai/api/paas/v4 |
glm-5.1 |
zai-cn |
https://open.bigmodel.cn/api/paas/v4 |
glm-5.1 |
zai-coding-global |
https://api.z.ai/api/coding/paas/v4 |
glm-5.2 |
zai-coding-cn |
https://open.bigmodel.cn/api/coding/paas/v4 |
glm-5.2 |
zai-api-key은 각 엔드포인트의 채팅 완성 API에 키를 대입하여 이 네 가지 중 하나를
자동으로 감지합니다. 일반 엔드포인트(zai-global, 그다음
zai-cn)를 Coding Plan 엔드포인트(zai-coding-global, 그다음
zai-coding-cn)보다 먼저 확인하며, 요청을 수락하는 첫 번째 엔드포인트에서 중단합니다.
키가 양쪽 모두에서 작동하는 경우 Coding Plan 엔드포인트를 강제로 사용하려면 명시적
--auth-choice을 사용하십시오.
속도 제한 및 과부하
Z.AI 문서에서는 Coding Plan과 범용 에이전트 도구를 용량 관리형 서비스로 설명합니다. Z.AI 자체 문서에 따르면 다음과 같습니다.
- 범용 에이전트 도구는 OpenClaw를 포함하여 최선형 서비스 방식으로 제공됩니다. 일반적으로 싱가포르 시간 오후 2시~6시경처럼 추론 부하가 높을 때 일부 요청에 일시적인 속도 제한이 적용될 수 있습니다.
- Coding Plan 속도 및 동시성 제한은 요금제 등급에 따라 결정되며 리소스 가용성에 따라 동적으로 조정될 수 있습니다. 사용량이 적은 시간에는 동시성 한도가 더 높을 수 있습니다.
- API 오류 코드
1302는 "요청 속도 제한에 도달함"을 의미합니다. API 오류 코드1305은 "서비스가 일시적으로 과부하 상태일 수 있으므로 나중에 다시 시도하십시오"를 의미합니다.
사용량이 많은 시간대에 일시적인 429 또는 1305 응답이 표시되면 기다렸다가
요청을 다시 시도하십시오. 사용량이 많은 시간대가 아닌데도 오류가 반복되거나 특정
엔드포인트, 모델 또는 요청 형식에서만 발생하는 경우 먼저 구성된 엔드포인트와
모델을 확인하십시오.
openclaw models list --all --provider zaiopenclaw config get models.providers.zai.baseUrlCoding Plan 키에는 https://api.z.ai/api/coding/paas/v4 같은 Coding Plan 엔드포인트를
사용해야 하며, 일반 API 키에는 https://api.z.ai/api/paas/v4 같은 일반 API
엔드포인트를 사용해야 합니다. 동일한 키와 엔드포인트에서 오류가 계속되면
일반적인 최대 부하 시간대 제한이 아니라 제공자 측의 거부 또는 요금제 제한을
의미할 수 있습니다.
구성 예시
{ env: { ZAI_API_KEY: "sk-..." }, models: { providers: { zai: { // GLM-5.2는 Coding Plan 엔드포인트를 사용합니다. baseUrl: "https://api.z.ai/api/coding/paas/v4", }, }, }, agents: { defaults: { model: { primary: "zai/glm-5.2" } } },}기본 제공 카탈로그
zai 제공자 Plugin은 Plugin 매니페스트에 카탈로그를 포함하여 제공하므로,
제공자 런타임을 로드하지 않고도 읽기 전용 목록에서 알려진 GLM 항목을 표시할 수 있습니다.
openclaw models list --all --provider zai매니페스트 기반 카탈로그에는 현재 다음 항목이 포함됩니다.
| 모델 참조 | 참고 |
|---|---|
zai/glm-5.2 |
Coding Plan 기본값, 1M 컨텍스트 |
zai/glm-5.1 |
일반 API 기본값 |
zai/glm-5 |
|
zai/glm-5-turbo |
|
zai/glm-5v-turbo |
|
zai/glm-4.7 |
|
zai/glm-4.7-flash |
|
zai/glm-4.7-flashx |
|
zai/glm-4.6 |
|
zai/glm-4.6v |
|
zai/glm-4.5 |
|
zai/glm-4.5-air |
|
zai/glm-4.5-flash |
|
zai/glm-4.5v |
사고 수준
GLM-5.2
전체 범위: off, low, high, max(기본값 off).
OpenClaw는 요청 페이로드의 reasoning_effort을 통해
low 및 high을 Z.AI의 high 추론 노력 수준에 매핑하고,
max을 Z.AI의 max 노력 수준에 매핑합니다.
기타 GLM 모델
이진 토글만 지원합니다. off 및 low(선택기에서는 on으로 표시)이며,
기본값은 off입니다. 사고 수준을 off으로 설정하면
thinking: { type: "disabled" }을 전송합니다. 그 외의 수준에서는 요청 페이로드를 변경하지 않습니다
(Z.AI 자체의 기본 추론 동작이 적용됩니다).
사고 수준을 off으로 설정하면 표시되는 텍스트보다 먼저
reasoning_content에 출력 예산을 소모하는 응답을 방지할 수 있습니다.
고급 구성
알 수 없는 GLM-5 모델의 순방향 확인
알 수 없는 glm-5* ID도 현재 GLM-5 제품군 형식과 일치하면
glm-4.7 템플릿에서 제공자 소유 메타데이터를 합성하여
제공자 경로에서 계속 순방향 확인됩니다.
도구 호출 스트리밍
Z.AI 도구 호출 스트리밍에는 기본적으로 tool_stream이 활성화됩니다. 비활성화하려면 다음과 같이 설정하십시오.
{ agents: { defaults: { models: { "zai/<model>": { params: { tool_stream: false }, }, }, }, },}보존된 사고
Z.AI에서는 전체 과거 reasoning_content을 다시 재생해야 하며 이로 인해 프롬프트 토큰이
증가하므로, 사고 보존은 명시적으로 활성화해야 합니다. 모델별로 활성화하십시오.
{ agents: { defaults: { models: { "zai/glm-5.2": { params: { preserveThinking: true }, }, }, }, },}활성화되고 사고 기능이 켜져 있으면 OpenClaw는
thinking: { type: "enabled", clear_thinking: false }을 전송하고 동일한 OpenAI 호환 트랜스크립트의 이전
reasoning_content을 다시 재생합니다. 스네이크 케이스
preserve_thinking 매개변수 키도 별칭으로 사용할 수 있습니다.
고급 사용자는 params.extra_body.thinking을 사용하여 정확한 제공자 페이로드를
계속 재정의할 수 있습니다.
이미지 이해
Z.AI Plugin은 이미지 이해 기능을 등록합니다.
| 속성 | 값 |
|---|---|
| 모델 | glm-4.6v |
이미지 이해 기능은 구성된 Z.AI 인증에서 자동으로 확인되므로 추가 구성이 필요하지 않습니다.
인증 세부 정보
- Z.AI는 API 키를 사용하는 Bearer 인증을 사용합니다.
zai-api-key온보딩 옵션은 키로 지원되는 엔드포인트를 탐색하여 일치하는 Z.AI 엔드포인트를 자동으로 감지합니다.- 특정 API 인터페이스를 강제로 사용하려면 명시적 지역 옵션(
zai-coding-global,zai-coding-cn,zai-global,zai-cn)을 사용하십시오. - 레거시 환경 변수
Z_AI_API_KEY도 계속 허용됩니다. 시작할 때ZAI_API_KEY이 설정되지 않은 경우 OpenClaw가 이를ZAI_API_KEY에 복사합니다.