Nesta página
Nesta página
Providers
Moonshot AI
A Moonshot fornece a API Kimi com endpoints compatíveis com a OpenAI. Defina o
modelo padrão como moonshot/kimi-k2.6 para a Moonshot Open Platform ou
kimi/kimi-for-coding para o Kimi Coding.
Catálogo de modelos integrado
| Referência do modelo | Nome | Raciocínio | Entrada | Contexto | Saída máxima |
|---|---|---|---|---|---|
moonshot/kimi-k2.6 |
Kimi K2.6 | Não | texto, imagem | 262,144 | 262,144 |
moonshot/kimi-k2.7-code |
Kimi K2.7 Code | Sempre ativo | texto, imagem | 262,144 | 262,144 |
moonshot/kimi-k2.5 |
Kimi K2.5 | Não | texto, imagem | 262,144 | 262,144 |
moonshot/kimi-k2-thinking |
Kimi K2 Thinking | Sim | texto | 262,144 | 262,144 |
moonshot/kimi-k2-thinking-turbo |
Kimi K2 Thinking Turbo | Sim | texto | 262,144 | 262,144 |
moonshot/kimi-k2-turbo |
Kimi K2 Turbo | Não | texto | 256,000 | 16,384 |
As estimativas de custo do catálogo usam as tarifas de pagamento por uso publicadas pela Moonshot: o Kimi K2.7 Code custa US$ 0,19/MTok para acerto de cache, US$ 0,95/MTok de entrada e US$ 4,00/MTok de saída; o Kimi K2.6 custa US$ 0,16/MTok para acerto de cache, US$ 0,95/MTok de entrada e US$ 4,00/MTok de saída; o Kimi K2.5 custa US$ 0,10/MTok para acerto de cache, US$ 0,60/MTok de entrada e US$ 3,00/MTok de saída. As outras entradas do catálogo mantêm valores provisórios de custo zero, a menos que você os substitua na configuração.
O Kimi K2.7 Code sempre usa raciocínio nativo. O OpenClaw expõe apenas o estado
de raciocínio on para esse modelo e omite os campos enviados thinking e
reasoning_effort, conforme exigido pela Moonshot. Ele também omite
substituições de amostragem (temperature, top_p, n, presence_penalty,
frequency_penalty), que o K2.7 fixa nos padrões do provedor. O Kimi K2.6
continua sendo o padrão da configuração inicial.
Primeiros passos
Tanto o Moonshot quanto o Kimi Coding são plugins externos — instale um deles antes de iniciar a configuração.
API Moonshot
Mais indicado para: modelos Kimi K2 por meio da Moonshot Open Platform.
Instale o plugin
Escolha a região do endpoint
| Opção de autenticação | Endpoint | Região |
|---|---|---|
moonshot-api-key |
https://api.moonshot.ai/v1 |
Internacional |
moonshot-api-key-cn |
https://api.moonshot.cn/v1 |
China |
Execute a configuração inicial
Ou, para o endpoint da China:
Defina um modelo padrão
Verifique se os modelos estão disponíveis
Execute um teste rápido real
Use um diretório de estado isolado quando quiser verificar o acesso ao modelo e o acompanhamento de custos sem afetar suas sessões normais:
A resposta JSON deve informar provider: "moonshot" e
model: "kimi-k2.6". A entrada da transcrição do assistente armazena
o uso normalizado de tokens e o custo estimado em usage.cost quando
a Moonshot retorna metadados de uso.
Exemplo de configuração
Kimi Coding
Mais indicado para: tarefas focadas em código por meio do endpoint do Kimi Coding.
Instale o plugin
Execute a configuração inicial
Defina um modelo padrão
Verifique se o modelo está disponível
Exemplo de configuração
Pesquisa na web do Kimi
O plugin da Moonshot também registra o Kimi como um provedor de web_search,
com suporte da pesquisa na web da Moonshot.
Execute a configuração interativa da pesquisa na web
Escolha Kimi na seção de pesquisa na web para armazenar
plugins.entries.moonshot.config.webSearch.*.
Configure a região e o modelo da pesquisa na web
A configuração interativa solicita:
| Configuração | Opções |
|---|---|
| Região da API | https://api.moonshot.ai/v1 (internacional) ou https://api.moonshot.cn/v1 (China) |
| Modelo de pesquisa na web | O padrão é kimi-k2.6 |
A configuração fica em plugins.entries.moonshot.config.webSearch:
Configuração avançada
Modo de raciocínio nativo
O Kimi K2.7 Code sempre usa raciocínio nativo. A Moonshot exige que os
clientes omitam o campo thinking para esse modelo, portanto o OpenClaw
expõe apenas on e ignora configurações off obsoletas. O K2.7 também
fixa temperature, top_p, n, presence_penalty e
frequency_penalty; o OpenClaw omite as substituições configuradas para
esses campos.
Outros modelos Kimi da Moonshot oferecem suporte a raciocínio nativo binário:
thinking: { type: "enabled" }thinking: { type: "disabled" }
Configure-o por modelo por meio de agents.defaults.models.<provider/model>.params:
O OpenClaw mapeia os níveis de /think em tempo de execução para esses modelos:
Nível de /think |
Comportamento da Moonshot |
|---|---|
/think off |
thinking.type=disabled |
Qualquer nível diferente de off |
thinking.type=enabled |
O Kimi K2.6 também aceita um campo opcional thinking.keep que controla
a retenção de reasoning_content entre vários turnos. Defina-o como "all" para manter o
raciocínio completo entre os turnos; omita-o (ou deixe-o como null) para usar a estratégia
padrão do servidor. O OpenClaw encaminha thinking.keep somente para
moonshot/kimi-k2.6 e o remove de outros modelos. O Kimi K2.7 Code
preserva o histórico completo de raciocínio por padrão, enquanto o OpenClaw omite todo o
campo thinking.
Tool call id sanitization
O Moonshot Kimi fornece ids nativos de tool_call no formato functions.<name>:<index>. O OpenClaw preserva a primeira ocorrência de cada id nativo do Kimi e reescreve duplicatas posteriores como ids determinísticos call_* no estilo da OpenAI. Os resultados de ferramentas correspondentes são remapeados com o mesmo id, para que a reprodução permaneça exclusiva sem remover o primeiro id nativo do Kimi. Esse comportamento está integrado ao provedor Moonshot incluído e não é uma configuração ajustável pelo usuário.
Streaming usage compatibility
Os endpoints nativos do Moonshot (https://api.moonshot.ai/v1 e
https://api.moonshot.cn/v1) indicam compatibilidade com o uso em streaming.
O OpenClaw determina isso pelo host do endpoint, e não pelo id do provedor; portanto, um id de
provedor personalizado que aponte para o mesmo host nativo do Moonshot herda o mesmo
comportamento de uso em streaming.
Com os preços do K2.6 no catálogo, o uso transmitido que inclui tokens de entrada, saída
e leitura de cache também é convertido em um custo local estimado em USD para
/status, /usage full, /usage cost e a contabilização de sessões
baseada em transcrições.
Endpoint and model ref reference
| Provedor | Prefixo da referência do modelo | Endpoint | Variável de ambiente de autenticação |
|---|---|---|---|
| Moonshot | moonshot/ |
https://api.moonshot.ai/v1 |
MOONSHOT_API_KEY |
| Moonshot CN | moonshot/ |
https://api.moonshot.cn/v1 |
MOONSHOT_API_KEY |
| Kimi Coding | kimi/ |
Endpoint do Kimi Coding | KIMI_API_KEY |
| Pesquisa na web | N/D | Igual à região da API Moonshot | KIMI_API_KEY ou MOONSHOT_API_KEY |
- A pesquisa na web do Kimi usa
KIMI_API_KEYouMOONSHOT_API_KEYe, por padrão, utilizahttps://api.moonshot.ai/v1com o modelokimi-k2.6. - Se necessário, substitua os preços e os metadados de contexto em
models.providers. - Se o Moonshot publicar limites de contexto diferentes para um modelo, ajuste
contextWindowadequadamente.
Relacionados
Escolha de provedores, referências de modelos e comportamento de failover.
Configuração de provedores de pesquisa na web, incluindo o Kimi.
Esquema completo de configuração para provedores, modelos e plugins.
Gerenciamento de chaves de API do Moonshot e documentação.