Providers
Moonshot AI
Moonshot stellt die Kimi-API mit OpenAI-kompatiblen Endpunkten bereit. Wählen Sie
moonshot/kimi-k3 für Kimi K3, behalten Sie den Onboarding-Standard
moonshot/kimi-k2.6 bei oder verwenden Sie kimi/kimi-for-coding für Kimi Coding.
Integrierter Modellkatalog
| Modellreferenz | Name | Schlussfolgern | Eingabe | Kontext | Max. Ausgabe |
|---|---|---|---|---|---|
moonshot/kimi-k2.6 |
Kimi K2.6 | Nein | Text, Bild | 262,144 | 262,144 |
moonshot/kimi-k3 |
Kimi K3 | Immer maximal | Text, Bild | 1,048,576 | 1,048,576 |
moonshot/kimi-k2.7-code |
Kimi K2.7 Code | Immer aktiviert | Text, Bild | 262,144 | 262,144 |
moonshot/kimi-k2.7-code-highspeed |
Kimi K2.7 Code HighSpeed | Immer aktiviert | Text, Bild | 262,144 | 262,144 |
moonshot/kimi-k2.5 |
Kimi K2.5 | Nein | Text, Bild | 262,144 | 262,144 |
Die Kostenschätzungen im Katalog verwenden die von Moonshot veröffentlichten nutzungsabhängigen Tarife. Prüfen Sie vor Kostenentscheidungen die aktuellen Anbieterseiten für Kimi K3, Kimi K2.7 Code, Kimi K2.6 und Kimi K2.5.
Kimi K3 schlussfolgert immer mit reasoning_effort: "max". OpenClaw stellt nur
/think max bereit, lässt das ausschließlich für K2 vorgesehene Feld thinking weg und entfernt Sampling-
Überschreibungen (temperature, top_p, n, presence_penalty und
frequency_penalty), die K3 auf die Provider-Standards festlegt. Kimi K2.7 Code verwendet ebenfalls
immer natives Denken, erfordert jedoch, dass sowohl thinking als auch
reasoning_effort weggelassen werden; die HighSpeed-Variante verwendet denselben Vertrag.
Kimi K2.6 bleibt der Onboarding-Standard.
Siehe Moonshots Kimi-K3-Schnellstart.
Erste Schritte
Sowohl Moonshot als auch Kimi Coding sind externe Plugins – installieren Sie eines davon vor dem Onboarding.
Moonshot API
Am besten geeignet für: Kimi-K3- und K2-Modelle über die Moonshot Open Platform.
Plugin installieren
openclaw plugins install @openclaw/moonshot-provideropenclaw gateway restartEndpunktregion auswählen
| Authentifizierungsoption | Endpunkt | Region |
|---|---|---|
moonshot-api-key |
https://api.moonshot.ai/v1 |
International |
moonshot-api-key-cn |
https://api.moonshot.cn/v1 |
China |
Onboarding ausführen
openclaw onboard --auth-choice moonshot-api-keyOder für den China-Endpunkt:
openclaw onboard --auth-choice moonshot-api-key-cnKimi K3 als Standardmodell festlegen
Beim Onboarding bleibt Kimi K2.6 zunächst das Standardmodell. Wechseln Sie ausdrücklich, wenn Sie Kimi K3 verwenden möchten:
openclaw models set moonshot/kimi-k3Verfügbarkeit der Modelle überprüfen
openclaw models list --provider moonshotLive-Smoke-Test ausführen
Verwenden Sie ein isoliertes Zustandsverzeichnis, wenn Sie den Modellzugriff und die Kostenverfolgung überprüfen möchten, ohne Ihre normalen Sitzungen zu verändern:
OPENCLAW_CONFIG_PATH=/tmp/openclaw-kimi/openclaw.json \OPENCLAW_STATE_DIR=/tmp/openclaw-kimi \openclaw agent --local \ --session-id live-kimi-cost \ --message 'Reply exactly: KIMI_LIVE_OK' \ --thinking max \ --jsonDie JSON-Antwort sollte provider: "moonshot" und
model: "kimi-k3" melden. Der Assistenten-Transkripteintrag speichert die normalisierte
Token-Nutzung sowie die geschätzten Kosten unter usage.cost, wenn Moonshot
Nutzungsmetadaten zurückgibt.
Konfigurationsbeispiel
{ env: { MOONSHOT_API_KEY: "sk-..." }, agents: { defaults: { model: { primary: "moonshot/kimi-k2.6" }, models: { // moonshot-kimi-k2-aliases:start "moonshot/kimi-k2.6": { alias: "Kimi K2.6" }, "moonshot/kimi-k3": { alias: "Kimi K3" }, "moonshot/kimi-k2.7-code": { alias: "Kimi K2.7 Code" }, "moonshot/kimi-k2.7-code-highspeed": { alias: "Kimi K2.7 Code HighSpeed" }, "moonshot/kimi-k2.5": { alias: "Kimi K2.5" }, // moonshot-kimi-k2-aliases:end }, }, }, models: { mode: "merge", providers: { moonshot: { baseUrl: "https://api.moonshot.ai/v1", apiKey: "${MOONSHOT_API_KEY}", api: "openai-completions", models: [ // moonshot-kimi-k2-models:start { id: "kimi-k2.6", name: "Kimi K2.6", reasoning: false, input: ["text", "image"], cost: { input: 0.95, output: 4, cacheRead: 0.16, cacheWrite: 0 }, contextWindow: 262144, maxTokens: 262144, }, { id: "kimi-k3", name: "Kimi K3", reasoning: true, thinkingLevelMap: { off: null, minimal: null, low: null, medium: null, high: null, xhigh: "max", max: "max", }, input: ["text", "image"], cost: { input: 3, output: 15, cacheRead: 0.3, cacheWrite: 0 }, contextWindow: 1048576, maxTokens: 1048576, }, { id: "kimi-k2.7-code", name: "Kimi K2.7 Code", reasoning: true, input: ["text", "image"], cost: { input: 0.95, output: 4, cacheRead: 0.19, cacheWrite: 0 }, contextWindow: 262144, maxTokens: 262144, }, { id: "kimi-k2.7-code-highspeed", name: "Kimi K2.7 Code HighSpeed", reasoning: true, input: ["text", "image"], cost: { input: 1.9, output: 8, cacheRead: 0.38, cacheWrite: 0 }, contextWindow: 262144, maxTokens: 262144, }, { id: "kimi-k2.5", name: "Kimi K2.5", reasoning: false, input: ["text", "image"], cost: { input: 0.6, output: 3, cacheRead: 0.1, cacheWrite: 0 }, contextWindow: 262144, maxTokens: 262144, }, // moonshot-kimi-k2-models:end ], }, }, },}Kimi Coding
Am besten geeignet für: codeorientierte Aufgaben über den Kimi-Coding-Endpunkt.
Der Coding-Dienst akzeptiert sowohl OpenAI-kompatible
https://api.kimi.com/coding/v1- als auch Anthropic-kompatible
https://api.kimi.com/coding/-Clients. Dieses Plugin verwendet Anthropic Messages.
Erstellen Sie Mitgliedschaftsschlüssel in der
Kimi Code Console; die aktuellen Mitgliedschaftspreise
finden Sie auf der Preisseite von Kimi.
Plugin installieren
openclaw plugins install @openclaw/kimi-provideropenclaw gateway restartOnboarding ausführen
openclaw onboard --auth-choice kimi-code-api-keyStandardmodell festlegen
{ agents: { defaults: { model: { primary: "kimi/kimi-for-coding" }, }, },}Verfügbarkeit des Modells überprüfen
openclaw models list --provider kimiKimi Code K3 verwendet standardmäßig tiefes Denken mit max. /think off sendet
thinking.type: "disabled"; /think max sendet die Adaptive-Thinking-
Anfrage von K3 mit maximalem Aufwand. Veraltete niedrigere Denkstufen werden auf die
unterstützte Stufe max aufgelöst. Das 1M-Modell erfordert eine Allegretto- oder höhere Kimi-
Mitgliedschaft; verwenden Sie kimi/k3 bei Moderato.
Die aktuelle Verfügbarkeit nach Tarif finden Sie in der offiziellen Kimi-Code-Modelltabelle.
Konfigurationsbeispiel
{ env: { KIMI_API_KEY: "sk-..." }, agents: { defaults: { model: { primary: "kimi/kimi-for-coding" }, models: { "kimi/kimi-for-coding": { alias: "Kimi" }, }, }, },}Kimi-Websuche
Das Moonshot-Plugin registriert außerdem Kimi als web_search-Provider, der auf der Moonshot-Websuche basiert.
Interaktive Einrichtung der Websuche ausführen
openclaw configure --section webWählen Sie im Websuchabschnitt Kimi, um
plugins.entries.moonshot.config.webSearch.* zu speichern.
Region und Modell der Websuche konfigurieren
Bei der interaktiven Einrichtung werden Sie zu Folgendem aufgefordert:
| Einstellung | Optionen |
|---|---|
| API-Region | https://api.moonshot.ai/v1 (international) oder https://api.moonshot.cn/v1 (China) |
| Websuchmodell | Standardmäßig kimi-k2.6 |
Die Konfiguration befindet sich unter plugins.entries.moonshot.config.webSearch:
{ plugins: { entries: { moonshot: { config: { webSearch: { apiKey: "sk-...", // oder KIMI_API_KEY / MOONSHOT_API_KEY verwenden baseUrl: "https://api.moonshot.ai/v1", model: "kimi-k2.6", }, }, }, }, }, tools: { web: { search: { provider: "kimi", }, }, },}Erweiterte Konfiguration
Nativer Denkmodus
Moonshot API Kimi K3 schlussfolgert immer mit maximalem Aufwand. OpenClaw stellt nur
/think max bereit, sendet reasoning_effort: "max" und ignoriert veraltete niedrigere oder
off-Einstellungen.
Kimi Code K3 stellt /think off|max bereit. Sein Anthropic-kompatibler Endpunkt
empfängt thinking.type: "disabled" zum Deaktivieren oder adaptives Thinking mit
output_config.effort: "max" für das Maximum. Dies gilt sowohl für kimi/k3 als auch für
kimi/k3[1m].
Moonshot API K3 unterstützt auto, none, required und festgelegte Tool-Auswahlen,
sodass OpenClaw die angeforderte tool_choice beibehält. Bei der mehrstufigen Tool-Nutzung
behält OpenClaw die vom Replay-Vertrag von Moonshot
benötigten Reasoning-Inhalte des Assistenten bei.
Kimi K2.7 Code verwendet immer natives Thinking. Moonshot verlangt von Clients,
das Feld thinking für dieses Modell wegzulassen, daher stellt OpenClaw nur on bereit und
ignoriert veraltete off-Einstellungen. K2.7 legt außerdem temperature, top_p, n,
presence_penalty und frequency_penalty fest; OpenClaw lässt konfigurierte
Überschreibungen für diese Felder weg.
Andere Moonshot-Kimi-Modelle unterstützen binäres natives Thinking:
thinking: { type: "enabled" }thinking: { type: "disabled" }
Konfigurieren Sie es über agents.defaults.models.<provider/model>.params für jedes Modell separat:
{ agents: { defaults: { models: { "moonshot/kimi-k2.6": { params: { thinking: { type: "disabled" }, }, }, }, }, },}OpenClaw ordnet die Laufzeitstufen von /think für diese Modelle wie folgt zu:
Stufe von /think |
Moonshot-Verhalten |
|---|---|
/think off |
thinking.type=disabled |
| Jede nicht deaktivierte Stufe | thinking.type=enabled |
Kimi K2.6 akzeptiert außerdem ein optionales Feld thinking.keep, das die
turnübergreifende Beibehaltung von reasoning_content steuert. Setzen Sie es auf "all", um das vollständige
Reasoning über mehrere Turns hinweg beizubehalten; lassen Sie es weg (oder belassen Sie es bei null), um die
Standardstrategie des Servers zu verwenden. OpenClaw leitet thinking.keep nur für
moonshot/kimi-k2.6 weiter und entfernt es bei anderen Modellen. Kimi K2.7 Code
behält standardmäßig den vollständigen Reasoning-Verlauf bei, während OpenClaw das gesamte
Feld thinking weglässt.
{ agents: { defaults: { models: { "moonshot/kimi-k2.6": { params: { thinking: { type: "enabled", keep: "all" }, }, }, }, }, },}Bereinigung der Tool-Aufruf-ID
Moonshot Kimi stellt native tool_call-IDs im Format functions.<name>:<index> bereit. OpenClaw behält das erste Vorkommen jeder nativen Kimi-ID bei und schreibt spätere Duplikate in deterministische IDs im OpenAI-Stil call_* um. Zugehörige Tool-Ergebnisse werden derselben ID zugeordnet, sodass das Replay eindeutig bleibt, ohne die erste native ID von Kimi zu entfernen. Dieses Verhalten ist fest in den gebündelten Moonshot-Provider integriert und keine vom Benutzer konfigurierbare Einstellung.
Kompatibilität der Streaming-Nutzungsdaten
Native Moonshot-Endpunkte (https://api.moonshot.ai/v1 und
https://api.moonshot.cn/v1) weisen Kompatibilität mit Streaming-Nutzungsdaten aus.
OpenClaw richtet sich dabei nach dem Host des Endpunkts, nicht nach der Provider-ID. Daher übernimmt eine benutzerdefinierte
Provider-ID, die auf denselben nativen Moonshot-Host verweist, dasselbe
Verhalten für Streaming-Nutzungsdaten.
Bei den K2.6-Preisen aus dem Katalog wird die gestreamte Nutzung, die Eingabe-, Ausgabe-
und Cache-Lese-Tokens enthält, außerdem für
/status, /usage full, /usage cost und die sitzungsbezogene
Abrechnung auf Grundlage des Transkripts in lokal geschätzte Kosten in USD umgerechnet.
Referenz für Endpunkte und Modellreferenzen
| Provider | Präfix der Modellreferenz | Endpunkt | Umgebungsvariable für die Authentifizierung |
|---|---|---|---|
| Moonshot | moonshot/ |
https://api.moonshot.ai/v1 |
MOONSHOT_API_KEY |
| Moonshot CN | moonshot/ |
https://api.moonshot.cn/v1 |
MOONSHOT_API_KEY |
| Kimi Coding | kimi/ |
Kimi-Coding-Endpunkt | KIMI_API_KEY |
| Websuche | k. A. | Entspricht der Region der Moonshot API | KIMI_API_KEY oder MOONSHOT_API_KEY |
- Die Kimi-Websuche verwendet
KIMI_API_KEYoderMOONSHOT_API_KEYund standardmäßighttps://api.moonshot.ai/v1mit dem Modellkimi-k2.6. - Überschreiben Sie bei Bedarf die Preis- und Kontextmetadaten in
models.providers. - Wenn Moonshot andere Kontextlimits für ein Modell veröffentlicht, passen Sie
contextWindowentsprechend an.
Verwandte Themen
Auswahl von Providern, Modellreferenzen und Failover-Verhalten.
Konfiguration von Websuch-Providern einschließlich Kimi.
Vollständiges Konfigurationsschema für Provider, Modelle und Plugins.
Verwaltung und Dokumentation von Moonshot-API-Schlüsseln.