Providers
ds4
ds4, yerel bir Metal arka ucundan OpenAI uyumlu bir /v1 API ile DeepSeek V4 Flash sunar. OpenClaw, genel openai-completions sağlayıcı ailesi üzerinden ds4'e bağlanır.
ds4, OpenClaw ile birlikte gelen bir sağlayıcı plugini değildir. Onu
models.providers.ds4 altında yapılandırın, ardından ds4/deepseek-v4-flash seçeneğini belirleyin.
| Özellik | Değer |
|---|---|
| Sağlayıcı kimliği | ds4 |
| Plugin | yok (yalnızca yapılandırma) |
| API | OpenAI uyumlu Chat Completions (openai-completions) |
| Temel URL | http://127.0.0.1:18000/v1 (önerilen) |
| Model kimliği | deepseek-v4-flash |
| Araç çağrıları | OpenAI tarzı tools / tool_calls |
| Akıl yürütme | DeepSeek tarzı thinking ve reasoning_effort |
Gereksinimler
- Metal desteğine sahip macOS.
ds4-serverve DeepSeek V4 Flash GGUF dosyasını içeren çalışan bir ds4 çalışma kopyası.- Seçtiğiniz bağlam için yeterli bellek; daha büyük
--ctxdeğerleri, sunucu başlatılırken daha fazla KV belleği ayırır.
Hızlı başlangıç
ds4-server'ı başlatın
<DS4_DIR> değerini ds4 çalışma kopyanızın yoluyla değiştirin.
<DS4_DIR>/ds4-server \ --model <DS4_DIR>/ds4flash.gguf \ --host 127.0.0.1 \ --port 18000 \ --ctx 32768 \ --tokens 128OpenAI uyumlu uç noktayı doğrulayın
curl http://127.0.0.1:18000/v1/modelsYanıt deepseek-v4-flash değerini içermelidir.
OpenClaw sağlayıcı yapılandırmasını ekleyin
Tam yapılandırma bölümündeki yapılandırmayı ekleyin, ardından tek seferlik bir model denetimi çalıştırın:
openclaw infer model run \ --local \ --model ds4/deepseek-v4-flash \ --thinking off \ --prompt "Reply with exactly: openclaw-ds4-ok" \ --jsonTam yapılandırma
ds4 zaten 127.0.0.1:18000 üzerinde çalışıyorsa bu yapılandırmayı kullanın.
{ agents: { defaults: { model: { primary: "ds4/deepseek-v4-flash" }, models: { "ds4/deepseek-v4-flash": { alias: "DS4 local", }, }, }, }, models: { mode: "merge", providers: { ds4: { baseUrl: "http://127.0.0.1:18000/v1", apiKey: "ds4-local", api: "openai-completions", timeoutSeconds: 300, models: [ { id: "deepseek-v4-flash", name: "DeepSeek V4 Flash (ds4)", reasoning: true, input: ["text"], cost: { input: 0, output: 0, cacheRead: 0, cacheWrite: 0 }, contextWindow: 32768, maxTokens: 128, compat: { supportsUsageInStreaming: true, supportsReasoningEffort: true, maxTokensField: "max_tokens", supportsStrictMode: false, thinkingFormat: "deepseek", supportedReasoningEfforts: ["low", "medium", "high", "xhigh"], }, }, ], }, }, },}contextWindow değerini ds4-server --ctx ile uyumlu tutun. OpenClaw'un sunucu varsayılanından
daha az çıktı istemesini bilinçli olarak tercih etmiyorsanız maxTokens değerini
--tokens ile uyumlu tutun.
İstek üzerine başlatma
OpenClaw, ds4'ü yalnızca bir ds4/... modeli seçildiğinde başlatabilir. Aynı sağlayıcı
girdisine localService ekleyin:
{ models: { providers: { ds4: { baseUrl: "http://127.0.0.1:18000/v1", apiKey: "ds4-local", api: "openai-completions", timeoutSeconds: 300, localService: { command: "<DS4_DIR>/ds4-server", args: [ "--model", "<DS4_DIR>/ds4flash.gguf", "--host", "127.0.0.1", "--port", "18000", "--ctx", "32768", "--tokens", "128", ], cwd: "<DS4_DIR>", healthUrl: "http://127.0.0.1:18000/v1/models", readyTimeoutMs: 300000, idleStopMs: 0, }, models: [ { id: "deepseek-v4-flash", name: "DeepSeek V4 Flash (ds4)", reasoning: true, input: ["text"], cost: { input: 0, output: 0, cacheRead: 0, cacheWrite: 0 }, contextWindow: 32768, maxTokens: 128, compat: { supportsUsageInStreaming: true, supportsReasoningEffort: true, maxTokensField: "max_tokens", supportsStrictMode: false, thinkingFormat: "deepseek", supportedReasoningEfforts: ["low", "medium", "high", "xhigh"], }, }, ], }, }, },}command mutlak bir yürütülebilir dosya yolu olmalıdır. Kabuk araması ve ~ genişletmesi
kullanılmaz. Tüm localService alanları için Yerel model hizmetleri
bölümüne bakın.
Think Max
ds4, Think Max'i yalnızca aşağıdaki iki koşul da karşılandığında uygular:
ds4-server,--ctx 393216veya daha yüksek bir değerle başlar.- İstek
reasoning_effort: "max"değerini (veya eşdeğer ds4 efor alanını) kullanır.
Bu büyük bağlamı çalıştırırsanız hem sunucu bayraklarını hem de OpenClaw model meta verilerini güncelleyin:
{ contextWindow: 393216, maxTokens: 384000, compat: { supportsUsageInStreaming: true, supportsReasoningEffort: true, maxTokensField: "max_tokens", supportsStrictMode: false, thinkingFormat: "deepseek", supportedReasoningEfforts: ["low", "medium", "high", "xhigh", "max"], },}Test
OpenClaw'u atlayan doğrudan HTTP denetimi:
curl http://127.0.0.1:18000/v1/chat/completions \ -H 'content-type: application/json' \ -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Reply with exactly: ds4-ok"}],"max_tokens":16,"stream":false,"thinking":{"type":"disabled"}}'OpenClaw model yönlendirmesi (Hızlı başlangıç denetimiyle aynı):
openclaw infer model run \ --local \ --model ds4/deepseek-v4-flash \ --thinking off \ --prompt "Reply with exactly: openclaw-ds4-ok" \ --jsonEn az 32768 bağlamla tam agent ve araç çağrısı duman testi:
openclaw agent \ --local \ --session-id ds4-tool-smoke \ --model ds4/deepseek-v4-flash \ --thinking off \ --message "Use the shell command pwd once, then reply exactly: tool-ok <output>" \ --json \ --timeout 240Beklenen sonuç:
executionTrace.winnerProvider,ds4değeridirexecutionTrace.winnerModel,deepseek-v4-flashdeğeridirtoolSummary.calls, en az1değeridirfinalAssistantVisibleText,tool-okile başlar
Sorun giderme
curl /v1/models bağlanamıyor
ds4 çalışmıyor veya baseUrl içindeki ana bilgisayara/bağlantı noktasına bağlı değil.
ds4-server öğesini başlatın, ardından yeniden deneyin:
curl http://127.0.0.1:18000/v1/models500 istemi bağlamı aşıyor
Yapılandırılmış --ctx, OpenClaw turu için çok küçük. ds4-server --ctx
değerini artırın, ardından models.providers.ds4.models[].contextWindow değerini eşleşecek şekilde
güncelleyin. Araçları içeren tam agent turları, doğrudan tek mesajlı bir curl
isteğinden önemli ölçüde daha fazla bağlam gerektirir.
Think Max etkinleşmiyor
ds4, Think Max'i yalnızca --ctx en az 393216 olduğunda ve istek
reasoning_effort: "max" istediğinde kullanır. Daha küçük bağlamlar yüksek
akıl yürütmeye geri döner.
İlk istek yavaş
ds4'ün soğuk Metal yerleşimi ve model ısınma aşaması vardır. OpenClaw sunucuyu istek
üzerine başlattığında localService.readyTimeoutMs: 300000 değerini ayarlayın.
İlgili
Model isteklerinden önce yerel model sunucularını istek üzerine başlatın.
Yerel model arka uçlarını seçin ve çalıştırın.
Sağlayıcı referanslarını, kimlik doğrulamayı ve yük devretmeyi yapılandırın.
Yerel DeepSeek sağlayıcı davranışı ve düşünme denetimleri.