Auf dieser Seite
Auf dieser Seite
Providers
ds4
ds4 stellt DeepSeek V4 Flash über ein lokales
Metal-Backend mit einer OpenAI-kompatiblen /v1-API bereit. OpenClaw verbindet sich mit ds4
über die generische openai-completions-Provider-Familie.
ds4 ist kein mitgeliefertes OpenClaw-Provider-Plugin. Konfigurieren Sie es unter
models.providers.ds4 und wählen Sie anschließend ds4/deepseek-v4-flash aus.
| Eigenschaft | Wert |
|---|---|
| Provider-ID | ds4 |
| Plugin | keines (nur Konfiguration) |
| API | OpenAI-kompatible Chat Completions (openai-completions) |
| Basis-URL | http://127.0.0.1:18000/v1 (empfohlen) |
| Modell-ID | deepseek-v4-flash |
| Tool-Aufrufe | OpenAI-Stil tools / tool_calls |
| Reasoning | DeepSeek-Stil thinking und reasoning_effort |
Anforderungen
- macOS mit Metal-Unterstützung.
- Ein funktionsfähiger ds4-Checkout mit
ds4-serverund der GGUF-Datei für DeepSeek V4 Flash. - Ausreichend Arbeitsspeicher für den gewählten Kontext; größere
--ctx-Werte weisen beim Serverstart mehr KV-Speicher zu.
Schnellstart
ds4-server starten
Ersetzen Sie <DS4_DIR> durch den Pfad zu Ihrem ds4-Checkout.
OpenAI-kompatiblen Endpunkt überprüfen
Die Antwort sollte deepseek-v4-flash enthalten.
OpenClaw-Provider-Konfiguration hinzufügen
Fügen Sie die Konfiguration aus Vollständige Konfiguration hinzu und führen Sie anschließend eine einmalige Modellprüfung aus:
Vollständige Konfiguration
Verwenden Sie diese Konfiguration, wenn ds4 bereits unter 127.0.0.1:18000 ausgeführt wird.
Halten Sie contextWindow mit ds4-server --ctx synchron. Halten Sie maxTokens
mit --tokens synchron, sofern OpenClaw nicht absichtlich weniger Ausgabe
als den Serverstandard anfordern soll.
Bedarfsgesteuerter Start
OpenClaw kann ds4 nur starten, wenn ein ds4/...-Modell ausgewählt ist. Fügen Sie
localService demselben Provider-Eintrag hinzu:
command muss ein absoluter Pfad zu einer ausführbaren Datei sein. Shell-Suche und
~-Erweiterung werden nicht verwendet. Unter Lokale Modelldienste
finden Sie alle localService-Felder.
Think Max
ds4 wendet Think Max nur an, wenn beides zutrifft:
ds4-serverbeginnt mit--ctx 393216oder höher.- Die Anfrage verwendet
reasoning_effort: "max"(oder das entsprechende ds4-Aufwandsfeld).
Wenn Sie diesen großen Kontext verwenden, aktualisieren Sie sowohl die Server-Flags als auch die OpenClaw-Modellmetadaten:
Test
Direkte HTTP-Prüfung unter Umgehung von OpenClaw:
OpenClaw-Modellrouting (wie bei der Schnellstartprüfung):
Vollständiger Smoke-Test für Agent und Tool-Aufrufe mit einem Kontext von mindestens 32768:
Erwartetes Ergebnis:
executionTrace.winnerProvideristds4executionTrace.winnerModelistdeepseek-v4-flashtoolSummary.callsist mindestens1finalAssistantVisibleTextbeginnt mittool-ok
Fehlerbehebung
curl /v1/models kann keine Verbindung herstellen
ds4 wird nicht ausgeführt oder ist nicht an den Host/Port in baseUrl gebunden. Starten Sie
ds4-server und versuchen Sie es anschließend erneut:
500 – Prompt überschreitet den Kontext
Der konfigurierte Wert --ctx ist für den OpenClaw-Durchlauf zu klein. Erhöhen Sie
ds4-server --ctx und aktualisieren Sie anschließend models.providers.ds4.models[].contextWindow
entsprechend. Vollständige Agent-Durchläufe mit Tools benötigen erheblich mehr Kontext als
eine direkte curl-Anfrage mit einer einzelnen Nachricht.
Think Max wird nicht aktiviert
ds4 verwendet Think Max nur, wenn --ctx mindestens 393216 beträgt und die Anfrage
reasoning_effort: "max" anfordert. Bei kleineren Kontexten wird auf hohes
Reasoning zurückgegriffen.
Die erste Anfrage ist langsam
ds4 durchläuft eine kalte Metal-Residenz- und Modellaufwärmphase. Legen Sie
localService.readyTimeoutMs: 300000 fest, wenn OpenClaw den Server bei
Bedarf startet.
Verwandte Themen
Starten Sie lokale Modellserver bei Bedarf vor Modellanfragen.
Wählen und betreiben Sie lokale Modell-Backends.
Konfigurieren Sie Provider-Referenzen, Authentifizierung und Failover.
Natives Verhalten des DeepSeek-Providers und Steuerung des Denkprozesses.