Op deze pagina
Op deze pagina
Providers
ds4
ds4 biedt DeepSeek V4 Flash aan vanuit een lokale
Metal-backend met een OpenAI-compatibele /v1-API. OpenClaw maakt verbinding met ds4
via de generieke providerfamilie openai-completions.
ds4 is geen gebundelde OpenClaw-providerplugin. Configureer deze onder
models.providers.ds4 en selecteer vervolgens ds4/deepseek-v4-flash.
| Eigenschap | Waarde |
|---|---|
| Provider-id | ds4 |
| Plugin | geen (alleen configuratie) |
| API | OpenAI-compatibele Chat Completions (openai-completions) |
| Basis-URL | http://127.0.0.1:18000/v1 (aanbevolen) |
| Model-id | deepseek-v4-flash |
| Toolaanroepen | OpenAI-stijl tools / tool_calls |
| Redeneren | DeepSeek-stijl thinking en reasoning_effort |
Vereisten
- macOS met Metal-ondersteuning.
- Een werkende ds4-check-out met
ds4-serveren het GGUF-bestand van DeepSeek V4 Flash. - Voldoende geheugen voor de gekozen context; grotere waarden voor
--ctxwijzen bij het opstarten van de server meer KV-geheugen toe.
Snelstart
Start ds4-server
Vervang <DS4_DIR> door het pad naar je ds4-check-out.
Controleer het OpenAI-compatibele eindpunt
Het antwoord moet deepseek-v4-flash bevatten.
Voeg de OpenClaw-providerconfiguratie toe
Voeg de configuratie uit Volledige configuratie toe en voer vervolgens een eenmalige modelcontrole uit:
Volledige configuratie
Gebruik deze configuratie wanneer ds4 al op 127.0.0.1:18000 wordt uitgevoerd.
Houd contextWindow afgestemd op ds4-server --ctx. Houd maxTokens afgestemd
op --tokens, tenzij je bewust wilt dat OpenClaw minder uitvoer aanvraagt
dan de standaardwaarde van de server.
Op aanvraag starten
OpenClaw kan ds4 alleen starten wanneer een ds4/...-model is geselecteerd. Voeg
localService toe aan dezelfde providervermelding:
command moet een absoluut pad naar een uitvoerbaar bestand zijn. Shellopzoeking en uitbreiding van ~
worden niet gebruikt. Zie Lokale modelservices voor
elk localService-veld.
Think Max
ds4 past Think Max alleen toe wanneer aan beide voorwaarden wordt voldaan:
ds4-serverstart met--ctx 393216of hoger.- De aanvraag gebruikt
reasoning_effort: "max"(of het equivalente ds4-inspanningsveld).
Als je die grote context gebruikt, werk dan zowel de servervlaggen als de OpenClaw-modelmetadata bij:
Test
Directe HTTP-controle, waarbij OpenClaw wordt omzeild:
OpenClaw-modelroutering (hetzelfde als de controle in Snelstart):
Volledige rooktest voor agent- en toolaanroepen, met een context van ten minste 32768:
Verwacht resultaat:
executionTrace.winnerProviderisds4executionTrace.winnerModelisdeepseek-v4-flashtoolSummary.callsis ten minste1finalAssistantVisibleTextbegint mettool-ok
Problemen oplossen
curl /v1/models kan geen verbinding maken
ds4 wordt niet uitgevoerd of is niet gebonden aan de host/poort in baseUrl. Start
ds4-server en probeer het opnieuw:
500 prompt overschrijdt context
De geconfigureerde --ctx is te klein voor de OpenClaw-beurt. Verhoog
ds4-server --ctx en werk vervolgens models.providers.ds4.models[].contextWindow bij
zodat deze overeenkomt. Volledige agentbeurten met tools hebben aanzienlijk meer context nodig dan een
directe curl-aanvraag met één bericht.
Think Max wordt niet geactiveerd
ds4 gebruikt Think Max alleen wanneer --ctx ten minste 393216 is en de aanvraag
om reasoning_effort: "max" vraagt. Kleinere contexten vallen terug op een hoog
redeneerniveau.
De eerste aanvraag is traag
ds4 heeft een koude Metal-residentie en een opwarmfase voor het model. Stel
localService.readyTimeoutMs: 300000 in wanneer OpenClaw de server op
aanvraag start.