Na tej stronie
Na tej stronie
Providers
ds4
ds4 udostępnia DeepSeek V4 Flash z lokalnego
backendu Metal za pośrednictwem interfejsu API /v1 zgodnego z OpenAI. OpenClaw łączy się z ds4
przez ogólną rodzinę dostawców openai-completions.
ds4 nie jest dołączonym Pluginem dostawcy OpenClaw. Skonfiguruj go w
models.providers.ds4, a następnie wybierz ds4/deepseek-v4-flash.
| Właściwość | Wartość |
|---|---|
| Identyfikator dostawcy | ds4 |
| Plugin | brak (tylko konfiguracja) |
| API | Chat Completions zgodne z OpenAI (openai-completions) |
| Bazowy adres URL | http://127.0.0.1:18000/v1 (sugerowany) |
| Identyfikator modelu | deepseek-v4-flash |
| Wywołania narzędzi | tools / tool_calls w stylu OpenAI |
| Rozumowanie | thinking i reasoning_effort w stylu DeepSeek |
Wymagania
- macOS z obsługą Metal.
- Działająca kopia robocza ds4 z
ds4-serveroraz plikiem GGUF DeepSeek V4 Flash. - Wystarczająca ilość pamięci dla wybranego kontekstu; większe wartości
--ctxprzydzielają więcej pamięci KV podczas uruchamiania serwera.
Szybki start
Start ds4-server
Zastąp <DS4_DIR> ścieżką do swojej kopii roboczej ds4.
Verify the OpenAI-compatible endpoint
Odpowiedź powinna zawierać deepseek-v4-flash.
Add the OpenClaw provider config
Dodaj konfigurację z sekcji Pełna konfiguracja, a następnie uruchom jednorazowe sprawdzenie modelu:
Pełna konfiguracja
Użyj tej konfiguracji, gdy ds4 jest już uruchomiony pod adresem 127.0.0.1:18000.
Utrzymuj contextWindow zgodne z ds4-server --ctx. Utrzymuj maxTokens zgodne
z --tokens, chyba że celowo chcesz, aby OpenClaw żądał mniejszej ilości danych wyjściowych
niż domyślna wartość serwera.
Uruchamianie na żądanie
OpenClaw może uruchamiać ds4 tylko wtedy, gdy wybrany jest model ds4/.... Dodaj
localService do tego samego wpisu dostawcy:
command musi być bezwzględną ścieżką do pliku wykonywalnego. Wyszukiwanie przez powłokę ani rozwijanie ~
nie są używane. Opis wszystkich pól localService znajdziesz w sekcji
Lokalne usługi modeli.
Think Max
ds4 stosuje Think Max tylko wtedy, gdy oba warunki są spełnione:
ds4-serveruruchamia się z wartością--ctx 393216lub większą.- Żądanie używa
reasoning_effort: "max"(lub równoważnego pola poziomu wysiłku ds4).
Jeśli używasz tak dużego kontekstu, zaktualizuj zarówno flagi serwera, jak i metadane modelu OpenClaw:
Test
Bezpośrednie sprawdzenie HTTP z pominięciem OpenClaw:
Trasowanie modelu OpenClaw (takie samo jak sprawdzenie w sekcji Szybki start):
Pełny test dymny agenta i wywołań narzędzi z kontekstem wynoszącym co najmniej 32768:
Oczekiwany wynik:
executionTrace.winnerProviderma wartośćds4executionTrace.winnerModelma wartośćdeepseek-v4-flashtoolSummary.callswynosi co najmniej1finalAssistantVisibleTextzaczyna się odtool-ok
Rozwiązywanie problemów
curl /v1/models cannot connect
ds4 nie jest uruchomiony albo nie nasłuchuje na hoście lub porcie określonym w baseUrl. Uruchom
ds4-server, a następnie spróbuj ponownie:
500 prompt exceeds context
Skonfigurowana wartość --ctx jest zbyt mała dla tury OpenClaw. Zwiększ
ds4-server --ctx, a następnie odpowiednio zaktualizuj models.providers.ds4.models[].contextWindow.
Pełne tury agenta z narzędziami wymagają znacznie większego kontekstu niż bezpośrednie
żądanie curl z pojedynczą wiadomością.
Think Max does not activate
ds4 używa Think Max tylko wtedy, gdy --ctx wynosi co najmniej 393216, a żądanie
określa reasoning_effort: "max". Mniejsze konteksty powodują powrót do wysokiego
poziomu rozumowania.
The first request is slow
ds4 ma fazę początkowego umieszczania w pamięci Metal i rozgrzewania modelu. Ustaw
localService.readyTimeoutMs: 300000, gdy OpenClaw uruchamia serwer
na żądanie.
Powiązane
Uruchamiaj lokalne serwery modeli na żądanie przed żądaniami do modeli.
Wybieraj i obsługuj lokalne backendy modeli.
Konfiguruj odwołania do dostawców, uwierzytelnianie i przełączanie awaryjne.
Natywne zachowanie dostawcy DeepSeek i ustawienia sterujące myśleniem.