На цій сторінці
На цій сторінці
Providers
ds4
ds4 запускає DeepSeek V4 Flash на локальному
бекенді Metal з API /v1, сумісним з OpenAI. OpenClaw підключається до ds4
через універсальне сімейство постачальників openai-completions.
ds4 не є вбудованим Plugin постачальника OpenClaw. Налаштуйте його в
models.providers.ds4, а потім виберіть ds4/deepseek-v4-flash.
| Властивість | Значення |
|---|---|
| Ідентифікатор постачальника | ds4 |
| Plugin | немає (лише конфігурація) |
| API | Chat Completions, сумісний з OpenAI (openai-completions) |
| Базова URL-адреса | http://127.0.0.1:18000/v1 (рекомендовано) |
| Ідентифікатор моделі | deepseek-v4-flash |
| Виклики інструментів | tools / tool_calls у стилі OpenAI |
| Міркування | thinking і reasoning_effort у стилі DeepSeek |
Вимоги
- macOS із підтримкою Metal.
- Робоча копія репозиторію ds4 із
ds4-serverі файлом GGUF DeepSeek V4 Flash. - Достатньо пам’яті для вибраного контексту; більші значення
--ctxвиділяють більше KV-пам’яті під час запуску сервера.
Швидкий початок
Start ds4-server
Замініть <DS4_DIR> шляхом до вашої робочої копії ds4.
Verify the OpenAI-compatible endpoint
Відповідь має містити deepseek-v4-flash.
Add the OpenClaw provider config
Додайте конфігурацію з розділу Повна конфігурація, а потім виконайте одноразову перевірку моделі:
Повна конфігурація
Використовуйте цю конфігурацію, якщо ds4 уже працює на 127.0.0.1:18000.
Узгоджуйте contextWindow із ds4-server --ctx. Узгоджуйте maxTokens
із --tokens, якщо ви навмисно не хочете, щоб OpenClaw запитував менше вихідних даних,
ніж визначено стандартним значенням сервера.
Запуск на вимогу
OpenClaw може запускати ds4 лише тоді, коли вибрано модель ds4/.... Додайте
localService до того самого запису постачальника:
command має бути абсолютним шляхом до виконуваного файла. Пошук через оболонку та розгортання ~
не використовуються. Опис усіх полів localService див. у розділі
Локальні служби моделей.
Think Max
ds4 застосовує Think Max лише тоді, коли виконуються обидві умови:
ds4-serverзапускається з--ctx 393216або більшим значенням.- Запит використовує
reasoning_effort: "max"(або еквівалентне поле зусилля ds4).
Якщо ви використовуєте такий великий контекст, оновіть і прапорці сервера, і метадані моделі OpenClaw:
Тестування
Пряма перевірка HTTP в обхід OpenClaw:
Маршрутизація моделі OpenClaw (та сама перевірка, що й у швидкому початку):
Повний димовий тест агента та виклику інструментів із контекстом щонайменше 32768:
Очікуваний результат:
executionTrace.winnerProviderмає значенняds4executionTrace.winnerModelмає значенняdeepseek-v4-flashtoolSummary.callsстановить щонайменше1finalAssistantVisibleTextпочинається зtool-ok
Усунення несправностей
curl /v1/models cannot connect
ds4 не запущено або він не прив’язаний до хоста чи порту, указаного в baseUrl. Запустіть
ds4-server, а потім повторіть спробу:
500 prompt exceeds context
Налаштоване значення --ctx замале для ходу OpenClaw. Збільште
ds4-server --ctx, а потім відповідно оновіть models.providers.ds4.models[].contextWindow.
Повні ходи агента з інструментами потребують значно більшого контексту, ніж
прямий запит curl з одним повідомленням.
Think Max does not activate
ds4 використовує Think Max лише тоді, коли --ctx становить щонайменше 393216, а запит
вимагає reasoning_effort: "max". За меншого контексту використовується високий
рівень міркування.
The first request is slow
ds4 має фазу холодного розміщення в Metal і прогрівання моделі. Установіть
localService.readyTimeoutMs: 300000, коли OpenClaw запускає сервер
на вимогу.
Пов’язані матеріали
Запускайте локальні сервери моделей на вимогу перед запитами до моделей.
Вибирайте й використовуйте локальні бекенди моделей.
Налаштовуйте посилання на постачальників, автентифікацію та перемикання після відмови.
Власна поведінка постачальника DeepSeek і засоби керування міркуванням.