Nesta página
Nesta página
Providers
ds4
ds4 disponibiliza o DeepSeek V4 Flash por meio de um backend
Metal local com uma API /v1 compatível com OpenAI. O OpenClaw se conecta ao ds4
por meio da família genérica de provedores openai-completions.
O ds4 não é um Plugin de provedor integrado ao OpenClaw. Configure-o em
models.providers.ds4 e selecione ds4/deepseek-v4-flash.
| Propriedade | Valor |
|---|---|
| ID do provedor | ds4 |
| Plugin | nenhum (somente configuração) |
| API | Chat Completions compatível com OpenAI (openai-completions) |
| URL base | http://127.0.0.1:18000/v1 (sugerida) |
| ID do modelo | deepseek-v4-flash |
| Chamadas de ferramentas | tools / tool_calls no estilo OpenAI |
| Raciocínio | thinking e reasoning_effort no estilo DeepSeek |
Requisitos
- macOS com suporte ao Metal.
- Um checkout funcional do ds4 com
ds4-servere o arquivo GGUF do DeepSeek V4 Flash. - Memória suficiente para o contexto escolhido; valores maiores de
--ctxalocam mais memória KV na inicialização do servidor.
Início rápido
Start ds4-server
Substitua <DS4_DIR> pelo caminho do seu checkout do ds4.
Verify the OpenAI-compatible endpoint
A resposta deve incluir deepseek-v4-flash.
Add the OpenClaw provider config
Adicione a configuração de Configuração completa e execute uma verificação pontual do modelo:
Configuração completa
Use esta configuração quando o ds4 já estiver em execução em 127.0.0.1:18000.
Mantenha contextWindow alinhado com ds4-server --ctx. Mantenha maxTokens alinhado
com --tokens, a menos que você queira intencionalmente que o OpenClaw solicite menos saída
do que o padrão do servidor.
Inicialização sob demanda
O OpenClaw pode iniciar o ds4 somente quando um modelo ds4/... for selecionado. Adicione
localService à mesma entrada do provedor:
command deve ser um caminho absoluto para um executável. A pesquisa no shell e a expansão de ~
não são usadas. Consulte Serviços de modelos locais para conhecer
todos os campos de localService.
Think Max
O ds4 aplica o Think Max somente quando ambas as condições são verdadeiras:
- O
ds4-serveré iniciado com--ctx 393216ou um valor maior. - A solicitação usa
reasoning_effort: "max"(ou o campo de esforço equivalente do ds4).
Se você executar com esse contexto grande, atualize tanto os sinalizadores do servidor quanto os metadados do modelo no OpenClaw:
Teste
Verificação HTTP direta, ignorando o OpenClaw:
Roteamento de modelo do OpenClaw (igual à verificação do início rápido):
Teste rápido completo do agente e das chamadas de ferramentas, com contexto de pelo menos 32768:
Resultado esperado:
executionTrace.winnerProvideréds4executionTrace.winnerModelédeepseek-v4-flashtoolSummary.callsé pelo menos1finalAssistantVisibleTextcomeça comtool-ok
Solução de problemas
curl /v1/models cannot connect
O ds4 não está em execução ou não está vinculado ao host/à porta em baseUrl. Inicie
o ds4-server e tente novamente:
500 prompt exceeds context
O --ctx configurado é pequeno demais para a interação do OpenClaw. Aumente
ds4-server --ctx e atualize models.providers.ds4.models[].contextWindow
para corresponder. Interações completas do agente com ferramentas precisam de muito mais contexto do que uma
solicitação direta de uma única mensagem com curl.
Think Max does not activate
O ds4 usa o Think Max somente quando --ctx é de pelo menos 393216 e a solicitação
pede reasoning_effort: "max". Contextos menores recorrem ao nível alto de
raciocínio.
The first request is slow
O ds4 passa por uma fase inicial de residência a frio no Metal e aquecimento do modelo. Defina
localService.readyTimeoutMs: 300000 quando o OpenClaw iniciar o servidor sob
demanda.
Relacionados
Inicie servidores de modelos locais sob demanda antes das solicitações de modelo.
Escolha e opere backends de modelos locais.
Configure referências de provedores, autenticação e failover.
Comportamento nativo do provedor DeepSeek e controles de raciocínio.