CLI commands
Inferentie-CLI
openclaw infer is de canonieke headless-interface voor door providers ondersteunde inferentie. Deze biedt capabilityfamilies (model, image, audio, tts, video, web, embedding), geen onbewerkte RPC-namen van de Gateway of tool-id's van agents. openclaw capability ... is een alias voor dezelfde commandostructuur.
Redenen om dit te verkiezen boven een eenmalige providerwrapper:
- Hergebruikt providers en modellen die al in OpenClaw zijn geconfigureerd.
- Stabiele
--json-envelop voor scripts en door agents aangestuurde automatisering (zie JSON-uitvoer). - Voert voor de meeste subcommando's het normale lokale pad uit zonder de Gateway.
- Voor end-to-end-providercontroles doorloopt het de meegeleverde CLI, het laden van configuratie, het bepalen van de standaardagent, het activeren van gebundelde plugins en de gedeelde capabilityruntime voordat het providerverzoek wordt verzonden.
Maak van infer een skill
Kopieer en plak dit naar een agent:
Lees https://docs.openclaw.ai/cli/infer en maak vervolgens een skill die mijn gebruikelijke workflows naar `openclaw infer` routeert.Richt je op modeluitvoeringen, beeldgeneratie, videogeneratie, audiotranscriptie, TTS, zoeken op het web en embeddings.Een goede op infer gebaseerde skill koppelt veelvoorkomende gebruikersintenties aan het juiste subcommando, bevat enkele canonieke voorbeelden per workflow, verkiest openclaw infer ... boven alternatieven op lager niveau en documenteert niet het volledige infer-oppervlak opnieuw in de hoofdtekst van de skill.
Commandostructuur
openclaw infer list inspect model run list inspect providers auth login auth logout auth status image generate edit describe describe-many providers audio transcribe providers tts convert voices providers personas status enable disable set-provider set-persona video generate describe providers web search fetch providers embedding create providersinfer list / infer inspect --name <capability> tonen deze structuur als gegevens (capability-id, transporten, beschrijving).
Veelvoorkomende taken
| Taak | Commando | Opmerkingen |
|---|---|---|
| Een tekst-/modelprompt uitvoeren | openclaw infer model run --prompt "..." --json |
Standaard lokaal |
| Een modelprompt op afbeeldingen uitvoeren | openclaw infer model run --prompt "Describe this" --file ./image.png --model provider/model |
Herhaal --file voor meerdere afbeeldingen |
| Een afbeelding genereren | openclaw infer image generate --prompt "..." --json |
Gebruik image edit wanneer je vanuit een bestaand bestand begint |
| Een afbeeldingsbestand of URL beschrijven | openclaw infer image describe --file ./image.png --prompt "..." --json |
--model moet een voor afbeeldingen geschikt <provider/model> zijn |
| Audio transcriberen | openclaw infer audio transcribe --file ./memo.m4a --json |
--model moet <provider/model> zijn |
| Spraak synthetiseren | openclaw infer tts convert --text "..." --output ./speech.mp3 --json |
tts status wordt alleen via de Gateway uitgevoerd |
| Een video genereren | openclaw infer video generate --prompt "..." --json |
Ondersteunt providerhints zoals --resolution |
| Een videobestand beschrijven | openclaw infer video describe --file ./clip.mp4 --json |
--model moet <provider/model> zijn |
| Zoeken op het web | openclaw infer web search --query "..." --json |
|
| Een webpagina ophalen | openclaw infer web fetch --url https://example.com --json |
|
| Embeddings maken | openclaw infer embedding create --text "..." --json |
Gedrag
- Gebruik
--jsonwanneer de uitvoer als invoer voor een ander commando of script dient; gebruik anders tekstuitvoer. - Gebruik
--providerof--model provider/modelom een specifieke backend vast te leggen. - Gebruik
model run --thinking <level>voor een eenmalige override voor denken/redeneren:off,minimal,low,medium,high,adaptive,xhighofmax. - Voor
image describe,audio transcribeenvideo describemoet--modelde vorm<provider/model>gebruiken. - Voor
image describeaccepteert--filelokale paden en HTTP(S)-URL's; externe URL's doorlopen het normale SSRF-beleid voor het ophalen van media. - Toestandsloze uitvoeringscommando's (
model run,image *,audio *,video *,web *,embedding *) zijn standaard lokaal. Door de Gateway beheerde toestandscommando's (tts status) gebruiken standaard de Gateway. - Voor het lokale pad hoeft de Gateway nooit actief te zijn.
- Lokale
model runis een gestroomlijnde, eenmalige providervoltooiing: deze bepaalt het geconfigureerde agentmodel en de authenticatie, maar start geen chatagentbeurt, laadt geen tools en opent geen gebundelde MCP-servers. model run --filevoegt afbeeldingsbestanden (met automatisch gedetecteerd MIME-type) aan de prompt toe; herhaal--filevoor meerdere afbeeldingen. Niet-afbeeldingsbestanden worden geweigerd — gebruik in plaats daarvaninfer audio transcribeofinfer video describe.model run --gatewaydoorloopt Gateway-routering, opgeslagen authenticatie, providerselectie en de ingebedde runtime, maar blijft een onbewerkte modelprobe: geen eerder sessietranscript, bootstrap-/AGENTS-context, tools of gebundelde MCP-servers.model run --gateway --model <provider/model>vereist een Gateway-referentie van een vertrouwde operator, omdat het de Gateway vraagt een eenmalige provider-/modeloverride uit te voeren.
Model
Tekstinferentie en inspectie van modellen/providers.
openclaw infer model run --prompt "Antwoord exact met: smoke-ok" --jsonopenclaw infer model run --prompt "Vat dit changelog-item samen" --model openai/gpt-5.4 --jsonopenclaw infer model run --prompt "Beschrijf deze afbeelding in één zin" --file ./photo.jpg --model google/gemini-2.5-flash --jsonopenclaw infer model run --prompt "Gebruik hier meer redeneervermogen" --thinking high --jsonopenclaw infer model providers --jsonopenclaw infer model inspect --model gpt-5.6-sol --jsonGebruik volledige <provider/model>-referenties met --local om één provider met een rooktest te controleren zonder de Gateway te starten of het tooloppervlak van de agent te laden:
openclaw infer model run --local --model anthropic/claude-sonnet-4-6 --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model cerebras/zai-glm-4.7 --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model google/gemini-2.5-flash --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model groq/llama-3.1-8b-instant --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model mistral/mistral-medium-3-5 --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model mistral/mistral-small-latest --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model openai/gpt-5.6-luna --prompt "Antwoord exact met: pong" --jsonopenclaw infer model run --local --model ollama/qwen2.5vl:7b --prompt "Beschrijf deze afbeelding." --file ./photo.jpg --jsonOpmerkingen:
- Lokale
model runis de meest gerichte CLI-rooktest voor de status van provider/model/authenticatie: voor providers anders dan ChatGPT-Codex wordt alleen de opgegeven prompt verzonden. - Lokale
model run --model <provider/model>kan exacte gebundelde rijen uit de statische catalogus bepalen (dezelfde rijen dieopenclaw models list --alltoont) voordat die provider naar de configuratie is geschreven. Providerauthenticatie blijft vereist; ontbrekende referenties veroorzaken authenticatiefouten, nietUnknown model. - Laat voor redeneerprobes met Mistral Medium 3.5 de temperatuur oningesteld/op de standaardwaarde. Mistral weigert
reasoning_effort="high"mettemperature: 0; gebruik de standaardtemperatuur of een waarde die niet nul is, zoals0.7. - Lokale probes met OpenAI ChatGPT/Codex OAuth (
openai-chatgpt-responses-API) voegen een minimale systeeminstructie toe, zodat het transport het vereiste veldinstructionskan invullen — zonder volledige agentcontext, tools, geheugen of sessietranscript. model run --filevoegt afbeeldingsinhoud rechtstreeks aan het afzonderlijke gebruikersbericht toe. Gangbare indelingen (PNG, JPEG, WebP) werken wanneer het MIME-type alsimage/*wordt gedetecteerd; niet-ondersteunde of niet-herkende bestanden mislukken voordat de provider wordt aangeroepen. Gebruik in plaats daarvaninfer image describewanneer je OpenClaws routering en fallbacks voor afbeeldingsmodellen wilt gebruiken in plaats van een rechtstreekse multimodale modelprobe.- Het geselecteerde model moet afbeeldingsinvoer ondersteunen; modellen die alleen tekst ondersteunen, kunnen het verzoek op providerniveau weigeren.
model run --promptmoet tekst bevatten die niet alleen uit witruimte bestaat; lege prompts worden geweigerd voordat een provider- of Gateway-aanroep plaatsvindt.- Lokale
model runwordt afgesloten met een andere waarde dan nul wanneer de provider geen tekstuitvoer retourneert, zodat onbereikbare providers en lege voltooiingen niet op geslaagde probes lijken. - Gebruik
model run --gatewayom Gateway-routering of de configuratie van de agentruntime te testen terwijl de modelinvoer onbewerkt blijft. Gebruikopenclaw agentof een chatinterface voor volledige agentcontext, tools, geheugen en sessietranscript. --thinking adaptivewordt gekoppeld aanmediumop het niveau van de voltooiingsruntime;--thinking maxwordt gekoppeld aanmaxvoor OpenAI-modellen die de ingebouwde maximale inspanning ondersteunen, en anders aanxhigh.model auth login,model auth logoutenmodel auth statusbeheren de opgeslagen authenticatiestatus van providers.
Afbeelding
Generatie, bewerking en beschrijving.
openclaw infer image generate --prompt "vriendelijke illustratie van een kreeft" --jsonopenclaw infer image generate --prompt "filmische productfoto van een koptelefoon" --jsonopenclaw infer image generate --model openai/gpt-image-1.5 --output-format png --background transparent --prompt "eenvoudige sticker met een rode cirkel op een transparante achtergrond" --jsonopenclaw infer image generate --model openai/gpt-image-2 --quality low --openai-moderation low --prompt "goedkoop concept voor een poster" --jsonopenclaw infer image generate --prompt "trage backend voor afbeeldingen" --timeout-ms 180000 --jsonopenclaw infer image edit --file ./logo.png --model openai/gpt-image-1.5 --output-format png --background transparent --prompt "behoud het logo en verwijder de achtergrond" --jsonopenclaw infer image edit --file ./poster.png --prompt "maak hiervan een verticale storyadvertentie" --size 2160x3840 --aspect-ratio 9:16 --resolution 4K --jsonopenclaw infer image describe --file ./photo.jpg --jsonopenclaw infer image describe --file https://example.com/photo.png --jsonopenclaw infer image describe --file ./receipt.jpg --prompt "Extraheer de verkoper, datum en het totaalbedrag" --jsonopenclaw infer image describe-many --file ./before.png --file ./after.png --prompt "Vergelijk de schermafbeeldingen en vermeld de zichtbare wijzigingen in de gebruikersinterface" --jsonopenclaw infer image describe --file ./ui-screenshot.png --model openai/gpt-5.4-mini --jsonopenclaw infer image describe --file ./photo.jpg --model ollama/qwen2.5vl:7b --prompt "Beschrijf de afbeelding in één zin" --timeout-ms 300000 --jsonOpmerkingen:
-
Gebruik
image editwanneer je begint met bestaande invoerbestanden;--size,--aspect-ratioof--resolutionvoegen geometrieaanwijzingen toe voor providers/modellen die deze ondersteunen. -
--output-format png --background transparentmet--model openai/gpt-image-1.5levert OpenAI PNG-uitvoer met een transparante achtergrond;--openai-backgroundis een OpenAI-specifieke alias voor dezelfde aanwijzing. Providers die geen ondersteuning voor achtergronden declareren, rapporteren dit als een genegeerde overschrijving (zieignoredOverridesin de JSON-envelop). -
--quality low|medium|high|autowerkt voor providers die aanwijzingen voor beeldkwaliteit ondersteunen, waaronder OpenAI. OpenAI accepteert ook--openai-moderation low|auto. -
image providers --jsonvermeldt welke gebundelde afbeeldingsproviders detecteerbaar, geconfigureerd en geselecteerd zijn, en welke mogelijkheden voor genereren/bewerken elke provider biedt. -
image generate --model <provider/model> --jsonis de meest gerichte live-rooktest voor wijzigingen in het genereren van afbeeldingen:bash openclaw infer image providers --jsonopenclaw infer image generate \ --model google/gemini-3.1-flash-image \ --prompt "Minimale vlakke testafbeelding: één blauw vierkant op een witte achtergrond, zonder tekst." \ --output ./openclaw-infer-image-smoke.png \ --jsonHet antwoord rapporteert
ok,provider,model,attemptsen de paden van de geschreven uitvoer. Wanneer--outputis ingesteld, kan de uiteindelijke extensie het door de provider geretourneerde MIME-type volgen. -
Gebruik voor
image describeenimage describe-many--promptvoor een taakspecifieke instructie (OCR, vergelijking, UI-inspectie, beknopte ondertiteling). -
Gebruik
--timeout-msvoor trage lokale visiemodellen of koude starts van Ollama. -
Voor
image describewordt eerst een expliciete--modeluitgevoerd (dit moet een voor afbeeldingen geschikt<provider/model>zijn), waarna geconfigureerdeagents.defaults.imageModel.fallbacksworden geprobeerd als die aanroep mislukt. Fouten bij het voorbereiden van de invoer (ontbrekend bestand, niet-ondersteunde URL) leiden tot een fout voordat een terugvalpoging plaatsvindt, en het model moet in de modelcatalogus of providerconfiguratie als geschikt voor afbeeldingen zijn aangemerkt. -
Haal voor lokale Ollama-visiemodellen eerst het model op en stel
OLLAMA_API_KEYin op een willekeurige tijdelijke waarde, bijvoorbeeldollama-local. Zie Ollama.
Audio
Bestandstranscriptie (geen realtime sessiebeheer).
openclaw infer audio transcribe --file ./memo.m4a --jsonopenclaw infer audio transcribe --file ./team-sync.m4a --language en --prompt "Concentreer je op namen en actiepunten" --jsonopenclaw infer audio transcribe --file ./memo.m4a --model openai/whisper-1 --json--model moet <provider/model> zijn.
TTS
Spraaksynthese en de status van TTS-providers/persona's.
openclaw infer tts convert --text "hallo van openclaw" --output ./hello.mp3 --jsonopenclaw infer tts convert --text "Je build is voltooid" --output ./build-complete.mp3 --jsonopenclaw infer tts providers --jsonopenclaw infer tts personas --jsonopenclaw infer tts status --jsonOpmerkingen:
tts statusondersteunt alleen--gateway(dit weerspiegelt de door de Gateway beheerde TTS-status).- Gebruik
tts providers,tts voices,tts personas,tts set-providerentts set-personaom TTS-gedrag te inspecteren en configureren.
Video
Genereren en beschrijven.
openclaw infer video generate --prompt "filmische zonsondergang boven de oceaan" --jsonopenclaw infer video generate --prompt "langzame droneopname boven een bosmeer" --resolution 768P --duration 6 --jsonopenclaw infer video describe --file ./clip.mp4 --jsonopenclaw infer video describe --file ./clip.mp4 --model openai/gpt-5.4-mini --jsonOpmerkingen:
video generateaccepteert--size,--aspect-ratio,--resolution,--duration,--audio,--watermarken--timeout-ms, die worden doorgestuurd naar de runtime voor het genereren van video's.--modelmoet<provider/model>zijn voorvideo describe.
Web
Zoeken en ophalen.
openclaw infer web search --query "OpenClaw-documentatie" --jsonopenclaw infer web search --query "OpenClaw infer-webproviders" --jsonopenclaw infer web fetch --url https://docs.openclaw.ai/cli/infer --jsonopenclaw infer web providers --jsonweb providers vermeldt beschikbare, geconfigureerde en geselecteerde providers voor zoeken en ophalen.
Insluiting
Vectorcreatie en inspectie van insluitingsproviders.
openclaw infer embedding create --text "vriendelijke kreeft" --jsonopenclaw infer embedding create --text "klantenserviceticket: vertraagde verzending" --model openai/text-embedding-3-large --jsonopenclaw infer embedding providers --jsonJSON-uitvoer
Infer-opdrachten normaliseren JSON-uitvoer onder een gedeelde envelop:
{ "ok": true, "capability": "image.generate", "transport": "local", "provider": "openai", "model": "gpt-image-2", "attempts": [], "outputs": []}Stabiele velden op het hoogste niveau:
okcapabilitytransportprovidermodelattemptsinputs(afbeeldingsbijlagen die met het verzoek zijn verzonden, indien van toepassing)outputsignoredOverrides(aanwijzingssleutels die een provider niet ondersteunt, indien van toepassing)error
Voor opdrachten voor gegenereerde media bevat outputs bestanden die door OpenClaw zijn geschreven. Gebruik voor automatisering de path, mimeType, size en eventuele mediaspecifieke afmetingen in die array, in plaats van door mensen leesbare stdout te parseren.
Veelvoorkomende valkuilen
# Foutopenclaw infer media image generate --prompt "vriendelijke kreeft" # Goedopenclaw infer image generate --prompt "vriendelijke kreeft"# Foutopenclaw infer audio transcribe --file ./memo.m4a --model whisper-1 --json # Goedopenclaw infer audio transcribe --file ./memo.m4a --model openai/whisper-1 --json