Tools
Afbeeldingen genereren
De tool image_generate maakt en bewerkt afbeeldingen via je geconfigureerde
providers. In chatsessies wordt de tool asynchroon uitgevoerd: OpenClaw registreert een
achtergrondtaak, retourneert onmiddellijk de taak-id en wekt de agent wanneer
de provider klaar is. De voltooiingsagent volgt de normale modus voor
zichtbare antwoorden van de sessie: automatische aflevering van het definitieve antwoord indien geconfigureerd, of
message(action="send") wanneer de sessie de berichtentool vereist. Als de
sessie van de aanvrager inactief is of het actief wekken ervan mislukt, verzendt OpenClaw een
idempotente directe fallback met de gegenereerde afbeeldingen, zodat het resultaat niet
verloren gaat.
Snel aan de slag
Authenticatie configureren
Stel een API-sleutel in voor ten minste één provider (bijvoorbeeld OPENAI_API_KEY,
GEMINI_API_KEY, OPENROUTER_API_KEY) of meld je aan met OpenAI Codex OAuth.
Een standaardmodel kiezen (optioneel)
{ agents: { defaults: { imageGenerationModel: { primary: "openai/gpt-image-2", timeoutMs: 180_000, }, }, },}ChatGPT/Codex OAuth gebruikt dezelfde modelverwijzing openai/gpt-image-2. Wanneer een
OAuth-profiel openai is geconfigureerd, routeert OpenClaw afbeeldingsverzoeken
via dat OAuth-profiel in plaats van eerst OPENAI_API_KEY te proberen.
Expliciete configuratie van models.providers.openai (API-sleutel, aangepaste/Azure-basis-URL)
schakelt weer over op de directe route via de OpenAI Images API.
De agent een opdracht geven
"Genereer een afbeelding van een vriendelijke robotmascotte."
De agent roept image_generate automatisch aan. Er is geen toelatingslijst voor tools
nodig: de tool is standaard ingeschakeld wanneer een provider beschikbaar is. De tool
retourneert een id van een achtergrondtaak, waarna de voltooiingsagent de
gegenereerde bijlage via de tool message verzendt zodra deze gereed is.
Veelgebruikte routes
| Doel | Modelverwijzing | Authenticatie |
|---|---|---|
| OpenAI-afbeeldingen genereren met API-facturering | openai/gpt-image-2 |
OPENAI_API_KEY |
| OpenAI-afbeeldingen genereren met Codex-abonnementsauthenticatie | openai/gpt-image-2 |
OpenAI ChatGPT/Codex OAuth |
| OpenAI PNG/WebP met transparante achtergrond | openai/gpt-image-1.5 |
OPENAI_API_KEY of OpenAI Codex OAuth |
| Afbeeldingen genereren met DeepInfra | deepinfra/black-forest-labs/FLUX-1-schnell |
DEEPINFRA_API_KEY |
| Expressieve/stijlgestuurde generatie met fal Krea 2 | fal/krea/v2/medium/text-to-image |
FAL_KEY |
| Afbeeldingen genereren met OpenRouter | openrouter/google/gemini-3.1-flash-image-preview |
OPENROUTER_API_KEY |
| Afbeeldingen genereren met LiteLLM | litellm/gpt-image-2 |
LITELLM_API_KEY |
| MAI-afbeeldingen genereren met Microsoft Foundry | microsoft-foundry/<deployment-name> |
AZURE_OPENAI_API_KEY of Entra ID |
| Afbeeldingen genereren met Google Gemini | google/gemini-3.1-flash-image |
GEMINI_API_KEY of GOOGLE_API_KEY |
Dezelfde tool verwerkt tekst-naar-afbeelding en bewerking met referentieafbeeldingen. Gebruik image
voor één referentie of images voor meerdere. Voor Krea 2-modellen op fal worden deze
referenties verzonden als stijlreferenties in plaats van als invoer voor bewerking.
Door de provider ondersteunde uitvoeraanwijzingen, zoals quality, outputFormat en
background, worden doorgestuurd wanneer ze beschikbaar zijn en als genegeerd gemeld wanneer een
provider geen ondersteuning declareert. De meegeleverde ondersteuning voor transparante achtergronden is
specifiek voor OpenAI; andere providers kunnen PNG-alfa nog steeds behouden als hun
backend deze uitvoert.
Ondersteunde providers
| Provider | Standaardmodel | Ondersteuning voor bewerken | Authenticatie |
|---|---|---|---|
| ComfyUI | workflow |
Ja (1 afbeelding, via workflow geconfigureerd) | COMFY_API_KEY of COMFY_CLOUD_API_KEY voor cloud |
| DeepInfra | black-forest-labs/FLUX-1-schnell |
Ja (1 afbeelding) | DEEPINFRA_API_KEY |
| fal | fal-ai/flux/dev |
Ja (modelspecifieke limieten) | FAL_KEY |
gemini-3.1-flash-image |
Ja (maximaal 5 afbeeldingen) | GEMINI_API_KEY of GOOGLE_API_KEY |
|
| LiteLLM | gpt-image-2 |
Ja (maximaal 5 invoerafbeeldingen) | LITELLM_API_KEY |
| Microsoft Foundry | <deployment-name> |
Ja (alleen MAI-Image-2.5-modellen) | AZURE_OPENAI_API_KEY of Entra ID (az login) |
| MiniMax | image-01 |
Ja (onderwerpreferentie) | MINIMAX_API_KEY of MiniMax OAuth (minimax-portal) |
| OpenAI | gpt-image-2 |
Ja (maximaal 5 afbeeldingen) | OPENAI_API_KEY of OpenAI ChatGPT/Codex OAuth |
| OpenRouter | google/gemini-3.1-flash-image-preview |
Ja (maximaal 5 invoerafbeeldingen) | OPENROUTER_API_KEY |
| Vydra | grok-imagine |
Nee | VYDRA_API_KEY |
| xAI | grok-imagine-image |
Ja (maximaal 3 afbeeldingen) | XAI_API_KEY |
Gebruik action: "list" om tijdens runtime beschikbare providers en modellen te bekijken:
/tool image_generate action=listGebruik action: "status" om de actieve taak voor het genereren van afbeeldingen voor de
huidige sessie te bekijken:
/tool image_generate action=statusProvidermogelijkheden
| Mogelijkheid | ComfyUI | DeepInfra | fal | Microsoft Foundry | MiniMax | OpenAI | Vydra | xAI | |
|---|---|---|---|---|---|---|---|---|---|
| Genereren (maximumaantal) | 1 | 4 | 4 | 4 | 1 | 9 | 4 | 1 | 4 |
| Bewerken/referentie | 1 afbeelding (workflow) | 1 afbeelding | Flux: 1; GPT: 10; Krea-stijlreferenties: 10; NB2: 14 | Maximaal 5 afbeeldingen | 1 afbeelding | 1 afbeelding (onderwerpreferentie) | Maximaal 5 afbeeldingen | - | Maximaal 3 afbeeldingen |
| Grootteregeling | - | ✓ | ✓ | ✓ | ✓ | - | Maximaal 4K | - | - |
| Beeldverhouding | - | - | ✓ | ✓ | - | ✓ | - | - | ✓ |
| Resolutie (1K/2K/4K) | - | - | ✓ | ✓ | - | - | - | - | 1K, 2K |
Toolparameters
promptstringrequiredPrompt voor het genereren van afbeeldingen. Vereist voor action: "generate".
action"generate" | "status" | "list"default: generateGebruik "status" om de actieve sessietaak te bekijken of "list" om
tijdens runtime beschikbare providers en modellen te bekijken.
modelstringOverschrijving van provider/model (bijvoorbeeld openai/gpt-image-2). Gebruik
openai/gpt-image-1.5 voor transparante OpenAI-achtergronden.
imagestringPad of URL van één referentieafbeelding voor de bewerkingsmodus.
imagesstring[]Meerdere referentieafbeeldingen voor de bewerkingsmodus of modellen met stijlreferenties (maximaal 14 via de gedeelde tool; providerspecifieke limieten blijven van toepassing).
sizestringGrootteaanwijzing: 1024x1024, 1536x1024, 1024x1536, 2048x2048, 3840x2160.
aspectRatiostringBeeldverhouding: 1:1, 2:1, 20:9, 19.5:9, 2:3, 3:2, 2.35:1, 3:4,
4:3, 4:5, 5:4, 9:16, 9:19.5, 9:20, 16:9, 21:9, 1:2, 4:1,
1:4, 8:1, 1:8. Providers valideren hun modelspecifieke subset.
resolution"1K" | "2K" | "4K"quality"low" | "medium" | "high" | "auto"Kwaliteitsaanwijzing wanneer de provider deze ondersteunt.
outputFormat"png" | "jpeg" | "webp"Aanwijzing voor de uitvoerindeling wanneer de provider deze ondersteunt.
background"transparent" | "opaque" | "auto"Achtergrondaanwijzing wanneer de provider deze ondersteunt. Gebruik transparent met
outputFormat: "png" of "webp" voor providers die transparantie ondersteunen.
countnumbertimeoutMsnumberOptionele time-out voor providerverzoeken in milliseconden. Wanneer Codex
image_generate aanroept via dynamische tools, overschrijft deze waarde per aanroep nog steeds
de geconfigureerde standaardwaarde en wordt deze begrensd op 600000 ms.
filenamestringopenaiobjectAlleen voor OpenAI geldende aanwijzingen: background, moderation, outputCompression en user.
fal.creativity"raw" | "low" | "medium" | "high"Creativiteitsregeling voor fal Krea 2. Standaard is medium.
Configuratie
Modelselectie
{ agents: { defaults: { imageGenerationModel: { primary: "openai/gpt-image-2", timeoutMs: 180_000, fallbacks: [ "openrouter/google/gemini-3.1-flash-image-preview", "google/gemini-3.1-flash-image", "fal/fal-ai/flux/dev", ], }, }, },}Selectievolgorde van providers
OpenClaw probeert providers in deze volgorde:
model-parameter uit de toolaanroep (als de agent er een opgeeft).imageGenerationModel.primaryuit de configuratie.imageGenerationModel.fallbacksin volgorde.- Automatische detectie - alleen standaardproviders met geconfigureerde authenticatie:
- eerst de huidige standaardprovider;
- daarna de overige geregistreerde providers voor afbeeldingsgeneratie, gesorteerd op provider-id.
Als een provider mislukt (authenticatiefout, snelheidslimiet enzovoort), wordt de volgende geconfigureerde kandidaat automatisch geprobeerd. Als alle kandidaten mislukken, bevat de fout details van elke poging.
Modeloverschrijvingen per aanroep zijn exact
Een model-overschrijving per aanroep probeert alleen die provider/dat model en gaat
niet verder met de geconfigureerde primaire provider, fallbackprovider of automatisch gedetecteerde providers.
Automatische detectie houdt rekening met authenticatie
Een standaardprovider wordt alleen aan de kandidatenlijst toegevoegd wanneer OpenClaw
daadwerkelijk bij die provider kan authenticeren. Automatische fallback tussen geauthenticeerde
providers is altijd ingeschakeld; een model per aanroep blijft doorslaggevend.
Time-outs
Stel agents.defaults.mediaModels.image.timeoutMs in voor trage backends voor
afbeeldingen. Een timeoutMs-toolparameter per aanroep overschrijft de geconfigureerde
standaardwaarde, en geconfigureerde standaardwaarden overschrijven de door de Plugin opgegeven
standaardwaarden van de provider. Door Google en OpenRouter gehoste afbeeldingsproviders gebruiken standaard
180 seconden; afbeeldingsgeneratie van Microsoft Foundry MAI, xAI en Azure OpenAI gebruikt
600 seconden. Dynamische toolaanroepen van Codex gebruiken standaard een image_generate-brugtime-out van
120 seconden en respecteren hetzelfde geconfigureerde time-outbudget, begrensd
door het maximum van 600000 ms voor de dynamische-toolbrug van OpenClaw.
Inspecteren tijdens runtime
Gebruik action: "list" om de momenteel geregistreerde providers,
hun standaardmodellen en hints voor authenticatieomgevingsvariabelen te inspecteren.
Afbeeldingen bewerken
OpenAI, OpenRouter, Google, DeepInfra, fal, Microsoft Foundry, MiniMax,
ComfyUI en xAI ondersteunen het bewerken van referentieafbeeldingen. Krea 2-modellen op fal gebruiken
dezelfde velden image / images als stijlreferenties in plaats van bewerkingsinvoer.
Geef een pad of URL van een referentieafbeelding door:
"Genereer een aquarelversie van deze foto" + image: "/path/to/photo.jpg"OpenAI, OpenRouter en Google ondersteunen maximaal 5 referentieafbeeldingen via de
parameter images; xAI ondersteunt er maximaal 3. fal ondersteunt 1 referentieafbeelding voor
Flux-afbeelding-naar-afbeelding, maximaal 10 voor GPT Image 2-bewerkingen, maximaal 10 stijlreferenties
voor Krea 2 en maximaal 14 voor Nano Banana 2-bewerkingen. Microsoft Foundry, MiniMax
en ComfyUI ondersteunen er 1.
Providers uitgelicht
OpenAI gpt-image-2 (en gpt-image-1.5)
Afbeeldingsgeneratie van OpenAI gebruikt standaard openai/gpt-image-2. Als een
openai-OAuth-profiel is geconfigureerd, hergebruikt OpenClaw hetzelfde
OAuth-profiel dat door Codex-chatmodellen met abonnement wordt gebruikt en stuurt het
afbeeldingsverzoek via de Codex Responses-backend. Verouderde Codex-basis-URL's,
zoals https://chatgpt.com/backend-api, worden voor afbeeldingsverzoeken gecanonicaliseerd naar
https://chatgpt.com/backend-api/codex. OpenClaw
valt voor dat verzoek niet stilzwijgend terug op OPENAI_API_KEY -
om routering rechtstreeks via de OpenAI Images API af te dwingen, configureer je
models.providers.openai expliciet met een API-sleutel, aangepaste basis-URL
of Azure-eindpunt.
De modellen openai/gpt-image-1.5, openai/gpt-image-1 en
openai/gpt-image-1-mini kunnen nog steeds expliciet worden geselecteerd. Gebruik
gpt-image-1.5 voor PNG/WebP-uitvoer met transparante achtergrond; de huidige
gpt-image-2-API weigert background: "transparent".
gpt-image-2 ondersteunt zowel tekst-naar-afbeeldinggeneratie als
het bewerken van referentieafbeeldingen via dezelfde image_generate-tool.
OpenClaw stuurt prompt, count, size, quality, outputFormat
en referentieafbeeldingen door naar OpenAI. OpenAI ontvangt
aspectRatio en resolution niet rechtstreeks; waar mogelijk zet OpenClaw
deze om naar een ondersteunde size, anders meldt de tool ze als
genegeerde overschrijvingen.
OpenAI-specifieke opties staan onder het object openai:
{ "quality": "low", "outputFormat": "jpeg", "openai": { "background": "opaque", "moderation": "low", "outputCompression": 60, "user": "end-user-42" }}openai.background accepteert transparent, opaque of auto;
transparante uitvoer vereist outputFormat png of webp en een
OpenAI-afbeeldingsmodel dat transparantie ondersteunt. OpenClaw routeert standaard
gpt-image-2-verzoeken met een transparante achtergrond naar gpt-image-1.5.
openai.outputCompression geldt voor JPEG/WebP-uitvoer en wordt genegeerd
voor PNG-uitvoer.
De hint background op het hoogste niveau is providerneutraal en wordt momenteel
toegewezen aan hetzelfde OpenAI-verzoekveld background wanneer de OpenAI-provider
is geselecteerd. Providers die geen ondersteuning voor achtergronden declareren, retourneren
deze in ignoredOverrides in plaats van de niet-ondersteunde parameter te ontvangen.
Als je afbeeldingsgeneratie van OpenAI via een Azure OpenAI-implementatie wilt routeren
in plaats van via api.openai.com, raadpleeg je
Azure OpenAI-eindpunten.
Microsoft Foundry MAI-afbeeldingsmodellen
Afbeeldingsgeneratie van Microsoft Foundry gebruikt de namen van geïmplementeerde MAI-afbeeldingsimplementaties
onder het providerprefix microsoft-foundry/. Er is geen standaardmodel op providerniveau,
omdat de MAI-API de naam van jouw implementatie verwacht in het veld
model:
{ agents: { defaults: { imageGenerationModel: { primary: "microsoft-foundry/<deployment-name>", timeoutMs: 600_000, }, }, },}De provider gebruikt de MAI-API van Microsoft Foundry, niet de OpenAI Images API:
- Generatie-eindpunt:
/mai/v1/images/generations - Bewerkingseindpunt:
/mai/v1/images/edits - Authenticatie:
AZURE_OPENAI_API_KEY/ API-sleutel van de provider, of Entra ID viaaz login - Uitvoer: één PNG-afbeelding
- Grootte: standaard
1024x1024; breedte en hoogte moeten elk minimaal 768 px zijn, en het totale aantal pixels mag maximaal 1.048.576 zijn - Bewerkingen: één PNG- of JPEG-referentieafbeelding, alleen ondersteund door
implementaties van
MAI-Image-2.5-FlashenMAI-Image-2.5
Generatie met alleen een prompt kan een aangepaste implementatienaam gebruiken wanneer alleen het
Foundry-eindpunt is geconfigureerd. Voor bewerkingen met aangepaste implementatienamen zijn
onboarding-/modelmetadata nodig, zodat OpenClaw kan verifiëren dat de implementatie
wordt ondersteund door MAI-Image-2.5-Flash of MAI-Image-2.5.
De huidige MAI-afbeeldingsmodellen zijn MAI-Image-2.5-Flash, MAI-Image-2.5,
MAI-Image-2e en MAI-Image-2. Zie
Microsoft Foundry-Plugin voor configuratie
en het gedrag van chatmodellen.
OpenRouter-afbeeldingsmodellen
Afbeeldingsgeneratie van OpenRouter gebruikt dezelfde OPENROUTER_API_KEY en
wordt gerouteerd via de afbeeldings-API voor chatvoltooiingen van OpenRouter. Selecteer
OpenRouter-afbeeldingsmodellen met het prefix openrouter/:
{ agents: { defaults: { imageGenerationModel: { primary: "openrouter/google/gemini-3.1-flash-image-preview", }, }, },}OpenClaw stuurt prompt, count, referentieafbeeldingen en
Gemini-compatibele hints voor aspectRatio / resolution door naar OpenRouter.
De huidige ingebouwde snelkoppelingen voor OpenRouter-afbeeldingsmodellen omvatten
google/gemini-3.1-flash-image,
google/gemini-3-pro-image en openai/gpt-5.4-image-2. Gebruik
action: "list" om te zien wat je geconfigureerde Plugin beschikbaar stelt.
fal Krea 2
Krea 2-modellen op fal gebruiken het systeemeigen Krea-schema van fal in plaats van het algemene
image_size-schema dat Flux gebruikt. OpenClaw verzendt:
aspect_ratiovoor hints voor de beeldverhoudingcreativity, standaard ingesteld opmediumimage_style_referenceswanneerimageofimageswordt opgegeven
Selecteer Krea 2 Medium voor snellere, expressieve illustraties en Krea 2 Large voor tragere, gedetailleerdere fotorealistische en gestructureerde resultaten:
{ agents: { defaults: { imageGenerationModel: { primary: "fal/krea/v2/medium/text-to-image", }, }, },}Krea 2 retourneert momenteel één afbeelding per verzoek. Geef voor Krea de voorkeur aan
aspectRatio; OpenClaw wijst size toe aan de dichtstbijzijnde ondersteunde Krea-beeldverhouding en
weigert resolution voor Krea in plaats van deze weg te laten. Gebruik fal.creativity
wanneer je een systeemeigen Krea-creativiteitsniveau wilt:
{ "model": "fal/krea/v2/medium/text-to-image", "prompt": "Een cyberzineportret met risograaftextuur", "aspectRatio": "9:16", "fal": { "creativity": "high" }}Dubbele authenticatie van MiniMax
Afbeeldingsgeneratie van MiniMax is beschikbaar via beide gebundelde authenticatiepaden van MiniMax:
minimax/image-01voor configuraties met API-sleutelminimax-portal/image-01voor configuraties met OAuth
xAI grok-imagine-image
De gebundelde xAI-provider gebruikt /v1/images/generations voor verzoeken
met alleen een prompt en /v1/images/edits wanneer image of images aanwezig is.
- Modellen:
xai/grok-imagine-image,xai/grok-imagine-image-quality - Aantal: maximaal 4
- Referenties: één
imageof maximaal drieimages - Beeldverhoudingen:
1:1,16:9,9:16,4:3,3:4,3:2,2:3,2:1,1:2,19.5:9,9:19.5,20:9,9:20 - Resoluties:
1K,2K - Uitvoer: geretourneerd als door OpenClaw beheerde afbeeldingsbijlagen
OpenClaw stelt de systeemeigen xAI-opties quality, mask,
user en de beeldverhouding auto bewust niet beschikbaar totdat deze besturingselementen deel uitmaken van het gedeelde
provideroverschrijdende image_generate-contract.
Voorbeelden
Genereren (4K-landschap)
/tool image_generate action=generate model=openai/gpt-image-2 prompt="Een strakke redactionele poster voor afbeeldingsgeneratie met OpenClaw" size=3840x2160 count=1Genereren (transparante PNG)
/tool image_generate action=generate model=openai/gpt-image-1.5 prompt="Een eenvoudige rode cirkelsticker op een transparante achtergrond" outputFormat=png background=transparentGelijkwaardige CLI:
openclaw infer image generate \--model openai/gpt-image-1.5 \--output-format png \--background transparent \--prompt "Een eenvoudige rode cirkelsticker op een transparante achtergrond" \--jsonGenereren (lage OpenAI-kwaliteit)
/tool image_generate action=generate model=openai/gpt-image-2 prompt="Goedkoop concept voor een poster voor een rustige productiviteitsapp" quality=low openai='{"moderation":"low"}'Gelijkwaardige CLI:
openclaw infer image generate \--model openai/gpt-image-2 \--quality low \--openai-moderation low \--prompt "Voordelige conceptposter voor een rustige productiviteitsapp" \--jsonGenereren (twee vierkante afbeeldingen)
/tool image_generate action=generate model=openai/gpt-image-2 prompt="Twee visuele richtingen voor het pictogram van een rustige productiviteitsapp" size=1024x1024 count=2Bewerken (één referentie)
/tool image_generate action=generate model=openai/gpt-image-2 prompt="Behoud het onderwerp en vervang de achtergrond door een heldere studio-opstelling" image=/path/to/reference.png size=1024x1536Bewerken (meerdere referenties)
/tool image_generate action=generate model=openai/gpt-image-2 prompt="Combineer de identiteit van het personage uit de eerste afbeelding met het kleurenpalet uit de tweede" images='["/path/to/character.png","/path/to/palette.jpg"]' size=1536x1024Krea-stijlreferenties
/tool image_generate action=generate model=fal/krea/v2/medium/text-to-image prompt="Een expressief redactioneel portret met dit kleurenpalet en deze druktextuur" images='["/path/to/palette.png","/path/to/texture.jpg"]' aspectRatio=9:16 fal='{"creativity":"high"}'Dezelfde vlaggen --output-format, --background, --quality en
--openai-moderation zijn beschikbaar voor openclaw infer image edit;
--openai-background blijft beschikbaar als een OpenAI-specifieke alias. Gebundelde providers
anders dan OpenAI bieden momenteel geen expliciete achtergrondregeling, waardoor
background: "transparent" voor deze providers als genegeerd wordt gemeld.
Gerelateerd
- Overzicht van tools - alle beschikbare agenttools
- ComfyUI - workflowconfiguratie voor lokale ComfyUI en Comfy Cloud
- fal - configuratie van fal als provider voor afbeeldingen en video
- Google (Gemini) - configuratie van Gemini als afbeeldingsprovider
- Microsoft Foundry-plugin - configuratie van Microsoft Foundry-chat en MAI-afbeeldingen
- MiniMax - configuratie van MiniMax als afbeeldingsprovider
- OpenAI - configuratie van OpenAI Images als provider
- Vydra - configuratie van Vydra voor afbeeldingen, video en spraak
- xAI - configuratie van Grok voor afbeeldingen, video, zoeken, code-uitvoering en TTS
- Configuratiereferentie - configuratie van
imageGenerationModel - Modellen - modelconfiguratie en failover