Tools

Afbeeldingen genereren

De tool image_generate maakt en bewerkt afbeeldingen via je geconfigureerde providers. In chatsessies wordt de tool asynchroon uitgevoerd: OpenClaw registreert een achtergrondtaak, retourneert onmiddellijk de taak-id en wekt de agent wanneer de provider klaar is. De voltooiingsagent volgt de normale modus voor zichtbare antwoorden van de sessie: automatische aflevering van het definitieve antwoord indien geconfigureerd, of message(action="send") wanneer de sessie de berichtentool vereist. Als de sessie van de aanvrager inactief is of het actief wekken ervan mislukt, verzendt OpenClaw een idempotente directe fallback met de gegenereerde afbeeldingen, zodat het resultaat niet verloren gaat.

Snel aan de slag

  • Authenticatie configureren

    Stel een API-sleutel in voor ten minste één provider (bijvoorbeeld OPENAI_API_KEY, GEMINI_API_KEY, OPENROUTER_API_KEY) of meld je aan met OpenAI Codex OAuth.

  • Een standaardmodel kiezen (optioneel)

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "openai/gpt-image-2",        timeoutMs: 180_000,      },    },  },}

    ChatGPT/Codex OAuth gebruikt dezelfde modelverwijzing openai/gpt-image-2. Wanneer een OAuth-profiel openai is geconfigureerd, routeert OpenClaw afbeeldingsverzoeken via dat OAuth-profiel in plaats van eerst OPENAI_API_KEY te proberen. Expliciete configuratie van models.providers.openai (API-sleutel, aangepaste/Azure-basis-URL) schakelt weer over op de directe route via de OpenAI Images API.

  • De agent een opdracht geven

    "Genereer een afbeelding van een vriendelijke robotmascotte."

    De agent roept image_generate automatisch aan. Er is geen toelatingslijst voor tools nodig: de tool is standaard ingeschakeld wanneer een provider beschikbaar is. De tool retourneert een id van een achtergrondtaak, waarna de voltooiingsagent de gegenereerde bijlage via de tool message verzendt zodra deze gereed is.

  • Veelgebruikte routes

    Doel Modelverwijzing Authenticatie
    OpenAI-afbeeldingen genereren met API-facturering openai/gpt-image-2 OPENAI_API_KEY
    OpenAI-afbeeldingen genereren met Codex-abonnementsauthenticatie openai/gpt-image-2 OpenAI ChatGPT/Codex OAuth
    OpenAI PNG/WebP met transparante achtergrond openai/gpt-image-1.5 OPENAI_API_KEY of OpenAI Codex OAuth
    Afbeeldingen genereren met DeepInfra deepinfra/black-forest-labs/FLUX-1-schnell DEEPINFRA_API_KEY
    Expressieve/stijlgestuurde generatie met fal Krea 2 fal/krea/v2/medium/text-to-image FAL_KEY
    Afbeeldingen genereren met OpenRouter openrouter/google/gemini-3.1-flash-image-preview OPENROUTER_API_KEY
    Afbeeldingen genereren met LiteLLM litellm/gpt-image-2 LITELLM_API_KEY
    MAI-afbeeldingen genereren met Microsoft Foundry microsoft-foundry/<deployment-name> AZURE_OPENAI_API_KEY of Entra ID
    Afbeeldingen genereren met Google Gemini google/gemini-3.1-flash-image GEMINI_API_KEY of GOOGLE_API_KEY

    Dezelfde tool verwerkt tekst-naar-afbeelding en bewerking met referentieafbeeldingen. Gebruik image voor één referentie of images voor meerdere. Voor Krea 2-modellen op fal worden deze referenties verzonden als stijlreferenties in plaats van als invoer voor bewerking. Door de provider ondersteunde uitvoeraanwijzingen, zoals quality, outputFormat en background, worden doorgestuurd wanneer ze beschikbaar zijn en als genegeerd gemeld wanneer een provider geen ondersteuning declareert. De meegeleverde ondersteuning voor transparante achtergronden is specifiek voor OpenAI; andere providers kunnen PNG-alfa nog steeds behouden als hun backend deze uitvoert.

    Ondersteunde providers

    Provider Standaardmodel Ondersteuning voor bewerken Authenticatie
    ComfyUI workflow Ja (1 afbeelding, via workflow geconfigureerd) COMFY_API_KEY of COMFY_CLOUD_API_KEY voor cloud
    DeepInfra black-forest-labs/FLUX-1-schnell Ja (1 afbeelding) DEEPINFRA_API_KEY
    fal fal-ai/flux/dev Ja (modelspecifieke limieten) FAL_KEY
    Google gemini-3.1-flash-image Ja (maximaal 5 afbeeldingen) GEMINI_API_KEY of GOOGLE_API_KEY
    LiteLLM gpt-image-2 Ja (maximaal 5 invoerafbeeldingen) LITELLM_API_KEY
    Microsoft Foundry <deployment-name> Ja (alleen MAI-Image-2.5-modellen) AZURE_OPENAI_API_KEY of Entra ID (az login)
    MiniMax image-01 Ja (onderwerpreferentie) MINIMAX_API_KEY of MiniMax OAuth (minimax-portal)
    OpenAI gpt-image-2 Ja (maximaal 5 afbeeldingen) OPENAI_API_KEY of OpenAI ChatGPT/Codex OAuth
    OpenRouter google/gemini-3.1-flash-image-preview Ja (maximaal 5 invoerafbeeldingen) OPENROUTER_API_KEY
    Vydra grok-imagine Nee VYDRA_API_KEY
    xAI grok-imagine-image Ja (maximaal 3 afbeeldingen) XAI_API_KEY

    Gebruik action: "list" om tijdens runtime beschikbare providers en modellen te bekijken:

    text
    /tool image_generate action=list

    Gebruik action: "status" om de actieve taak voor het genereren van afbeeldingen voor de huidige sessie te bekijken:

    text
    /tool image_generate action=status

    Providermogelijkheden

    Mogelijkheid ComfyUI DeepInfra fal Google Microsoft Foundry MiniMax OpenAI Vydra xAI
    Genereren (maximumaantal) 1 4 4 4 1 9 4 1 4
    Bewerken/referentie 1 afbeelding (workflow) 1 afbeelding Flux: 1; GPT: 10; Krea-stijlreferenties: 10; NB2: 14 Maximaal 5 afbeeldingen 1 afbeelding 1 afbeelding (onderwerpreferentie) Maximaal 5 afbeeldingen - Maximaal 3 afbeeldingen
    Grootteregeling - - Maximaal 4K - -
    Beeldverhouding - - - - -
    Resolutie (1K/2K/4K) - - - - - - 1K, 2K

    Toolparameters

    promptstringrequired

    Prompt voor het genereren van afbeeldingen. Vereist voor action: "generate".

    action"generate" | "status" | "list"default: generate

    Gebruik "status" om de actieve sessietaak te bekijken of "list" om tijdens runtime beschikbare providers en modellen te bekijken.

    modelstring

    Overschrijving van provider/model (bijvoorbeeld openai/gpt-image-2). Gebruik openai/gpt-image-1.5 voor transparante OpenAI-achtergronden.

    imagestring

    Pad of URL van één referentieafbeelding voor de bewerkingsmodus.

    imagesstring[]

    Meerdere referentieafbeeldingen voor de bewerkingsmodus of modellen met stijlreferenties (maximaal 14 via de gedeelde tool; providerspecifieke limieten blijven van toepassing).

    sizestring

    Grootteaanwijzing: 1024x1024, 1536x1024, 1024x1536, 2048x2048, 3840x2160.

    aspectRatiostring

    Beeldverhouding: 1:1, 2:1, 20:9, 19.5:9, 2:3, 3:2, 2.35:1, 3:4, 4:3, 4:5, 5:4, 9:16, 9:19.5, 9:20, 16:9, 21:9, 1:2, 4:1, 1:4, 8:1, 1:8. Providers valideren hun modelspecifieke subset.

    resolution"1K" | "2K" | "4K"
    quality"low" | "medium" | "high" | "auto"

    Kwaliteitsaanwijzing wanneer de provider deze ondersteunt.

    outputFormat"png" | "jpeg" | "webp"

    Aanwijzing voor de uitvoerindeling wanneer de provider deze ondersteunt.

    background"transparent" | "opaque" | "auto"

    Achtergrondaanwijzing wanneer de provider deze ondersteunt. Gebruik transparent met outputFormat: "png" of "webp" voor providers die transparantie ondersteunen.

    countnumber
    timeoutMsnumber

    Optionele time-out voor providerverzoeken in milliseconden. Wanneer Codex image_generate aanroept via dynamische tools, overschrijft deze waarde per aanroep nog steeds de geconfigureerde standaardwaarde en wordt deze begrensd op 600000 ms.

    filenamestring
    openaiobject

    Alleen voor OpenAI geldende aanwijzingen: background, moderation, outputCompression en user.

    fal.creativity"raw" | "low" | "medium" | "high"

    Creativiteitsregeling voor fal Krea 2. Standaard is medium.

    Configuratie

    Modelselectie

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "openai/gpt-image-2",        timeoutMs: 180_000,        fallbacks: [          "openrouter/google/gemini-3.1-flash-image-preview",          "google/gemini-3.1-flash-image",          "fal/fal-ai/flux/dev",        ],      },    },  },}

    Selectievolgorde van providers

    OpenClaw probeert providers in deze volgorde:

    1. model-parameter uit de toolaanroep (als de agent er een opgeeft).
    2. imageGenerationModel.primary uit de configuratie.
    3. imageGenerationModel.fallbacks in volgorde.
    4. Automatische detectie - alleen standaardproviders met geconfigureerde authenticatie:
      • eerst de huidige standaardprovider;
      • daarna de overige geregistreerde providers voor afbeeldingsgeneratie, gesorteerd op provider-id.

    Als een provider mislukt (authenticatiefout, snelheidslimiet enzovoort), wordt de volgende geconfigureerde kandidaat automatisch geprobeerd. Als alle kandidaten mislukken, bevat de fout details van elke poging.

    Modeloverschrijvingen per aanroep zijn exact

    Een model-overschrijving per aanroep probeert alleen die provider/dat model en gaat niet verder met de geconfigureerde primaire provider, fallbackprovider of automatisch gedetecteerde providers.

    Automatische detectie houdt rekening met authenticatie

    Een standaardprovider wordt alleen aan de kandidatenlijst toegevoegd wanneer OpenClaw daadwerkelijk bij die provider kan authenticeren. Automatische fallback tussen geauthenticeerde providers is altijd ingeschakeld; een model per aanroep blijft doorslaggevend.

    Time-outs

    Stel agents.defaults.mediaModels.image.timeoutMs in voor trage backends voor afbeeldingen. Een timeoutMs-toolparameter per aanroep overschrijft de geconfigureerde standaardwaarde, en geconfigureerde standaardwaarden overschrijven de door de Plugin opgegeven standaardwaarden van de provider. Door Google en OpenRouter gehoste afbeeldingsproviders gebruiken standaard 180 seconden; afbeeldingsgeneratie van Microsoft Foundry MAI, xAI en Azure OpenAI gebruikt 600 seconden. Dynamische toolaanroepen van Codex gebruiken standaard een image_generate-brugtime-out van 120 seconden en respecteren hetzelfde geconfigureerde time-outbudget, begrensd door het maximum van 600000 ms voor de dynamische-toolbrug van OpenClaw.

    Inspecteren tijdens runtime

    Gebruik action: "list" om de momenteel geregistreerde providers, hun standaardmodellen en hints voor authenticatieomgevingsvariabelen te inspecteren.

    Afbeeldingen bewerken

    OpenAI, OpenRouter, Google, DeepInfra, fal, Microsoft Foundry, MiniMax, ComfyUI en xAI ondersteunen het bewerken van referentieafbeeldingen. Krea 2-modellen op fal gebruiken dezelfde velden image / images als stijlreferenties in plaats van bewerkingsinvoer. Geef een pad of URL van een referentieafbeelding door:

    text
    "Genereer een aquarelversie van deze foto" + image: "/path/to/photo.jpg"

    OpenAI, OpenRouter en Google ondersteunen maximaal 5 referentieafbeeldingen via de parameter images; xAI ondersteunt er maximaal 3. fal ondersteunt 1 referentieafbeelding voor Flux-afbeelding-naar-afbeelding, maximaal 10 voor GPT Image 2-bewerkingen, maximaal 10 stijlreferenties voor Krea 2 en maximaal 14 voor Nano Banana 2-bewerkingen. Microsoft Foundry, MiniMax en ComfyUI ondersteunen er 1.

    Providers uitgelicht

    OpenAI gpt-image-2 (en gpt-image-1.5)

    Afbeeldingsgeneratie van OpenAI gebruikt standaard openai/gpt-image-2. Als een openai-OAuth-profiel is geconfigureerd, hergebruikt OpenClaw hetzelfde OAuth-profiel dat door Codex-chatmodellen met abonnement wordt gebruikt en stuurt het afbeeldingsverzoek via de Codex Responses-backend. Verouderde Codex-basis-URL's, zoals https://chatgpt.com/backend-api, worden voor afbeeldingsverzoeken gecanonicaliseerd naar https://chatgpt.com/backend-api/codex. OpenClaw valt voor dat verzoek niet stilzwijgend terug op OPENAI_API_KEY - om routering rechtstreeks via de OpenAI Images API af te dwingen, configureer je models.providers.openai expliciet met een API-sleutel, aangepaste basis-URL of Azure-eindpunt.

    De modellen openai/gpt-image-1.5, openai/gpt-image-1 en openai/gpt-image-1-mini kunnen nog steeds expliciet worden geselecteerd. Gebruik gpt-image-1.5 voor PNG/WebP-uitvoer met transparante achtergrond; de huidige gpt-image-2-API weigert background: "transparent".

    gpt-image-2 ondersteunt zowel tekst-naar-afbeeldinggeneratie als het bewerken van referentieafbeeldingen via dezelfde image_generate-tool. OpenClaw stuurt prompt, count, size, quality, outputFormat en referentieafbeeldingen door naar OpenAI. OpenAI ontvangt aspectRatio en resolution niet rechtstreeks; waar mogelijk zet OpenClaw deze om naar een ondersteunde size, anders meldt de tool ze als genegeerde overschrijvingen.

    OpenAI-specifieke opties staan onder het object openai:

    json
    {  "quality": "low",  "outputFormat": "jpeg",  "openai": {    "background": "opaque",    "moderation": "low",    "outputCompression": 60,    "user": "end-user-42"  }}

    openai.background accepteert transparent, opaque of auto; transparante uitvoer vereist outputFormat png of webp en een OpenAI-afbeeldingsmodel dat transparantie ondersteunt. OpenClaw routeert standaard gpt-image-2-verzoeken met een transparante achtergrond naar gpt-image-1.5. openai.outputCompression geldt voor JPEG/WebP-uitvoer en wordt genegeerd voor PNG-uitvoer.

    De hint background op het hoogste niveau is providerneutraal en wordt momenteel toegewezen aan hetzelfde OpenAI-verzoekveld background wanneer de OpenAI-provider is geselecteerd. Providers die geen ondersteuning voor achtergronden declareren, retourneren deze in ignoredOverrides in plaats van de niet-ondersteunde parameter te ontvangen.

    Als je afbeeldingsgeneratie van OpenAI via een Azure OpenAI-implementatie wilt routeren in plaats van via api.openai.com, raadpleeg je Azure OpenAI-eindpunten.

    Microsoft Foundry MAI-afbeeldingsmodellen

    Afbeeldingsgeneratie van Microsoft Foundry gebruikt de namen van geïmplementeerde MAI-afbeeldingsimplementaties onder het providerprefix microsoft-foundry/. Er is geen standaardmodel op providerniveau, omdat de MAI-API de naam van jouw implementatie verwacht in het veld model:

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "microsoft-foundry/<deployment-name>",        timeoutMs: 600_000,      },    },  },}

    De provider gebruikt de MAI-API van Microsoft Foundry, niet de OpenAI Images API:

    • Generatie-eindpunt: /mai/v1/images/generations
    • Bewerkingseindpunt: /mai/v1/images/edits
    • Authenticatie: AZURE_OPENAI_API_KEY / API-sleutel van de provider, of Entra ID via az login
    • Uitvoer: één PNG-afbeelding
    • Grootte: standaard 1024x1024; breedte en hoogte moeten elk minimaal 768 px zijn, en het totale aantal pixels mag maximaal 1.048.576 zijn
    • Bewerkingen: één PNG- of JPEG-referentieafbeelding, alleen ondersteund door implementaties van MAI-Image-2.5-Flash en MAI-Image-2.5

    Generatie met alleen een prompt kan een aangepaste implementatienaam gebruiken wanneer alleen het Foundry-eindpunt is geconfigureerd. Voor bewerkingen met aangepaste implementatienamen zijn onboarding-/modelmetadata nodig, zodat OpenClaw kan verifiëren dat de implementatie wordt ondersteund door MAI-Image-2.5-Flash of MAI-Image-2.5.

    De huidige MAI-afbeeldingsmodellen zijn MAI-Image-2.5-Flash, MAI-Image-2.5, MAI-Image-2e en MAI-Image-2. Zie Microsoft Foundry-Plugin voor configuratie en het gedrag van chatmodellen.

    OpenRouter-afbeeldingsmodellen

    Afbeeldingsgeneratie van OpenRouter gebruikt dezelfde OPENROUTER_API_KEY en wordt gerouteerd via de afbeeldings-API voor chatvoltooiingen van OpenRouter. Selecteer OpenRouter-afbeeldingsmodellen met het prefix openrouter/:

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "openrouter/google/gemini-3.1-flash-image-preview",      },    },  },}

    OpenClaw stuurt prompt, count, referentieafbeeldingen en Gemini-compatibele hints voor aspectRatio / resolution door naar OpenRouter. De huidige ingebouwde snelkoppelingen voor OpenRouter-afbeeldingsmodellen omvatten google/gemini-3.1-flash-image, google/gemini-3-pro-image en openai/gpt-5.4-image-2. Gebruik action: "list" om te zien wat je geconfigureerde Plugin beschikbaar stelt.

    fal Krea 2

    Krea 2-modellen op fal gebruiken het systeemeigen Krea-schema van fal in plaats van het algemene image_size-schema dat Flux gebruikt. OpenClaw verzendt:

    • aspect_ratio voor hints voor de beeldverhouding
    • creativity, standaard ingesteld op medium
    • image_style_references wanneer image of images wordt opgegeven

    Selecteer Krea 2 Medium voor snellere, expressieve illustraties en Krea 2 Large voor tragere, gedetailleerdere fotorealistische en gestructureerde resultaten:

    json5
    {  agents: {    defaults: {      imageGenerationModel: {        primary: "fal/krea/v2/medium/text-to-image",      },    },  },}

    Krea 2 retourneert momenteel één afbeelding per verzoek. Geef voor Krea de voorkeur aan aspectRatio; OpenClaw wijst size toe aan de dichtstbijzijnde ondersteunde Krea-beeldverhouding en weigert resolution voor Krea in plaats van deze weg te laten. Gebruik fal.creativity wanneer je een systeemeigen Krea-creativiteitsniveau wilt:

    json
    {  "model": "fal/krea/v2/medium/text-to-image",  "prompt": "Een cyberzineportret met risograaftextuur",  "aspectRatio": "9:16",  "fal": {    "creativity": "high"  }}
    Dubbele authenticatie van MiniMax

    Afbeeldingsgeneratie van MiniMax is beschikbaar via beide gebundelde authenticatiepaden van MiniMax:

    • minimax/image-01 voor configuraties met API-sleutel
    • minimax-portal/image-01 voor configuraties met OAuth
    xAI grok-imagine-image

    De gebundelde xAI-provider gebruikt /v1/images/generations voor verzoeken met alleen een prompt en /v1/images/edits wanneer image of images aanwezig is.

    • Modellen: xai/grok-imagine-image, xai/grok-imagine-image-quality
    • Aantal: maximaal 4
    • Referenties: één image of maximaal drie images
    • Beeldverhoudingen: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, 19.5:9, 9:19.5, 20:9, 9:20
    • Resoluties: 1K, 2K
    • Uitvoer: geretourneerd als door OpenClaw beheerde afbeeldingsbijlagen

    OpenClaw stelt de systeemeigen xAI-opties quality, mask, user en de beeldverhouding auto bewust niet beschikbaar totdat deze besturingselementen deel uitmaken van het gedeelde provideroverschrijdende image_generate-contract.

    Voorbeelden

    Genereren (4K-landschap)

    text
    /tool image_generate action=generate model=openai/gpt-image-2 prompt="Een strakke redactionele poster voor afbeeldingsgeneratie met OpenClaw" size=3840x2160 count=1

    Genereren (transparante PNG)

    text
    /tool image_generate action=generate model=openai/gpt-image-1.5 prompt="Een eenvoudige rode cirkelsticker op een transparante achtergrond" outputFormat=png background=transparent

    Gelijkwaardige CLI:

    bash
    openclaw infer image generate \--model openai/gpt-image-1.5 \--output-format png \--background transparent \--prompt "Een eenvoudige rode cirkelsticker op een transparante achtergrond" \--json

    Genereren (lage OpenAI-kwaliteit)

    text
    /tool image_generate action=generate model=openai/gpt-image-2 prompt="Goedkoop concept voor een poster voor een rustige productiviteitsapp" quality=low openai='{"moderation":"low"}'

    Gelijkwaardige CLI:

    bash
    openclaw infer image generate \--model openai/gpt-image-2 \--quality low \--openai-moderation low \--prompt "Voordelige conceptposter voor een rustige productiviteitsapp" \--json

    Genereren (twee vierkante afbeeldingen)

    text
    /tool image_generate action=generate model=openai/gpt-image-2 prompt="Twee visuele richtingen voor het pictogram van een rustige productiviteitsapp" size=1024x1024 count=2

    Bewerken (één referentie)

    text
    /tool image_generate action=generate model=openai/gpt-image-2 prompt="Behoud het onderwerp en vervang de achtergrond door een heldere studio-opstelling" image=/path/to/reference.png size=1024x1536

    Bewerken (meerdere referenties)

    text
    /tool image_generate action=generate model=openai/gpt-image-2 prompt="Combineer de identiteit van het personage uit de eerste afbeelding met het kleurenpalet uit de tweede" images='["/path/to/character.png","/path/to/palette.jpg"]' size=1536x1024

    Krea-stijlreferenties

    text
    /tool image_generate action=generate model=fal/krea/v2/medium/text-to-image prompt="Een expressief redactioneel portret met dit kleurenpalet en deze druktextuur" images='["/path/to/palette.png","/path/to/texture.jpg"]' aspectRatio=9:16 fal='{"creativity":"high"}'

    Dezelfde vlaggen --output-format, --background, --quality en --openai-moderation zijn beschikbaar voor openclaw infer image edit; --openai-background blijft beschikbaar als een OpenAI-specifieke alias. Gebundelde providers anders dan OpenAI bieden momenteel geen expliciete achtergrondregeling, waardoor background: "transparent" voor deze providers als genegeerd wordt gemeld.

    Gerelateerd

    • Overzicht van tools - alle beschikbare agenttools
    • ComfyUI - workflowconfiguratie voor lokale ComfyUI en Comfy Cloud
    • fal - configuratie van fal als provider voor afbeeldingen en video
    • Google (Gemini) - configuratie van Gemini als afbeeldingsprovider
    • Microsoft Foundry-plugin - configuratie van Microsoft Foundry-chat en MAI-afbeeldingen
    • MiniMax - configuratie van MiniMax als afbeeldingsprovider
    • OpenAI - configuratie van OpenAI Images als provider
    • Vydra - configuratie van Vydra voor afbeeldingen, video en spraak
    • xAI - configuratie van Grok voor afbeeldingen, video, zoeken, code-uitvoering en TTS
    • Configuratiereferentie - configuratie van imageGenerationModel
    • Modellen - modelconfiguratie en failover
    Was this useful?
    On this page

    On this page