Providers

OpenAI

OpenClaw usa un único id de proveedor, openai, tanto para la autenticación directa con clave de API como para la autenticación mediante suscripción de ChatGPT/Codex. openai/* es la ruta de modelo canónica. Para los turnos del agente integrado cuya política de runtime no esté definida o sea auto, los datos de ruta de OpenAI determinan si OpenClaw puede seleccionar implícitamente el runtime incluido del servidor de aplicaciones de Codex. El prefijo openai/* por sí solo no selecciona ningún runtime.

  • Modelos de agente - openai/* mediante el runtime seleccionado por la configuración explícita agentRuntime o por la política de ruta implícita de OpenAI. Inicie sesión con la autenticación de Codex para usar una suscripción de ChatGPT/Codex, o configure un perfil de autenticación con clave de API si desea facturación basada en claves.
  • API de OpenAI ajenas al agente - acceso directo a OpenAI Platform, facturado por uso, mediante OPENAI_API_KEY o un perfil de autenticación con clave de API openai.
  • Configuración heredada - las referencias codex/* y openai-codex/* se reparan como openai/* más agentRuntime.id: "codex" con ámbito de modelo mediante openclaw doctor --fix.

OpenAI admite explícitamente el uso de OAuth de suscripción en herramientas y flujos de trabajo externos como OpenClaw.

Seguimiento del uso y los costes

OpenClaw mantiene separados la cuota de suscripción y la facturación de la API de Platform:

  • OAuth de ChatGPT/Codex muestra el plan de suscripción, los períodos de cuota y el saldo de créditos.
  • OPENAI_ADMIN_KEY muestra 30 días de costes de la organización y uso de completions informados por el proveedor en Uso de Control UI, incluidos el gasto diario, los totales de solicitudes/tokens, los modelos principales y las categorías de costes.
  • OPENAI_PROJECT_ID limita opcionalmente el historial de la Admin API a un proyecto.
  • OpenClaw nunca envía OPENAI_API_KEY ni un perfil de inferencia openai a las API de la organización; esas credenciales pueden pertenecer a endpoints personalizados, de Azure o locales del agente.

Una clave de administración explícita tiene prioridad sobre OAuth. El historial informado por el proveedor no se combina con el coste estimado por OpenClaw a partir de las sesiones; puede incluir actividad de la API procedente de otros clientes y ajustes de facturación del proveedor.

La documentación del panel de uso de la API de OpenAI describe los requisitos de ser propietario de la organización y contar con permisos explícitos del Usage Dashboard para acceder a los datos de uso.

El proveedor, el modelo, el runtime y el canal son capas independientes. Si esas etiquetas se están confundiendo, consulte Runtimes de agente antes de cambiar la configuración.

Elección rápida

Objetivo Usar Notas
Suscripción de ChatGPT/Codex, runtime nativo de Codex openai/gpt-5.6-sol Configuración de suscripción nueva; inicie sesión con la autenticación de Codex.
Facturación directa con clave de API para turnos del agente openai/gpt-5.6 más un perfil de autenticación con clave de API ordenado Configuración nueva con clave de API; el id básico de API directa se resuelve como Sol.
Elegir un nivel exacto de GPT-5.6 openai/gpt-5.6-sol, -terra o -luna Consulte models list para conocer los niveles disponibles para esta cuenta.
Cuenta sin acceso a GPT-5.6 openai/gpt-5.5 Opción de recuperación explícita; OpenClaw no cambia silenciosamente a una versión inferior.
Facturación directa con clave de API, runtime explícito de OpenClaw openai/gpt-5.6 más proveedor/modelo agentRuntime.id: "openclaw" Seleccione un perfil normal de clave de API openai.
Alias del modelo ChatGPT Instant más reciente openai/chat-latest Solo con clave de API directa; es un alias variable, no el valor predeterminado estable.
Generación o edición de imágenes openai/gpt-image-2 Funciona con OPENAI_API_KEY u OAuth de Codex.
Imágenes con fondo transparente openai/gpt-image-1.5 Establezca outputFormat en png o webp, y background=transparent.

Mapa de nombres

Nombre que aparece Capa Significado
openai Prefijo del proveedor Ruta de modelo canónica de OpenAI; los datos de ruta determinan el runtime implícito.
Plugin codex Plugin Plugin incluido que proporciona el runtime nativo del servidor de aplicaciones de Codex y los controles de chat /codex.
proveedor/modelo agentRuntime.id: codex Runtime del agente Fuerza el entorno nativo del servidor de aplicaciones de Codex para los turnos integrados coincidentes.
/codex ... Conjunto de comandos de chat Vincula y controla hilos del servidor de aplicaciones de Codex desde una conversación.
runtime: "acp", agentId: "codex" Ruta de sesión ACP Ruta alternativa explícita que ejecuta Codex mediante ACP/acpx.

Runtime implícito del agente

Cuando la política agentRuntime del proveedor/modelo no está definida o es auto, la política de ruta propiedad del proveedor de OpenAI elige el runtime implícito a partir del endpoint y el adaptador efectivos:

Datos de ruta efectivos Runtime implícito
Endpoint HTTPS oficial exacto de Platform con openai-responses, o endpoint HTTPS oficial exacto de ChatGPT con openai-chatgpt-responses; sin anulación de solicitud definida Se puede seleccionar Codex
Adaptador openai-completions definido OpenClaw
Endpoint personalizado OpenClaw
Endpoint oficial exacto explícito que usa HTTP Rechazado
Ruta con una anulación de solicitud de proveedor/modelo definida OpenClaw

Una configuración agentRuntime.id explícita y no predeterminada del proveedor/modelo sigue siendo vinculante. Por ejemplo, agentRuntime.id: "openclaw" mantiene en OpenClaw una ruta que, de otro modo, sería apta para Codex, mientras que agentRuntime.id: "codex" exige Codex y falla de forma cerrada cuando la ruta efectiva no está declarada como compatible con Codex. La selección del runtime no cambia el tipo de credencial ni la facturación: la autenticación con clave de API de Platform y la autenticación mediante suscripción de ChatGPT/Codex siguen siendo distintas.

openclaw doctor --fix migra las referencias de modelo heredadas codex/* y openai-codex/*, los ids de perfil de autenticación de Codex heredados y las entradas de orden de autenticación de Codex heredadas a la ruta canónica openai. Las referencias de modelo migradas reciben agentRuntime.id: "codex" con ámbito de modelo; use auth.order.openai para las nuevas configuraciones de orden de autenticación.

Vista previa limitada de GPT-5.6

OpenClaw reconoce los ids de modelo exactos openai/gpt-5.6-sol, openai/gpt-5.6-terra y openai/gpt-5.6-luna. Los tres ofrecen los niveles de razonamiento xhigh y max en el catálogo actual. OpenAI describe Sol como el nivel insignia, Terra como el nivel equilibrado y Luna como el nivel rápido y de menor coste. Consulte el anuncio de lanzamiento de GPT-5.6 y la guía de acceso.

Con autenticación directa mediante clave de API de OpenAI, el id básico openai/gpt-5.6 es un alias de Sol y el valor predeterminado de la configuración nueva. El catálogo nativo de Codex no aplica ese alias de API directa en el cliente; según el acceso del espacio de trabajo, puede mostrar los ids exactos de Sol, Terra y Luna. Por tanto, la configuración nueva de OAuth de ChatGPT/Codex usa openai/gpt-5.6-sol. Compruebe la cuenta actual con:

bash
openclaw models list --provider openai

El acceso de la organización de la API y el del espacio de trabajo de Codex pueden ser diferentes. Si GPT-5.6 no está disponible, seleccione GPT-5.5 explícitamente:

bash
openclaw models set openai/gpt-5.5

OpenClaw muestra el error de acceso original y no sustituye silenciosamente una selección de GPT-5.6 por GPT-5.5.

Cobertura de funciones de OpenClaw

Capacidad de OpenAI Superficie de OpenClaw Estado
Chat / Responses proveedor de modelos openai/<model>
Modelos de suscripción de Codex openai/<model> con OAuth de OpenAI
Referencias de modelos Codex heredadas referencias de modelos Codex antiguas, codex-cli/<model> Reparadas por doctor a openai/<model>
Arnés de app-server de Codex ruta HTTPS compatible con Codex con runtime sin establecer/auto, o agentRuntime.id: codex explícito
Búsqueda web del lado del servidor Herramienta nativa de OpenAI Responses Sí, cuando la búsqueda web está habilitada y no se ha fijado otro proveedor
Imágenes image_generate
Vídeos video_generate
Texto a voz tts.provider: "openai" / tts
Voz a texto por lotes tools.media.audio / comprensión multimedia
Voz a texto en streaming Voice Call streaming.provider: "openai"
Voz en tiempo real Voice Call realtime.provider: "openai" / Control UI Talk talk.realtime.provider: "openai" Sí (clave de API de OpenAI Platform)
Embeddings proveedor de embeddings de memoria

Embeddings de memoria

OpenClaw puede utilizar OpenAI, o un endpoint de embeddings compatible con OpenAI, para la indexación de memory_search y los embeddings de consultas:

json5
{  memory: {    search: {      provider: "openai",      model: "text-embedding-3-small",    },  },}

Para los endpoints compatibles con OpenAI que requieran etiquetas de embeddings asimétricas, establezca queryInputType y documentInputType en memory.search. OpenClaw los reenvía como campos de solicitud input_type específicos del proveedor: los embeddings de consultas utilizan queryInputType; los fragmentos de memoria indexados y la indexación por lotes utilizan documentInputType. Consulte la referencia de configuración de memoria para ver el ejemplo completo.

Primeros pasos

Clave de API (OpenAI Platform)

Ideal para: acceso directo a la API y facturación basada en el uso.

  • Obtener la clave de API

    Cree o copie una clave de API desde el panel de OpenAI Platform.

  • Ejecutar la incorporación

    bash
    openclaw onboard --auth-choice openai-api-key

    O proporcione la clave directamente:

    bash
    openclaw onboard --openai-api-key "$OPENAI_API_KEY"
  • Verificar que el modelo esté disponible

    bash
    openclaw models list --provider openai
  • Resumen de rutas

    Referencia del modelo Política del runtime o datos de la ruta Ruta Autenticación
    openai/gpt-5.6 sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud Puede seleccionarse Codex Perfil ordenado de autenticación mediante clave de API
    openai/gpt-5.6 proveedor/modelo agentRuntime.id: "openclaw" Runtime integrado de OpenClaw Perfil de clave de API openai seleccionado
    openai/gpt-5.5 proveedor/modelo agentRuntime.id explícito Runtime de agente seleccionado Perfil de clave de API de OpenAI seleccionado
    openai/* Completions creadas, personalizadas o con sobrescritura de solicitud Runtime integrado de OpenClaw El tipo de credencial permanece sin cambios
    openai/* endpoint HTTP oficial sin cifrar Rechazada La credencial no se envía

    Ejemplo de configuración

    json5
    {  env: { OPENAI_API_KEY: "example-openai-key-not-real" },  agents: { defaults: { model: { primary: "openai/gpt-5.6" } } },}

    El id gpt-5.6 de la API directa sin calificar se resuelve al nivel Sol. Si esta organización de la API no ofrece GPT-5.6, establezca explícitamente el modelo principal en openai/gpt-5.5.

    Para probar el modelo Instant actual de ChatGPT desde la API de OpenAI, establezca el modelo en openai/chat-latest:

    json5
    {  env: { OPENAI_API_KEY: "example-openai-key-not-real" },  agents: { defaults: { model: { primary: "openai/chat-latest" } } },}

    chat-latest es un alias dinámico. En cambio, la nueva configuración mediante clave de API de OpenAI utiliza openai/gpt-5.6, cuyo id de API directa sin calificar se resuelve a Sol. Los modelos principales explícitos existentes, incluido openai/gpt-5.5, permanecen sin cambios. El alias chat-latest solo acepta la verbosidad de texto medium; OpenClaw fuerza cualquier otra verbosidad solicitada a medium para este modelo.

    Suscripción de Codex

    Ideal para: utilizar la suscripción a ChatGPT/Codex con ejecución nativa mediante app-server de Codex en lugar de una clave de API independiente. Codex Cloud requiere iniciar sesión en ChatGPT.

  • Ejecutar OAuth de Codex

    bash
    openclaw onboard --auth-choice openai

    O ejecute OAuth directamente:

    bash
    openclaw models auth login --provider openai

    Para configuraciones sin interfaz gráfica o incompatibles con la devolución de llamada, añada --device-code para iniciar sesión con un flujo de código de dispositivo de ChatGPT en lugar de la devolución de llamada del navegador local:

    bash
    openclaw models auth login --provider openai --device-code
  • Usar la ruta canónica del modelo de OpenAI

    bash
    openclaw config set agents.defaults.model.primary openai/gpt-5.6-sol

    No se requiere ninguna configuración del runtime para esta ruta nativa HTTPS oficial exacta. Puede seleccionar automáticamente el runtime de app-server de Codex, y OpenClaw instala o repara el plugin de Codex incluido cuando se elige ese runtime.

  • Verificar que la autenticación de Codex esté disponible

    bash
    openclaw models list --provider openai

    Después de que el Gateway esté en funcionamiento, envíe /codex status o /codex models en el chat para verificar el runtime nativo de app-server.

  • Resumen de rutas

    Referencia del modelo Política del runtime o datos de la ruta Ruta Autenticación
    openai/gpt-5.6-sol sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud Puede seleccionarse Codex Inicio de sesión de Codex o un perfil de autenticación openai ordenado
    openai/gpt-5.6-terra sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud Puede seleccionarse Codex Inicio de sesión de Codex cuando el catálogo ofrece Terra
    openai/gpt-5.6-luna sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud Puede seleccionarse Codex Inicio de sesión de Codex cuando el catálogo ofrece Luna
    openai/gpt-5.6-sol proveedor/modelo agentRuntime.id: "openclaw" Runtime integrado de OpenClaw, transporte interno de autenticación de Codex Perfil OAuth openai seleccionado
    openai/gpt-5.5 proveedor/modelo agentRuntime.id explícito Runtime de agente seleccionado Perfil de autenticación de OpenAI seleccionado
    openai/* Completions creadas, personalizadas o con sobrescritura de solicitud Runtime integrado de OpenClaw El requisito de credenciales sigue siendo específico de la ruta
    openai/* endpoint HTTP oficial sin cifrar Rechazada La credencial no se envía
    Referencia heredada de Codex GPT-5.5 reparada por doctor Reescrita como openai/gpt-5.5 Perfil OAuth de OpenAI migrado
    codex-cli/gpt-5.5 reparada por doctor Reescrita como openai/gpt-5.5 Autenticación de app-server de Codex

    Ejemplo de configuración

    json5
    {  plugins: { entries: { codex: { enabled: true } } },  agents: {    defaults: {      model: { primary: "openai/gpt-5.6-sol" },    },  },}

    Con una clave de API de respaldo, mantenga el modelo seleccionado en openai/* y coloque el orden de autenticación en openai. OpenClaw prueba primero la suscripción y después la clave de API, sin abandonar el entorno de Codex:

    json5
    {  plugins: { entries: { codex: { enabled: true } } },  agents: {    defaults: {      model: { primary: "openai/gpt-5.6-sol" },    },  },  auth: {    order: {      openai: [        "openai:user@example.com",        "openai:api-key-backup",      ],    },  },}

    Comprobar y recuperar el enrutamiento OAuth de Codex

    bash
    openclaw models statusopenclaw models auth list --provider openaiopenclaw config get agents.defaults.model --jsonopenclaw config get models.providers.openai.agentRuntime --json

    Para un agente específico, añada --agent <id>:

    bash
    openclaw models status --agent <id>openclaw models auth list --agent <id> --provider openai

    Si una configuración anterior todavía contiene referencias heredadas de Codex GPT o una fijación obsoleta de sesión del entorno de ejecución de OpenAI sin una configuración explícita del entorno de ejecución, repárela:

    bash
    openclaw doctor --fixopenclaw config validate

    Si models auth list --provider openai no muestra ningún perfil utilizable, inicie sesión de nuevo:

    bash
    openclaw models auth login --provider openaiopenclaw models status --probe --probe-provider openai

    Use --profile-id para varios inicios de sesión OAuth de Codex en el mismo agente y después contrólelos mediante el orden de autenticación o /model ...@<profileId>:

    bash
    openclaw models auth login --provider openai --profile-id openai:ritsukoopenclaw models auth login --provider openai --profile-id openai:lain

    Ejecute openclaw doctor --fix para migrar los identificadores de perfil y las entradas de orden anteriores con el prefijo heredado OpenAI Codex antes de depender del orden de los perfiles.

    Indicador de estado

    /status en el chat muestra qué entorno de ejecución del modelo está activo para la sesión actual. El entorno de servidor de aplicaciones Codex incluido aparece como Runtime: OpenAI Codex cuando lo selecciona una ruta implícita apta o una política explícita de entorno de ejecución de proveedor/modelo.

    Advertencia de doctor

    Si permanecen referencias heredadas de modelos Codex o fijaciones obsoletas del entorno de ejecución de OpenAI en la configuración o en el estado de la sesión, openclaw doctor --fix las reescribe como openai/* con el entorno de ejecución de Codex, salvo que OpenClaw esté configurado explícitamente.

    Valores predeterminados de la ventana de contexto y activación voluntaria del contexto largo

    OpenClaw trata la capacidad nativa del modelo y el presupuesto del entorno de ejecución activo como valores independientes:

    • contextWindow declara la ventana total del modelo del proveedor.
    • contextTokens limita cuánto de esa ventana utiliza OpenClaw para la entrada activa.

    OAuth de ChatGPT/Codex sigue el catálogo activo de la cuenta de Codex. Actualmente, el catálogo suele anunciar una ventana activa de 272000 tokens para GPT-5.6. Los modelos GPT-5.5 y GPT-5.6 mediante clave de API directa también usan de forma predeterminada 272000 contextTokens, aunque la API de la plataforma expone una ventana nativa mayor. Esto mantiene coherentes los perfiles habituales de latencia, calidad y coste entre los distintos modos de autenticación. Un valor configurado de agents.defaults.contextTokens puede reducir aún más ese presupuesto, pero no puede elevar un modelo por encima de su límite configurado de contextTokens.

    Para GPT-5.5 y GPT-5.6 mediante clave de API directa, OpenAI documenta una ventana del proveedor de 1050000 tokens y 128000 tokens máximos de salida. Reservar la asignación completa de salida deja 922000 tokens para la entrada. Se trata de un presupuesto operativo derivado, no de un límite de entrada independiente publicado por el proveedor. Consulte la comparación de modelos y la página del modelo GPT-5.5 oficiales. El ejemplo siguiente habilita esa asignación para un modelo Terra y solicita a OpenAI que realice la compactación al alcanzar 700000 tokens activos:

    json5
    {  models: {    providers: {      openai: {        models: [          {            id: "gpt-5.6-terra",            name: "GPT-5.6 Terra",            contextWindow: 1050000,            contextTokens: 922000,            maxTokens: 128000,          },        ],      },    },  },  agents: {    defaults: {      model: { primary: "openai/gpt-5.6-terra" },      models: {        "openai/gpt-5.6-terra": {          agentRuntime: { id: "openclaw" },          params: {            responsesServerCompaction: true,            responsesCompactThreshold: 700000,          },        },      },    },  },}

    agentRuntime.id: "openclaw" es intencional en este ejemplo. Demuestra que la ruta integrada de Responses de OpenClaw utiliza los metadatos del modelo y la configuración de compactación del servidor anteriores. En cambio, un hilo del entorno nativo de Codex gestiona su presupuesto de contexto en la configuración de Codex; consulte contexto largo del entorno de Codex.

    OpenClaw utiliza los metadatos del catálogo ascendente de Codex para gpt-5.5 cuando están presentes. Si el descubrimiento en vivo de Codex omite la fila gpt-5.5 mientras la cuenta está autenticada, OpenClaw sintetiza esa fila del modelo OAuth para que las ejecuciones de cron, subagentes y modelos predeterminados configurados no fallen con Unknown model.

    Autenticación del servidor de aplicaciones nativo de Codex

    El entorno de servidor de aplicaciones nativo de Codex utiliza referencias de modelo openai/* cuando una ruta HTTPS oficial exacta y apta lo selecciona implícitamente, o cuando la configuración de proveedor/modelo agentRuntime.id: "codex" lo selecciona explícitamente. Su autenticación sigue estando basada en cuentas. OpenClaw selecciona la autenticación en este orden:

    1. Perfiles de autenticación de OpenAI ordenados para el agente, preferiblemente en auth.order.openai. Ejecute openclaw doctor --fix para migrar identificadores anteriores de perfiles de autenticación heredados de Codex y el orden de autenticación.
    2. La cuenta existente del servidor de aplicaciones, como un inicio de sesión local de ChatGPT en la CLI de Codex. Para el directorio principal aislado predeterminado del agente, OpenClaw enlaza esa cuenta nativa de la CLI con el servidor de aplicaciones mediante su RPC de inicio de sesión; no comparte la configuración, los plugins ni el almacén de hilos de la CLI.
    3. Solo para ejecuciones locales del servidor de aplicaciones mediante stdio y únicamente cuando el servidor de aplicaciones no informa de ninguna cuenta: CODEX_API_KEY y después OPENAI_API_KEY.

    Un inicio de sesión local de suscripción de ChatGPT/Codex no se sustituye solo porque el proceso del Gateway también disponga de OPENAI_API_KEY para modelos directos de OpenAI o representaciones vectoriales. La alternativa mediante clave de API del entorno solo se aplica a la ruta local de stdio sin cuenta; nunca se envía mediante conexiones WebSocket del servidor de aplicaciones. Cuando se selecciona un perfil de Codex basado en suscripción, OpenClaw también mantiene CODEX_API_KEY y OPENAI_API_KEY fuera del proceso hijo del servidor de aplicaciones stdio y envía las credenciales seleccionadas mediante el RPC de inicio de sesión del servidor de aplicaciones.

    Cuando ese perfil de suscripción queda bloqueado por un límite de uso de Codex, OpenClaw marca el perfil como bloqueado hasta la hora de restablecimiento anunciada por Codex y permite que el orden de autenticación rote al siguiente perfil openai:*, sin cambiar el modelo seleccionado ni abandonar el entorno de Codex. Una vez transcurrida la hora de restablecimiento, el perfil de suscripción vuelve a ser apto.

    Generación de imágenes

    El plugin openai incluido registra la generación de imágenes mediante la herramienta image_generate. Admite la generación de imágenes tanto mediante clave de API de OpenAI como mediante OAuth de Codex con la misma referencia de modelo openai/gpt-image-2.

    Capacidad Clave de API de OpenAI OAuth de Codex
    Referencia del modelo openai/gpt-image-2 openai/gpt-image-2
    Autenticación OPENAI_API_KEY Inicio de sesión OAuth de OpenAI Codex
    Transporte API de imágenes de OpenAI Backend de Responses de Codex
    Máximo de imágenes por solicitud 4 4
    Modo de edición Habilitado (hasta 5 imágenes de referencia) Habilitado (hasta 5 imágenes de referencia)
    Sustituciones de tamaño Compatibles, incluidos tamaños 2K/4K Compatibles, incluidos tamaños 2K/4K
    Relación de aspecto / resolución No se reenvía a la API de imágenes de OpenAI Se asigna a un tamaño compatible cuando es seguro
    json5
    {  agents: {    defaults: {      imageGenerationModel: { primary: "openai/gpt-image-2" },    },  },}

    gpt-image-2 es el valor predeterminado para la generación de imágenes a partir de texto y la edición de imágenes de OpenAI. gpt-image-1.5, gpt-image-1 y gpt-image-1-mini siguen estando disponibles como sustituciones explícitas del modelo. Use openai/gpt-image-1.5 para obtener salidas PNG/WebP con fondo transparente; la API actual gpt-image-2 rechaza background: "transparent".

    Para una solicitud con fondo transparente, invoque image_generate con model: "openai/gpt-image-1.5", outputFormat: "png" o "webp", y background: "transparent"; la opción anterior de proveedor openai.background todavía se acepta. OpenClaw también protege las rutas públicas de OpenAI y OAuth de OpenAI Codex reescribiendo las solicitudes transparentes predeterminadas de openai/gpt-image-2 como gpt-image-1.5; Azure y los endpoints personalizados compatibles con OpenAI conservan sus nombres configurados de implementación/modelo.

    La misma configuración está disponible para ejecuciones de la CLI sin interfaz gráfica:

    bash
    openclaw infer image generate \  --model openai/gpt-image-1.5 \  --output-format png \  --background transparent \  --prompt "Una pegatina sencilla de un círculo rojo sobre un fondo transparente" \  --json

    Use las mismas opciones --output-format y --background con openclaw infer image edit cuando parta de un archivo de entrada. --openai-background sigue estando disponible como alias específico de OpenAI. Use --quality low|medium|high|auto para controlar la calidad y el coste de las imágenes de OpenAI. Use --openai-moderation low|auto para pasar la indicación de moderación de OpenAI desde image generate o image edit.

    Para las instalaciones OAuth de ChatGPT/Codex, mantenga la misma referencia openai/gpt-image-2. Cuando se configura un perfil OAuth openai, OpenClaw resuelve ese token de acceso OAuth almacenado y envía las solicitudes de imágenes mediante el backend Codex Responses; no intenta primero OPENAI_API_KEY ni recurre silenciosamente a una clave de API. Configure models.providers.openai explícitamente con una clave de API, una URL base personalizada o un endpoint de Azure cuando quiera usar en su lugar la ruta directa de la API de OpenAI Images. Si ese endpoint de imágenes personalizado se encuentra en una dirección LAN/privada de confianza, establezca también browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true; OpenClaw mantiene bloqueados los endpoints de imágenes privados/internos compatibles con OpenAI a menos que esta habilitación explícita esté presente.

    Generar:

    Code
    /tool image_generate model=openai/gpt-image-2 prompt="Un póster de lanzamiento refinado para OpenClaw en macOS" size=3840x2160 count=1

    Generar un PNG transparente:

    Code
    /tool image_generate model=openai/gpt-image-1.5 prompt="Una pegatina sencilla de un círculo rojo sobre un fondo transparente" outputFormat=png background=transparent

    Editar:

    Code
    /tool image_generate model=openai/gpt-image-2 prompt="Conserva la forma del objeto y cambia el material por vidrio translúcido" image=/path/to/reference.png size=1024x1536

    Generación de vídeo

    El plugin openai incluido registra la generación de vídeo mediante la herramienta video_generate.

    Capacidad Valor
    Modelo predeterminado openai/sora-2
    Modos Texto a vídeo, imagen a vídeo, edición de un solo vídeo
    Entradas de referencia 1 imagen o 1 vídeo
    Anulaciones de tamaño Compatibles con texto a vídeo e imagen a vídeo
    Relación de aspecto Se convierte al tamaño compatible más cercano; no se reenvía sin procesar
    Otras anulaciones resolution, audio, watermark no son compatibles y se descartan con una advertencia de la herramienta

    Las solicitudes de imagen a vídeo de OpenAI usan POST /v1/videos con una input_reference de imagen. Las ediciones de un solo vídeo usan POST /v1/videos/edits con el vídeo cargado en el campo video.

    json5
    {  agents: {    defaults: {      videoGenerationModel: { primary: "openai/sora-2" },    },  },}

    Contribución al prompt de GPT-5

    OpenClaw añade una contribución compartida al prompt de GPT-5 para los modelos de la familia GPT-5 en el proveedor openai (incluidas las referencias heredadas de Codex anteriores a la reparación que se normalizan a openai/*). Otros proveedores que también ofrecen identificadores de modelos de la familia GPT-5, como OpenRouter o las rutas de opencode, no reciben esta capa; se condiciona al identificador de proveedor openai, no solo al identificador de modelo. Los modelos GPT-4.x anteriores nunca la reciben.

    El entorno nativo del servidor de aplicaciones de Codex no recibe el contrato de comportamiento de personalidad y disciplina de herramientas ni la capa de estilo de interacción cordial mediante instrucciones para desarrolladores; Codex nativo conserva el comportamiento base, de modelo y de documentación del proyecto propio de Codex, y OpenClaw desactiva la personalidad integrada de Codex para los hilos nativos, de modo que los archivos de personalidad del espacio de trabajo del agente sigan siendo la autoridad. OpenClaw solo aporta contexto de ejecución a los hilos nativos de Codex: entrega por canales, herramientas dinámicas de OpenClaw, delegación ACP, contexto del espacio de trabajo y Skills de OpenClaw. El texto de orientación de Heartbeat de esta misma contribución es la única excepción: los turnos de Heartbeat de Codex nativo sí lo reciben, insertado como instrucciones de colaboración específicas en lugar de mediante el enlace compartido de contribución al prompt.

    La contribución de GPT-5 añade un contrato de comportamiento etiquetado para la persistencia de la personalidad, la seguridad de ejecución, la disciplina de herramientas, la forma de la salida, las comprobaciones de finalización y la verificación en los prompts coincidentes ensamblados por OpenClaw. El comportamiento de respuesta y de mensajes silenciosos específico de cada canal permanece en el prompt del sistema compartido de OpenClaw y en la política de entrega saliente. La capa de estilo de interacción cordial es independiente y configurable.

    Valor Efecto
    "friendly" (predeterminado) Activa la capa de estilo de interacción cordial
    "on" Alias de "friendly"
    "off" Desactiva solo la capa de estilo cordial

    Configuración

    json5
    {  agents: {    defaults: {      promptOverlays: {        gpt5: { personality: "friendly" },      },    },  },}

    CLI

    bash
    openclaw config set agents.defaults.promptOverlays.gpt5.personality off

    Voz y habla

    Síntesis de voz (TTS)

    El plugin openai incluido registra la síntesis de voz para la superficie tts.

    Ajuste Ruta de configuración Valor predeterminado
    Modelo tts.providers.openai.model gpt-4o-mini-tts
    Voz tts.providers.openai.speakerVoice coral
    Velocidad tts.providers.openai.speed (sin establecer)
    Instrucciones tts.providers.openai.instructions (sin establecer, solo gpt-4o-mini-tts)
    Formato tts.providers.openai.responseFormat opus para notas de voz, mp3 para archivos
    Clave de API tts.providers.openai.apiKey Recurre a OPENAI_API_KEY
    URL base tts.providers.openai.baseUrl https://api.openai.com/v1
    Cuerpo adicional tts.providers.openai.extraBody / extra_body (sin establecer)

    Modelos disponibles: gpt-4o-mini-tts, tts-1, tts-1-hd. Voces disponibles: alloy, ash, ballad, cedar, coral, echo, fable, juniper, marin, onyx, nova, sage, shimmer, verse.

    extraBody se combina con el JSON de la solicitud /audio/speech después de los campos generados por OpenClaw, por lo que debe usarse para endpoints compatibles con OpenAI que requieran claves adicionales como lang. Las claves de prototipo se ignoran.

    json5
    {  tts: {    providers: {      openai: { model: "gpt-4o-mini-tts", speakerVoice: "coral" },    },  },}
    Voz a texto

    El plugin openai incluido registra la conversión por lotes de voz a texto mediante la superficie de transcripción para comprensión de medios de OpenClaw.

    • Modelo predeterminado: gpt-4o-transcribe
    • Endpoint: REST de OpenAI /v1/audio/transcriptions
    • Ruta de entrada: carga de archivo de audio multiparte
    • Se usa siempre que la transcripción de audio entrante lee tools.media.audio, incluidos los segmentos de canales de voz de Discord y los archivos adjuntos de audio de los canales

    Para forzar el uso de OpenAI en la transcripción de audio entrante:

    json5
    {  tools: {    media: {      audio: {        models: [          {            type: "provider",            provider: "openai",            model: "gpt-4o-transcribe",          },        ],      },    },  },}

    Las indicaciones de idioma y prompt se reenvían a OpenAI cuando las proporciona la configuración compartida de medios de audio o la solicitud de transcripción de cada llamada.

    Transcripción en tiempo real

    El plugin openai incluido registra la transcripción en tiempo real para el plugin Voice Call.

    Ajuste Ruta de configuración Valor predeterminado
    Modelo plugins.entries.voice-call.config.streaming.providers.openai.model gpt-4o-transcribe
    Idioma ...openai.language (sin establecer)
    Prompt ...openai.prompt (sin establecer)
    Duración del silencio ...openai.silenceDurationMs 800
    Umbral de VAD ...openai.vadThreshold 0.5
    Autenticación ...openai.apiKey, OPENAI_API_KEY o perfil de clave de API openai Se requiere una clave de API de Platform
    Voz en tiempo real

    El plugin openai incluido registra la voz en tiempo real para el plugin Voice Call.

    Ajuste Ruta de configuración Valor predeterminado
    Modelo plugins.entries.voice-call.config.realtime.providers.openai.model gpt-realtime-2.1
    Voz ...openai.voice alloy
    Temperatura (puente de implementación de Azure) ...openai.temperature 0.8
    Umbral de VAD ...openai.vadThreshold 0.5
    Duración del silencio ...openai.silenceDurationMs 500
    Relleno de prefijo ...openai.prefixPaddingMs 300
    Esfuerzo de razonamiento ...openai.reasoningEffort (sin establecer)
    Autenticación Perfil de clave de API openai, ...openai.apiKey o OPENAI_API_KEY Se requiere una clave de API de OpenAI Platform

    Voces Realtime integradas disponibles para gpt-realtime-2.1: alloy, ash, ballad, coral, echo, sage, shimmer, verse, marin, cedar. OpenAI recomienda marin y cedar para obtener la mejor calidad de Realtime. Este es un conjunto distinto del de las voces de texto a voz anteriores; una voz exclusiva de TTS, como fable, nova o onyx, no es válida para sesiones de Realtime. Establezca explícitamente el modelo en gpt-realtime-2.1-mini si prefiere la variante Realtime 2.1 más pequeña y de menor costo.

    Endpoints de Azure OpenAI

    El proveedor openai incluido puede dirigirse a un recurso de Azure OpenAI para la generación de imágenes reemplazando la URL base. En la ruta de generación de imágenes, OpenClaw detecta los nombres de host de Azure en models.providers.openai.baseUrl y cambia automáticamente a la estructura de solicitud de Azure.

    Use Azure OpenAI cuando:

    • Ya disponga de una suscripción, cuota o acuerdo empresarial de Azure OpenAI
    • Necesite la residencia regional de datos o los controles de cumplimiento que proporciona Azure
    • Quiera mantener el tráfico dentro de una suscripción existente de Azure

    Configuración

    Para generar imágenes en Azure mediante el proveedor openai incluido, dirija models.providers.openai.baseUrl a su recurso de Azure y establezca apiKey en la clave de Azure OpenAI (no una clave de OpenAI Platform):

    json5
    {  models: {    providers: {      openai: {        baseUrl: "https://<your-resource>.openai.azure.com",        apiKey: "<azure-openai-api-key>",      },    },  },}

    OpenClaw reconoce estos sufijos de host de Azure para la ruta de generación de imágenes de Azure:

    • *.openai.azure.com
    • *.services.ai.azure.com
    • *.cognitiveservices.azure.com

    Para las solicitudes de generación de imágenes en un host de Azure reconocido, OpenClaw:

    • Envía el encabezado api-key en lugar de Authorization: Bearer
    • Utiliza rutas limitadas a la implementación (/openai/deployments/{deployment}/...)
    • Añade ?api-version=... a cada solicitud
    • Utiliza un tiempo de espera predeterminado de 600s para las llamadas de generación de imágenes de Azure. Los valores de timeoutMs por llamada siguen reemplazando este valor predeterminado.

    Las demás URL base (OpenAI público y proxies compatibles con OpenAI) conservan la estructura estándar de solicitud de imágenes de OpenAI.

    Versión de la API

    Establezca AZURE_OPENAI_API_VERSION para fijar una versión preliminar o con disponibilidad general específica de Azure para la ruta de generación de imágenes de Azure:

    bash
    export AZURE_OPENAI_API_VERSION="2024-12-01-preview"

    El valor predeterminado es 2024-12-01-preview cuando la variable no está establecida.

    Los nombres de modelo son nombres de implementación

    Azure OpenAI vincula los modelos a implementaciones. Para las solicitudes de generación de imágenes de Azure enrutadas mediante el proveedor openai incluido, el campo model de OpenClaw debe ser el nombre de la implementación de Azure configurado en el portal de Azure, no el identificador público del modelo de OpenAI.

    Si crea una implementación llamada gpt-image-2-prod que sirve gpt-image-2:

    Code
    /tool image_generate model=openai/gpt-image-2-prod prompt="Un cartel sencillo" size=1024x1024 count=1

    La misma regla del nombre de implementación se aplica a cualquier llamada de generación de imágenes enrutada mediante el proveedor openai incluido.

    Disponibilidad regional

    Actualmente, la generación de imágenes de Azure solo está disponible en un subconjunto de regiones (por ejemplo, eastus2, swedencentral, polandcentral, westus3, uaenorth). Consulte la lista actual de regiones de Microsoft antes de crear una implementación y confirme que el modelo específico esté disponible en su región.

    Diferencias entre parámetros

    Azure OpenAI y OpenAI público no siempre aceptan los mismos parámetros de imagen. Azure puede rechazar opciones permitidas por OpenAI público (por ejemplo, determinados valores de background en gpt-image-2) o exponerlas únicamente en versiones específicas del modelo. Estas diferencias proceden de Azure y del modelo subyacente, no de OpenClaw. Si una solicitud de Azure falla con un error de validación, consulte en el portal de Azure el conjunto de parámetros compatible con su implementación y versión de API específicas.

    Configuración avanzada

    Los siguientes ejemplos de params por modelo determinan la solicitud del proveedor integrado de OpenClaw. Configurarlos constituye un comportamiento de solicitud definido, por lo que una ruta auto que cumpla los requisitos permanece en OpenClaw en lugar de seleccionar Codex implícitamente. El entorno del servidor de aplicaciones nativo de Codex administra su propio transporte y sus propios ajustes de solicitud; un agentRuntime.id: "codex" explícito produce un fallo seguro cuando la ruta efectiva no está declarada como compatible con Codex.

    Transporte (WebSocket frente a SSE)

    OpenClaw utiliza WebSocket primero con SSE como alternativa ("auto") para openai/*.

    En el modo "auto", OpenClaw:

    • Reintenta una vez tras un fallo inicial de WebSocket antes de recurrir a SSE
    • Después de un fallo, marca WebSocket como degradado durante 60 segundos y utiliza SSE durante el periodo de espera
    • Adjunta encabezados estables de identidad de sesión y turno para los reintentos y las reconexiones
    • Normaliza los contadores de uso (input_tokens / prompt_tokens) entre las variantes de transporte
    Valor Comportamiento
    "auto" (predeterminado) WebSocket primero, SSE como alternativa
    "sse" Forzar solo SSE
    "websocket" Forzar solo WebSocket
    json5
    {  agents: {    defaults: {      models: {        "openai/gpt-5.5": {          params: { transport: "auto" },        },      },    },  },}

    Documentación relacionada de OpenAI:

    Modo rápido

    OpenClaw ofrece un control compartido del modo rápido para openai/*:

    • Chat/interfaz: /fast status|auto|on|off
    • Configuración: agents.defaults.models["<provider>/<model>"].params.fastMode

    Cuando está habilitado, OpenClaw asigna el modo rápido al procesamiento prioritario de OpenAI (service_tier = "priority"). Los valores existentes de service_tier se conservan, y el modo rápido no modifica reasoning ni text.verbosity. fastMode: "auto" inicia rápidamente las nuevas llamadas al modelo hasta el límite automático y, después, inicia las llamadas posteriores de reintento, alternativa, resultado de herramienta o continuación sin el modo rápido. El límite predeterminado es de 60 segundos; establezca params.fastAutoOnSeconds en el modelo activo para cambiarlo.

    json5
    {  agents: {    defaults: {      models: {        "openai/gpt-5.5": { params: { fastMode: "auto", fastAutoOnSeconds: 30 } },      },    },  },}
    Procesamiento prioritario (service_tier)

    La API de OpenAI ofrece procesamiento prioritario mediante service_tier. Se configura por modelo en OpenClaw:

    json5
    {  agents: {    defaults: {      models: {        "openai/gpt-5.5": { params: { serviceTier: "priority" } },      },    },  },}

    Valores admitidos: auto, default, flex, priority.

    Compaction del lado del servidor (API Responses)

    Para los modelos directos de OpenAI Responses (openai/* en api.openai.com), el contenedor de flujos de OpenClaw del Plugin de OpenAI habilita automáticamente la Compaction del lado del servidor:

    • Fuerza store: true (a menos que la compatibilidad del modelo establezca supportsStore: false)
    • Inyecta context_management: [{ type: "compaction", compact_threshold: ... }]
    • Valor predeterminado de compact_threshold: el 70 % de contextWindow (o 80000 cuando no esté disponible)

    Esto se aplica a la ruta integrada del entorno de ejecución de OpenClaw y a los hooks del proveedor de OpenAI utilizados por las ejecuciones integradas. El entorno nativo del servidor de aplicaciones de Codex gestiona su propio contexto mediante Codex y esta configuración no le afecta.

    Habilitar explícitamente

    Resulta útil para endpoints compatibles, como Azure OpenAI Responses:

    json5
    {  agents: {    defaults: {      models: {        "azure-openai-responses/gpt-5.5": {          params: { responsesServerCompaction: true },        },      },    },  },}

    Umbral personalizado

    json5
    {  agents: {    defaults: {      models: {        "openai/gpt-5.5": {          params: {            responsesServerCompaction: true,            responsesCompactThreshold: 120000,          },        },      },    },  },}

    Deshabilitar

    json5
    {  agents: {    defaults: {      models: {        "openai/gpt-5.5": {          params: { responsesServerCompaction: false },        },      },    },  },}
    Modo GPT agéntico estricto

    Para los modelos de la familia GPT-5 del proveedor openai que se ejecutan mediante el entorno de ejecución integrado de OpenClaw, OpenClaw ya utiliza de forma predeterminada un contrato de ejecución más estricto denominado strict-agentic. Se activa automáticamente siempre que el proveedor resuelto sea openai y el id del modelo coincida con la familia GPT-5, salvo que la configuración deshabilite explícitamente este comportamiento:

    json5
    {  agents: {    defaults: {      embeddedAgent: { executionContract: "default" },    },  },}

    Establecer "strict-agentic" explícitamente no produce ningún efecto en una ruta compatible (ya es el valor predeterminado) y permanece inactivo para las combinaciones de proveedor y modelo no compatibles.

    Con strict-agentic activo, OpenClaw:

    • Habilita automáticamente update_plan para trabajos sustanciales
    • Reintenta los turnos estructuralmente vacíos o que solo contienen razonamiento con una continuación que proporciona una respuesta visible
    • Utiliza eventos de planificación explícitos del entorno cuando el entorno seleccionado los proporciona

    OpenClaw no clasifica el texto del asistente para decidir si un turno es un plan, una actualización del progreso o una respuesta final.

    Rutas nativas frente a rutas compatibles con OpenAI

    OpenClaw trata los endpoints directos de OpenAI, Codex y Azure OpenAI de forma distinta a los proxies genéricos /v1 compatibles con OpenAI:

    Rutas nativas (openai/*, Azure OpenAI):

    • Conservan reasoning: { effort: "none" } solo para los modelos compatibles con el nivel de esfuerzo none de OpenAI
    • Omiten el razonamiento deshabilitado para los modelos o proxies que rechazan reasoning.effort: "none"
    • Utilizan de forma predeterminada el modo estricto para los esquemas de herramientas
    • Adjuntan encabezados de atribución ocultos únicamente en hosts nativos verificados (Azure OpenAI no recibe estos encabezados, aunque sea una ruta nativa)
    • Mantienen la adaptación de solicitudes exclusiva de OpenAI (service_tier, store, compatibilidad de razonamiento, indicaciones de caché de prompts)

    Rutas de proxy/compatibles:

    • Utilizan un comportamiento de compatibilidad menos estricto
    • Eliminan store de Completions de las cargas útiles openai-completions no nativas
    • Aceptan JSON avanzado de paso directo params.extra_body/params.extraBody para proxies de Completions compatibles con OpenAI
    • Aceptan params.chat_template_kwargs para proxies de Completions compatibles con OpenAI, como vLLM
    • No fuerzan esquemas estrictos de herramientas ni encabezados exclusivos de rutas nativas

    Temas relacionados

    Was this useful?
    On this page

    On this page