Providers
OpenAI
OpenClaw usa un único id de proveedor, openai, tanto para la autenticación directa con clave de API como para
la autenticación mediante suscripción de ChatGPT/Codex. openai/* es la ruta de modelo canónica.
Para los turnos del agente integrado cuya política de runtime no esté definida o sea auto, los datos de ruta
de OpenAI determinan si OpenClaw puede seleccionar implícitamente el runtime incluido del servidor de aplicaciones de Codex.
El prefijo openai/* por sí solo no selecciona ningún runtime.
- Modelos de agente -
openai/*mediante el runtime seleccionado por la configuración explícitaagentRuntimeo por la política de ruta implícita de OpenAI. Inicie sesión con la autenticación de Codex para usar una suscripción de ChatGPT/Codex, o configure un perfil de autenticación con clave de API si desea facturación basada en claves. - API de OpenAI ajenas al agente - acceso directo a OpenAI Platform, facturado por uso,
mediante
OPENAI_API_KEYo un perfil de autenticación con clave de APIopenai. - Configuración heredada - las referencias
codex/*yopenai-codex/*se reparan comoopenai/*másagentRuntime.id: "codex"con ámbito de modelo medianteopenclaw doctor --fix.
OpenAI admite explícitamente el uso de OAuth de suscripción en herramientas y flujos de trabajo externos como OpenClaw.
Seguimiento del uso y los costes
OpenClaw mantiene separados la cuota de suscripción y la facturación de la API de Platform:
- OAuth de ChatGPT/Codex muestra el plan de suscripción, los períodos de cuota y el saldo de créditos.
OPENAI_ADMIN_KEYmuestra 30 días de costes de la organización y uso de completions informados por el proveedor en Uso de Control UI, incluidos el gasto diario, los totales de solicitudes/tokens, los modelos principales y las categorías de costes.OPENAI_PROJECT_IDlimita opcionalmente el historial de la Admin API a un proyecto.- OpenClaw nunca envía
OPENAI_API_KEYni un perfil de inferenciaopenaia las API de la organización; esas credenciales pueden pertenecer a endpoints personalizados, de Azure o locales del agente.
Una clave de administración explícita tiene prioridad sobre OAuth. El historial informado por el proveedor no se combina con el coste estimado por OpenClaw a partir de las sesiones; puede incluir actividad de la API procedente de otros clientes y ajustes de facturación del proveedor.
La documentación del panel de uso de la API de OpenAI describe los requisitos de ser propietario de la organización y contar con permisos explícitos del Usage Dashboard para acceder a los datos de uso.
El proveedor, el modelo, el runtime y el canal son capas independientes. Si esas etiquetas se están confundiendo, consulte Runtimes de agente antes de cambiar la configuración.
Elección rápida
| Objetivo | Usar | Notas |
|---|---|---|
| Suscripción de ChatGPT/Codex, runtime nativo de Codex | openai/gpt-5.6-sol |
Configuración de suscripción nueva; inicie sesión con la autenticación de Codex. |
| Facturación directa con clave de API para turnos del agente | openai/gpt-5.6 más un perfil de autenticación con clave de API ordenado |
Configuración nueva con clave de API; el id básico de API directa se resuelve como Sol. |
| Elegir un nivel exacto de GPT-5.6 | openai/gpt-5.6-sol, -terra o -luna |
Consulte models list para conocer los niveles disponibles para esta cuenta. |
| Cuenta sin acceso a GPT-5.6 | openai/gpt-5.5 |
Opción de recuperación explícita; OpenClaw no cambia silenciosamente a una versión inferior. |
| Facturación directa con clave de API, runtime explícito de OpenClaw | openai/gpt-5.6 más proveedor/modelo agentRuntime.id: "openclaw" |
Seleccione un perfil normal de clave de API openai. |
| Alias del modelo ChatGPT Instant más reciente | openai/chat-latest |
Solo con clave de API directa; es un alias variable, no el valor predeterminado estable. |
| Generación o edición de imágenes | openai/gpt-image-2 |
Funciona con OPENAI_API_KEY u OAuth de Codex. |
| Imágenes con fondo transparente | openai/gpt-image-1.5 |
Establezca outputFormat en png o webp, y background=transparent. |
Mapa de nombres
| Nombre que aparece | Capa | Significado |
|---|---|---|
openai |
Prefijo del proveedor | Ruta de modelo canónica de OpenAI; los datos de ruta determinan el runtime implícito. |
Plugin codex |
Plugin | Plugin incluido que proporciona el runtime nativo del servidor de aplicaciones de Codex y los controles de chat /codex. |
proveedor/modelo agentRuntime.id: codex |
Runtime del agente | Fuerza el entorno nativo del servidor de aplicaciones de Codex para los turnos integrados coincidentes. |
/codex ... |
Conjunto de comandos de chat | Vincula y controla hilos del servidor de aplicaciones de Codex desde una conversación. |
runtime: "acp", agentId: "codex" |
Ruta de sesión ACP | Ruta alternativa explícita que ejecuta Codex mediante ACP/acpx. |
Runtime implícito del agente
Cuando la política agentRuntime del proveedor/modelo no está definida o es auto, la política
de ruta propiedad del proveedor de OpenAI elige el runtime implícito a partir del
endpoint y el adaptador efectivos:
| Datos de ruta efectivos | Runtime implícito |
|---|---|
Endpoint HTTPS oficial exacto de Platform con openai-responses, o endpoint HTTPS oficial exacto de ChatGPT con openai-chatgpt-responses; sin anulación de solicitud definida |
Se puede seleccionar Codex |
Adaptador openai-completions definido |
OpenClaw |
| Endpoint personalizado | OpenClaw |
| Endpoint oficial exacto explícito que usa HTTP | Rechazado |
| Ruta con una anulación de solicitud de proveedor/modelo definida | OpenClaw |
Una configuración agentRuntime.id explícita y no predeterminada del proveedor/modelo sigue siendo vinculante.
Por ejemplo, agentRuntime.id: "openclaw" mantiene en OpenClaw una ruta que, de otro modo, sería
apta para Codex, mientras que agentRuntime.id: "codex" exige Codex y falla
de forma cerrada cuando la ruta efectiva no está declarada como compatible con Codex.
La selección del runtime no cambia el tipo de credencial ni la facturación: la autenticación
con clave de API de Platform y la autenticación mediante suscripción de ChatGPT/Codex siguen siendo distintas.
openclaw doctor --fix migra las referencias de modelo heredadas codex/* y openai-codex/*,
los ids de perfil de autenticación de Codex heredados y las entradas de orden de autenticación de Codex heredadas
a la ruta canónica openai. Las referencias de modelo migradas reciben
agentRuntime.id: "codex" con ámbito de modelo; use auth.order.openai para las nuevas configuraciones de orden de autenticación.
Vista previa limitada de GPT-5.6
OpenClaw reconoce los ids de modelo exactos openai/gpt-5.6-sol,
openai/gpt-5.6-terra y openai/gpt-5.6-luna. Los tres ofrecen los niveles de razonamiento
xhigh y max en el catálogo actual. OpenAI describe Sol como
el nivel insignia, Terra como el nivel equilibrado y Luna como el nivel rápido
y de menor coste. Consulte el
anuncio de lanzamiento de GPT-5.6
y la guía de acceso.
Con autenticación directa mediante clave de API de OpenAI, el id básico openai/gpt-5.6 es un alias de
Sol y el valor predeterminado de la configuración nueva. El catálogo nativo de Codex no aplica
ese alias de API directa en el cliente; según el acceso del espacio de trabajo, puede mostrar
los ids exactos de Sol, Terra y Luna. Por tanto, la configuración nueva de OAuth de ChatGPT/Codex
usa openai/gpt-5.6-sol. Compruebe la cuenta actual con:
openclaw models list --provider openaiEl acceso de la organización de la API y el del espacio de trabajo de Codex pueden ser diferentes. Si GPT-5.6 no está disponible, seleccione GPT-5.5 explícitamente:
openclaw models set openai/gpt-5.5OpenClaw muestra el error de acceso original y no sustituye silenciosamente una selección de GPT-5.6 por GPT-5.5.
Cobertura de funciones de OpenClaw
| Capacidad de OpenAI | Superficie de OpenClaw | Estado |
|---|---|---|
| Chat / Responses | proveedor de modelos openai/<model> |
Sí |
| Modelos de suscripción de Codex | openai/<model> con OAuth de OpenAI |
Sí |
| Referencias de modelos Codex heredadas | referencias de modelos Codex antiguas, codex-cli/<model> |
Reparadas por doctor a openai/<model> |
| Arnés de app-server de Codex | ruta HTTPS compatible con Codex con runtime sin establecer/auto, o agentRuntime.id: codex explícito |
Sí |
| Búsqueda web del lado del servidor | Herramienta nativa de OpenAI Responses | Sí, cuando la búsqueda web está habilitada y no se ha fijado otro proveedor |
| Imágenes | image_generate |
Sí |
| Vídeos | video_generate |
Sí |
| Texto a voz | tts.provider: "openai" / tts |
Sí |
| Voz a texto por lotes | tools.media.audio / comprensión multimedia |
Sí |
| Voz a texto en streaming | Voice Call streaming.provider: "openai" |
Sí |
| Voz en tiempo real | Voice Call realtime.provider: "openai" / Control UI Talk talk.realtime.provider: "openai" |
Sí (clave de API de OpenAI Platform) |
| Embeddings | proveedor de embeddings de memoria | Sí |
Embeddings de memoria
OpenClaw puede utilizar OpenAI, o un endpoint de embeddings compatible con
OpenAI, para la indexación de memory_search y los embeddings de consultas:
{ memory: { search: { provider: "openai", model: "text-embedding-3-small", }, },}Para los endpoints compatibles con OpenAI que requieran etiquetas de embeddings
asimétricas, establezca queryInputType y documentInputType en
memory.search. OpenClaw los reenvía como campos de solicitud
input_type específicos del proveedor: los embeddings de consultas
utilizan queryInputType; los fragmentos de memoria indexados y la indexación
por lotes utilizan documentInputType. Consulte la
referencia de configuración de memoria
para ver el ejemplo completo.
Primeros pasos
Clave de API (OpenAI Platform)
Ideal para: acceso directo a la API y facturación basada en el uso.
Obtener la clave de API
Cree o copie una clave de API desde el panel de OpenAI Platform.
Ejecutar la incorporación
openclaw onboard --auth-choice openai-api-keyO proporcione la clave directamente:
openclaw onboard --openai-api-key "$OPENAI_API_KEY"Verificar que el modelo esté disponible
openclaw models list --provider openaiResumen de rutas
| Referencia del modelo | Política del runtime o datos de la ruta | Ruta | Autenticación |
|---|---|---|---|
openai/gpt-5.6 |
sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud |
Puede seleccionarse Codex | Perfil ordenado de autenticación mediante clave de API |
openai/gpt-5.6 |
proveedor/modelo agentRuntime.id: "openclaw" |
Runtime integrado de OpenClaw | Perfil de clave de API openai seleccionado |
openai/gpt-5.5 |
proveedor/modelo agentRuntime.id explícito |
Runtime de agente seleccionado | Perfil de clave de API de OpenAI seleccionado |
openai/* |
Completions creadas, personalizadas o con sobrescritura de solicitud | Runtime integrado de OpenClaw | El tipo de credencial permanece sin cambios |
openai/* |
endpoint HTTP oficial sin cifrar | Rechazada | La credencial no se envía |
Ejemplo de configuración
{ env: { OPENAI_API_KEY: "example-openai-key-not-real" }, agents: { defaults: { model: { primary: "openai/gpt-5.6" } } },}El id gpt-5.6 de la API directa sin calificar se resuelve al nivel
Sol. Si esta organización de la API no ofrece GPT-5.6, establezca
explícitamente el modelo principal en openai/gpt-5.5.
Para probar el modelo Instant actual de ChatGPT desde la API de OpenAI,
establezca el modelo en openai/chat-latest:
{ env: { OPENAI_API_KEY: "example-openai-key-not-real" }, agents: { defaults: { model: { primary: "openai/chat-latest" } } },}chat-latest es un alias dinámico. En cambio, la nueva configuración
mediante clave de API de OpenAI utiliza openai/gpt-5.6, cuyo id de API
directa sin calificar se resuelve a Sol. Los modelos principales explícitos
existentes, incluido openai/gpt-5.5, permanecen sin cambios. El alias
chat-latest solo acepta la verbosidad de texto medium;
OpenClaw fuerza cualquier otra verbosidad solicitada a medium
para este modelo.
Suscripción de Codex
Ideal para: utilizar la suscripción a ChatGPT/Codex con ejecución nativa mediante app-server de Codex en lugar de una clave de API independiente. Codex Cloud requiere iniciar sesión en ChatGPT.
Ejecutar OAuth de Codex
openclaw onboard --auth-choice openaiO ejecute OAuth directamente:
openclaw models auth login --provider openaiPara configuraciones sin interfaz gráfica o incompatibles con la
devolución de llamada, añada --device-code para iniciar sesión con
un flujo de código de dispositivo de ChatGPT en lugar de la devolución
de llamada del navegador local:
openclaw models auth login --provider openai --device-codeUsar la ruta canónica del modelo de OpenAI
openclaw config set agents.defaults.model.primary openai/gpt-5.6-solNo se requiere ninguna configuración del runtime para esta ruta nativa HTTPS oficial exacta. Puede seleccionar automáticamente el runtime de app-server de Codex, y OpenClaw instala o repara el plugin de Codex incluido cuando se elige ese runtime.
Verificar que la autenticación de Codex esté disponible
openclaw models list --provider openaiDespués de que el Gateway esté en funcionamiento, envíe
/codex status o /codex models en el chat para verificar el
runtime nativo de app-server.
Resumen de rutas
| Referencia del modelo | Política del runtime o datos de la ruta | Ruta | Autenticación |
|---|---|---|---|
openai/gpt-5.6-sol |
sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud |
Puede seleccionarse Codex | Inicio de sesión de Codex o un perfil de autenticación openai ordenado |
openai/gpt-5.6-terra |
sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud |
Puede seleccionarse Codex | Inicio de sesión de Codex cuando el catálogo ofrece Terra |
openai/gpt-5.6-luna |
sin establecer/auto, ruta nativa HTTPS oficial exacta, sin sobrescritura de solicitud |
Puede seleccionarse Codex | Inicio de sesión de Codex cuando el catálogo ofrece Luna |
openai/gpt-5.6-sol |
proveedor/modelo agentRuntime.id: "openclaw" |
Runtime integrado de OpenClaw, transporte interno de autenticación de Codex | Perfil OAuth openai seleccionado |
openai/gpt-5.5 |
proveedor/modelo agentRuntime.id explícito |
Runtime de agente seleccionado | Perfil de autenticación de OpenAI seleccionado |
openai/* |
Completions creadas, personalizadas o con sobrescritura de solicitud | Runtime integrado de OpenClaw | El requisito de credenciales sigue siendo específico de la ruta |
openai/* |
endpoint HTTP oficial sin cifrar | Rechazada | La credencial no se envía |
| Referencia heredada de Codex GPT-5.5 | reparada por doctor | Reescrita como openai/gpt-5.5 |
Perfil OAuth de OpenAI migrado |
codex-cli/gpt-5.5 |
reparada por doctor | Reescrita como openai/gpt-5.5 |
Autenticación de app-server de Codex |
Ejemplo de configuración
{ plugins: { entries: { codex: { enabled: true } } }, agents: { defaults: { model: { primary: "openai/gpt-5.6-sol" }, }, },}Con una clave de API de respaldo, mantenga el modelo seleccionado en openai/* y coloque
el orden de autenticación en openai. OpenClaw prueba primero la suscripción y después
la clave de API, sin abandonar el entorno de Codex:
{ plugins: { entries: { codex: { enabled: true } } }, agents: { defaults: { model: { primary: "openai/gpt-5.6-sol" }, }, }, auth: { order: { openai: [ "openai:user@example.com", "openai:api-key-backup", ], }, },}Comprobar y recuperar el enrutamiento OAuth de Codex
openclaw models statusopenclaw models auth list --provider openaiopenclaw config get agents.defaults.model --jsonopenclaw config get models.providers.openai.agentRuntime --jsonPara un agente específico, añada --agent <id>:
openclaw models status --agent <id>openclaw models auth list --agent <id> --provider openaiSi una configuración anterior todavía contiene referencias heredadas de Codex GPT o una fijación obsoleta de sesión del entorno de ejecución de OpenAI sin una configuración explícita del entorno de ejecución, repárela:
openclaw doctor --fixopenclaw config validateSi models auth list --provider openai no muestra ningún perfil utilizable, inicie sesión
de nuevo:
openclaw models auth login --provider openaiopenclaw models status --probe --probe-provider openaiUse --profile-id para varios inicios de sesión OAuth de Codex en el mismo agente y después
contrólelos mediante el orden de autenticación o /model ...@<profileId>:
openclaw models auth login --provider openai --profile-id openai:ritsukoopenclaw models auth login --provider openai --profile-id openai:lainEjecute openclaw doctor --fix para migrar los identificadores de perfil y las entradas de orden anteriores
con el prefijo heredado OpenAI Codex antes de depender del orden de los perfiles.
Indicador de estado
/status en el chat muestra qué entorno de ejecución del modelo está activo para la
sesión actual. El entorno de servidor de aplicaciones Codex incluido aparece como
Runtime: OpenAI Codex cuando lo selecciona una ruta implícita apta o una
política explícita de entorno de ejecución de proveedor/modelo.
Advertencia de doctor
Si permanecen referencias heredadas de modelos Codex o fijaciones obsoletas del entorno de ejecución de OpenAI
en la configuración o en el estado de la sesión, openclaw doctor --fix las reescribe como openai/* con
el entorno de ejecución de Codex, salvo que OpenClaw esté configurado explícitamente.
Valores predeterminados de la ventana de contexto y activación voluntaria del contexto largo
OpenClaw trata la capacidad nativa del modelo y el presupuesto del entorno de ejecución activo como valores independientes:
contextWindowdeclara la ventana total del modelo del proveedor.contextTokenslimita cuánto de esa ventana utiliza OpenClaw para la entrada activa.
OAuth de ChatGPT/Codex sigue el catálogo activo de la cuenta de Codex. Actualmente, el
catálogo suele anunciar una ventana activa de 272000 tokens para GPT-5.6.
Los modelos GPT-5.5 y GPT-5.6 mediante clave de API directa también usan de forma predeterminada 272000
contextTokens, aunque la API de la plataforma expone una ventana nativa
mayor. Esto mantiene coherentes los perfiles habituales de latencia, calidad y coste
entre los distintos modos de autenticación. Un valor configurado de agents.defaults.contextTokens
puede reducir aún más ese presupuesto, pero no puede elevar un modelo por encima de su límite
configurado de contextTokens.
Para GPT-5.5 y GPT-5.6 mediante clave de API directa, OpenAI documenta una ventana del proveedor de
1050000 tokens y 128000 tokens máximos de salida. Reservar la
asignación completa de salida deja 922000 tokens para la entrada. Se trata de un presupuesto
operativo derivado, no de un límite de entrada independiente publicado por el proveedor. Consulte la
comparación de modelos
y la página del modelo GPT-5.5
oficiales. El ejemplo siguiente habilita esa asignación para un modelo Terra y solicita
a OpenAI que realice la compactación al alcanzar 700000 tokens activos:
{ models: { providers: { openai: { models: [ { id: "gpt-5.6-terra", name: "GPT-5.6 Terra", contextWindow: 1050000, contextTokens: 922000, maxTokens: 128000, }, ], }, }, }, agents: { defaults: { model: { primary: "openai/gpt-5.6-terra" }, models: { "openai/gpt-5.6-terra": { agentRuntime: { id: "openclaw" }, params: { responsesServerCompaction: true, responsesCompactThreshold: 700000, }, }, }, }, },}agentRuntime.id: "openclaw" es intencional en este ejemplo. Demuestra que la
ruta integrada de Responses de OpenClaw utiliza los metadatos del modelo y la configuración de
compactación del servidor anteriores. En cambio, un hilo del entorno nativo de Codex gestiona su presupuesto
de contexto en la configuración de Codex; consulte
contexto largo del entorno de Codex.
Recuperación del catálogo
OpenClaw utiliza los metadatos del catálogo ascendente de Codex para gpt-5.5 cuando están
presentes. Si el descubrimiento en vivo de Codex omite la fila gpt-5.5 mientras la cuenta
está autenticada, OpenClaw sintetiza esa fila del modelo OAuth para que las ejecuciones de cron,
subagentes y modelos predeterminados configurados no fallen con
Unknown model.
Autenticación del servidor de aplicaciones nativo de Codex
El entorno de servidor de aplicaciones nativo de Codex utiliza referencias de modelo openai/* cuando una ruta
HTTPS oficial exacta y apta lo selecciona implícitamente, o cuando la configuración de proveedor/modelo
agentRuntime.id: "codex" lo selecciona explícitamente. Su autenticación sigue estando
basada en cuentas. OpenClaw selecciona la autenticación en este orden:
- Perfiles de autenticación de OpenAI ordenados para el agente, preferiblemente en
auth.order.openai. Ejecuteopenclaw doctor --fixpara migrar identificadores anteriores de perfiles de autenticación heredados de Codex y el orden de autenticación. - La cuenta existente del servidor de aplicaciones, como un inicio de sesión local de ChatGPT en la CLI de Codex. Para el directorio principal aislado predeterminado del agente, OpenClaw enlaza esa cuenta nativa de la CLI con el servidor de aplicaciones mediante su RPC de inicio de sesión; no comparte la configuración, los plugins ni el almacén de hilos de la CLI.
- Solo para ejecuciones locales del servidor de aplicaciones mediante stdio y únicamente cuando el servidor de aplicaciones
no informa de ninguna cuenta:
CODEX_API_KEYy despuésOPENAI_API_KEY.
Un inicio de sesión local de suscripción de ChatGPT/Codex no se sustituye solo porque el
proceso del Gateway también disponga de OPENAI_API_KEY para modelos directos de OpenAI o
representaciones vectoriales. La alternativa mediante clave de API del entorno solo se aplica a la ruta local
de stdio sin cuenta; nunca se envía mediante conexiones WebSocket del servidor de aplicaciones. Cuando se
selecciona un perfil de Codex basado en suscripción, OpenClaw también mantiene
CODEX_API_KEY y OPENAI_API_KEY fuera del proceso hijo del servidor de aplicaciones stdio
y envía las credenciales seleccionadas mediante el RPC de inicio de sesión del servidor de aplicaciones.
Cuando ese perfil de suscripción queda bloqueado por un límite de uso de Codex, OpenClaw
marca el perfil como bloqueado hasta la hora de restablecimiento anunciada por Codex y permite que el orden de
autenticación rote al siguiente perfil openai:*, sin cambiar el modelo seleccionado
ni abandonar el entorno de Codex. Una vez transcurrida la hora de restablecimiento, el
perfil de suscripción vuelve a ser apto.
Generación de imágenes
El plugin openai incluido registra la generación de imágenes mediante la
herramienta image_generate. Admite la generación de imágenes tanto mediante clave de API de OpenAI como mediante
OAuth de Codex con la misma referencia de modelo openai/gpt-image-2.
| Capacidad | Clave de API de OpenAI | OAuth de Codex |
|---|---|---|
| Referencia del modelo | openai/gpt-image-2 |
openai/gpt-image-2 |
| Autenticación | OPENAI_API_KEY |
Inicio de sesión OAuth de OpenAI Codex |
| Transporte | API de imágenes de OpenAI | Backend de Responses de Codex |
| Máximo de imágenes por solicitud | 4 | 4 |
| Modo de edición | Habilitado (hasta 5 imágenes de referencia) | Habilitado (hasta 5 imágenes de referencia) |
| Sustituciones de tamaño | Compatibles, incluidos tamaños 2K/4K | Compatibles, incluidos tamaños 2K/4K |
| Relación de aspecto / resolución | No se reenvía a la API de imágenes de OpenAI | Se asigna a un tamaño compatible cuando es seguro |
{ agents: { defaults: { imageGenerationModel: { primary: "openai/gpt-image-2" }, }, },}gpt-image-2 es el valor predeterminado para la generación de imágenes a partir de texto y la edición de imágenes
de OpenAI. gpt-image-1.5, gpt-image-1 y gpt-image-1-mini siguen estando disponibles
como sustituciones explícitas del modelo. Use openai/gpt-image-1.5 para obtener
salidas PNG/WebP con fondo transparente; la API actual gpt-image-2 rechaza
background: "transparent".
Para una solicitud con fondo transparente, invoque image_generate con
model: "openai/gpt-image-1.5", outputFormat: "png" o "webp", y
background: "transparent"; la opción anterior de proveedor openai.background
todavía se acepta. OpenClaw también protege las rutas públicas de OpenAI y OAuth de OpenAI Codex
reescribiendo las solicitudes transparentes predeterminadas de openai/gpt-image-2 como
gpt-image-1.5; Azure y los endpoints personalizados compatibles con OpenAI conservan sus
nombres configurados de implementación/modelo.
La misma configuración está disponible para ejecuciones de la CLI sin interfaz gráfica:
openclaw infer image generate \ --model openai/gpt-image-1.5 \ --output-format png \ --background transparent \ --prompt "Una pegatina sencilla de un círculo rojo sobre un fondo transparente" \ --jsonUse las mismas opciones --output-format y --background con
openclaw infer image edit cuando parta de un archivo de entrada.
--openai-background sigue estando disponible como alias específico de OpenAI. Use
--quality low|medium|high|auto para controlar la calidad y el coste de las imágenes de OpenAI.
Use --openai-moderation low|auto para pasar la indicación de moderación de OpenAI desde
image generate o image edit.
Para las instalaciones OAuth de ChatGPT/Codex, mantenga la misma referencia openai/gpt-image-2. Cuando
se configura un perfil OAuth openai, OpenClaw resuelve ese token de acceso OAuth
almacenado y envía las solicitudes de imágenes mediante el backend Codex Responses; no
intenta primero OPENAI_API_KEY ni recurre silenciosamente a una clave de API.
Configure models.providers.openai explícitamente con una clave de API, una URL base
personalizada o un endpoint de Azure cuando quiera usar en su lugar la ruta directa
de la API de OpenAI Images. Si ese endpoint de imágenes personalizado se encuentra en una
dirección LAN/privada de confianza, establezca también browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true; OpenClaw
mantiene bloqueados los endpoints de imágenes privados/internos compatibles con OpenAI
a menos que esta habilitación explícita esté presente.
Generar:
/tool image_generate model=openai/gpt-image-2 prompt="Un póster de lanzamiento refinado para OpenClaw en macOS" size=3840x2160 count=1Generar un PNG transparente:
/tool image_generate model=openai/gpt-image-1.5 prompt="Una pegatina sencilla de un círculo rojo sobre un fondo transparente" outputFormat=png background=transparentEditar:
/tool image_generate model=openai/gpt-image-2 prompt="Conserva la forma del objeto y cambia el material por vidrio translúcido" image=/path/to/reference.png size=1024x1536Generación de vídeo
El plugin openai incluido registra la generación de vídeo mediante la
herramienta video_generate.
| Capacidad | Valor |
|---|---|
| Modelo predeterminado | openai/sora-2 |
| Modos | Texto a vídeo, imagen a vídeo, edición de un solo vídeo |
| Entradas de referencia | 1 imagen o 1 vídeo |
| Anulaciones de tamaño | Compatibles con texto a vídeo e imagen a vídeo |
| Relación de aspecto | Se convierte al tamaño compatible más cercano; no se reenvía sin procesar |
| Otras anulaciones | resolution, audio, watermark no son compatibles y se descartan con una advertencia de la herramienta |
Las solicitudes de imagen a vídeo de OpenAI usan POST /v1/videos con una
input_reference de imagen. Las ediciones de un solo vídeo usan POST /v1/videos/edits con el
vídeo cargado en el campo video.
{ agents: { defaults: { videoGenerationModel: { primary: "openai/sora-2" }, }, },}Contribución al prompt de GPT-5
OpenClaw añade una contribución compartida al prompt de GPT-5 para los modelos de la
familia GPT-5 en el proveedor openai (incluidas las referencias heredadas de Codex anteriores a la reparación que se normalizan
a openai/*). Otros proveedores que también ofrecen identificadores de modelos de la familia GPT-5, como
OpenRouter o las rutas de opencode, no reciben esta capa; se condiciona al
identificador de proveedor openai, no solo al identificador de modelo. Los modelos GPT-4.x anteriores nunca
la reciben.
El entorno nativo del servidor de aplicaciones de Codex no recibe el contrato de comportamiento de personalidad y disciplina de herramientas ni la capa de estilo de interacción cordial mediante instrucciones para desarrolladores; Codex nativo conserva el comportamiento base, de modelo y de documentación del proyecto propio de Codex, y OpenClaw desactiva la personalidad integrada de Codex para los hilos nativos, de modo que los archivos de personalidad del espacio de trabajo del agente sigan siendo la autoridad. OpenClaw solo aporta contexto de ejecución a los hilos nativos de Codex: entrega por canales, herramientas dinámicas de OpenClaw, delegación ACP, contexto del espacio de trabajo y Skills de OpenClaw. El texto de orientación de Heartbeat de esta misma contribución es la única excepción: los turnos de Heartbeat de Codex nativo sí lo reciben, insertado como instrucciones de colaboración específicas en lugar de mediante el enlace compartido de contribución al prompt.
La contribución de GPT-5 añade un contrato de comportamiento etiquetado para la persistencia de la personalidad, la seguridad de ejecución, la disciplina de herramientas, la forma de la salida, las comprobaciones de finalización y la verificación en los prompts coincidentes ensamblados por OpenClaw. El comportamiento de respuesta y de mensajes silenciosos específico de cada canal permanece en el prompt del sistema compartido de OpenClaw y en la política de entrega saliente. La capa de estilo de interacción cordial es independiente y configurable.
| Valor | Efecto |
|---|---|
"friendly" (predeterminado) |
Activa la capa de estilo de interacción cordial |
"on" |
Alias de "friendly" |
"off" |
Desactiva solo la capa de estilo cordial |
Configuración
{ agents: { defaults: { promptOverlays: { gpt5: { personality: "friendly" }, }, }, },}CLI
openclaw config set agents.defaults.promptOverlays.gpt5.personality offVoz y habla
Síntesis de voz (TTS)
El plugin openai incluido registra la síntesis de voz para la
superficie tts.
| Ajuste | Ruta de configuración | Valor predeterminado |
|---|---|---|
| Modelo | tts.providers.openai.model |
gpt-4o-mini-tts |
| Voz | tts.providers.openai.speakerVoice |
coral |
| Velocidad | tts.providers.openai.speed |
(sin establecer) |
| Instrucciones | tts.providers.openai.instructions |
(sin establecer, solo gpt-4o-mini-tts) |
| Formato | tts.providers.openai.responseFormat |
opus para notas de voz, mp3 para archivos |
| Clave de API | tts.providers.openai.apiKey |
Recurre a OPENAI_API_KEY |
| URL base | tts.providers.openai.baseUrl |
https://api.openai.com/v1 |
| Cuerpo adicional | tts.providers.openai.extraBody / extra_body |
(sin establecer) |
Modelos disponibles: gpt-4o-mini-tts, tts-1, tts-1-hd. Voces disponibles:
alloy, ash, ballad, cedar, coral, echo, fable, juniper,
marin, onyx, nova, sage, shimmer, verse.
extraBody se combina con el JSON de la solicitud /audio/speech después de los
campos generados por OpenClaw, por lo que debe usarse para endpoints compatibles con OpenAI que requieran
claves adicionales como lang. Las claves de prototipo se ignoran.
{ tts: { providers: { openai: { model: "gpt-4o-mini-tts", speakerVoice: "coral" }, }, },}Voz a texto
El plugin openai incluido registra la conversión por lotes de voz a texto mediante
la superficie de transcripción para comprensión de medios de OpenClaw.
- Modelo predeterminado:
gpt-4o-transcribe - Endpoint: REST de OpenAI
/v1/audio/transcriptions - Ruta de entrada: carga de archivo de audio multiparte
- Se usa siempre que la transcripción de audio entrante lee
tools.media.audio, incluidos los segmentos de canales de voz de Discord y los archivos adjuntos de audio de los canales
Para forzar el uso de OpenAI en la transcripción de audio entrante:
{ tools: { media: { audio: { models: [ { type: "provider", provider: "openai", model: "gpt-4o-transcribe", }, ], }, }, },}Las indicaciones de idioma y prompt se reenvían a OpenAI cuando las proporciona la configuración compartida de medios de audio o la solicitud de transcripción de cada llamada.
Transcripción en tiempo real
El plugin openai incluido registra la transcripción en tiempo real para el
plugin Voice Call.
| Ajuste | Ruta de configuración | Valor predeterminado |
|---|---|---|
| Modelo | plugins.entries.voice-call.config.streaming.providers.openai.model |
gpt-4o-transcribe |
| Idioma | ...openai.language |
(sin establecer) |
| Prompt | ...openai.prompt |
(sin establecer) |
| Duración del silencio | ...openai.silenceDurationMs |
800 |
| Umbral de VAD | ...openai.vadThreshold |
0.5 |
| Autenticación | ...openai.apiKey, OPENAI_API_KEY o perfil de clave de API openai |
Se requiere una clave de API de Platform |
Voz en tiempo real
El plugin openai incluido registra la voz en tiempo real para el plugin Voice Call.
| Ajuste | Ruta de configuración | Valor predeterminado |
|---|---|---|
| Modelo | plugins.entries.voice-call.config.realtime.providers.openai.model |
gpt-realtime-2.1 |
| Voz | ...openai.voice |
alloy |
| Temperatura (puente de implementación de Azure) | ...openai.temperature |
0.8 |
| Umbral de VAD | ...openai.vadThreshold |
0.5 |
| Duración del silencio | ...openai.silenceDurationMs |
500 |
| Relleno de prefijo | ...openai.prefixPaddingMs |
300 |
| Esfuerzo de razonamiento | ...openai.reasoningEffort |
(sin establecer) |
| Autenticación | Perfil de clave de API openai, ...openai.apiKey o OPENAI_API_KEY |
Se requiere una clave de API de OpenAI Platform |
Voces Realtime integradas disponibles para gpt-realtime-2.1: alloy, ash,
ballad, coral, echo, sage, shimmer, verse, marin, cedar.
OpenAI recomienda marin y cedar para obtener la mejor calidad de Realtime. Este
es un conjunto distinto del de las voces de texto a voz anteriores; una voz exclusiva de TTS,
como fable, nova o onyx, no es válida para sesiones de Realtime.
Establezca explícitamente el modelo en gpt-realtime-2.1-mini si prefiere la
variante Realtime 2.1 más pequeña y de menor costo.
Endpoints de Azure OpenAI
El proveedor openai incluido puede dirigirse a un recurso de Azure OpenAI para la generación
de imágenes reemplazando la URL base. En la ruta de generación de imágenes, OpenClaw
detecta los nombres de host de Azure en models.providers.openai.baseUrl y cambia automáticamente a
la estructura de solicitud de Azure.
Use Azure OpenAI cuando:
- Ya disponga de una suscripción, cuota o acuerdo empresarial de Azure OpenAI
- Necesite la residencia regional de datos o los controles de cumplimiento que proporciona Azure
- Quiera mantener el tráfico dentro de una suscripción existente de Azure
Configuración
Para generar imágenes en Azure mediante el proveedor openai incluido, dirija
models.providers.openai.baseUrl a su recurso de Azure y establezca apiKey en
la clave de Azure OpenAI (no una clave de OpenAI Platform):
{ models: { providers: { openai: { baseUrl: "https://<your-resource>.openai.azure.com", apiKey: "<azure-openai-api-key>", }, }, },}OpenClaw reconoce estos sufijos de host de Azure para la ruta de generación de imágenes de Azure:
*.openai.azure.com*.services.ai.azure.com*.cognitiveservices.azure.com
Para las solicitudes de generación de imágenes en un host de Azure reconocido, OpenClaw:
- Envía el encabezado
api-keyen lugar deAuthorization: Bearer - Utiliza rutas limitadas a la implementación (
/openai/deployments/{deployment}/...) - Añade
?api-version=...a cada solicitud - Utiliza un tiempo de espera predeterminado de 600s para las llamadas de generación de imágenes de Azure.
Los valores de
timeoutMspor llamada siguen reemplazando este valor predeterminado.
Las demás URL base (OpenAI público y proxies compatibles con OpenAI) conservan la estructura estándar de solicitud de imágenes de OpenAI.
Versión de la API
Establezca AZURE_OPENAI_API_VERSION para fijar una versión preliminar o con disponibilidad general específica
de Azure para la ruta de generación de imágenes de Azure:
export AZURE_OPENAI_API_VERSION="2024-12-01-preview"El valor predeterminado es 2024-12-01-preview cuando la variable no está establecida.
Los nombres de modelo son nombres de implementación
Azure OpenAI vincula los modelos a implementaciones. Para las solicitudes de generación de imágenes
de Azure enrutadas mediante el proveedor openai incluido, el campo model de OpenClaw
debe ser el nombre de la implementación de Azure configurado en el portal de Azure, no
el identificador público del modelo de OpenAI.
Si crea una implementación llamada gpt-image-2-prod que sirve gpt-image-2:
/tool image_generate model=openai/gpt-image-2-prod prompt="Un cartel sencillo" size=1024x1024 count=1La misma regla del nombre de implementación se aplica a cualquier llamada de generación de imágenes enrutada
mediante el proveedor openai incluido.
Disponibilidad regional
Actualmente, la generación de imágenes de Azure solo está disponible en un subconjunto de regiones
(por ejemplo, eastus2, swedencentral, polandcentral, westus3,
uaenorth). Consulte la lista actual de regiones de Microsoft antes de crear una
implementación y confirme que el modelo específico esté disponible en su región.
Diferencias entre parámetros
Azure OpenAI y OpenAI público no siempre aceptan los mismos parámetros de imagen.
Azure puede rechazar opciones permitidas por OpenAI público (por ejemplo, determinados
valores de background en gpt-image-2) o exponerlas únicamente en versiones específicas
del modelo. Estas diferencias proceden de Azure y del modelo subyacente, no de
OpenClaw. Si una solicitud de Azure falla con un error de validación, consulte en el
portal de Azure el conjunto de parámetros compatible con su implementación y versión de API
específicas.
Configuración avanzada
Los siguientes ejemplos de params por modelo determinan la solicitud del proveedor
integrado de OpenClaw. Configurarlos constituye un comportamiento de solicitud definido, por lo que una ruta
auto que cumpla los requisitos permanece en OpenClaw en lugar de seleccionar Codex implícitamente. El
entorno del servidor de aplicaciones nativo de Codex administra su propio transporte y sus propios ajustes de solicitud; un
agentRuntime.id: "codex" explícito produce un fallo seguro cuando la ruta efectiva no está declarada como
compatible con Codex.
Transporte (WebSocket frente a SSE)
OpenClaw utiliza WebSocket primero con SSE como alternativa ("auto") para openai/*.
En el modo "auto", OpenClaw:
- Reintenta una vez tras un fallo inicial de WebSocket antes de recurrir a SSE
- Después de un fallo, marca WebSocket como degradado durante 60 segundos y utiliza SSE durante el periodo de espera
- Adjunta encabezados estables de identidad de sesión y turno para los reintentos y las reconexiones
- Normaliza los contadores de uso (
input_tokens/prompt_tokens) entre las variantes de transporte
| Valor | Comportamiento |
|---|---|
"auto" (predeterminado) |
WebSocket primero, SSE como alternativa |
"sse" |
Forzar solo SSE |
"websocket" |
Forzar solo WebSocket |
{ agents: { defaults: { models: { "openai/gpt-5.5": { params: { transport: "auto" }, }, }, }, },}Documentación relacionada de OpenAI:
Modo rápido
OpenClaw ofrece un control compartido del modo rápido para openai/*:
- Chat/interfaz:
/fast status|auto|on|off - Configuración:
agents.defaults.models["<provider>/<model>"].params.fastMode
Cuando está habilitado, OpenClaw asigna el modo rápido al procesamiento prioritario de OpenAI
(service_tier = "priority"). Los valores existentes de service_tier se
conservan, y el modo rápido no modifica reasoning ni
text.verbosity. fastMode: "auto" inicia rápidamente las nuevas llamadas al modelo hasta el
límite automático y, después, inicia las llamadas posteriores de reintento, alternativa, resultado de herramienta o
continuación sin el modo rápido. El límite predeterminado es de 60 segundos;
establezca params.fastAutoOnSeconds en el modelo activo para cambiarlo.
{ agents: { defaults: { models: { "openai/gpt-5.5": { params: { fastMode: "auto", fastAutoOnSeconds: 30 } }, }, }, },}Procesamiento prioritario (service_tier)
La API de OpenAI ofrece procesamiento prioritario mediante service_tier. Se configura por
modelo en OpenClaw:
{ agents: { defaults: { models: { "openai/gpt-5.5": { params: { serviceTier: "priority" } }, }, }, },}Valores admitidos: auto, default, flex, priority.
Compaction del lado del servidor (API Responses)
Para los modelos directos de OpenAI Responses (openai/* en api.openai.com), el
contenedor de flujos de OpenClaw del Plugin de OpenAI habilita automáticamente la
Compaction del lado del servidor:
- Fuerza
store: true(a menos que la compatibilidad del modelo establezcasupportsStore: false) - Inyecta
context_management: [{ type: "compaction", compact_threshold: ... }] - Valor predeterminado de
compact_threshold: el 70 % decontextWindow(o80000cuando no esté disponible)
Esto se aplica a la ruta integrada del entorno de ejecución de OpenClaw y a los hooks del proveedor de OpenAI utilizados por las ejecuciones integradas. El entorno nativo del servidor de aplicaciones de Codex gestiona su propio contexto mediante Codex y esta configuración no le afecta.
Habilitar explícitamente
Resulta útil para endpoints compatibles, como Azure OpenAI Responses:
{ agents: { defaults: { models: { "azure-openai-responses/gpt-5.5": { params: { responsesServerCompaction: true }, }, }, }, },}Umbral personalizado
{ agents: { defaults: { models: { "openai/gpt-5.5": { params: { responsesServerCompaction: true, responsesCompactThreshold: 120000, }, }, }, }, },}Deshabilitar
{ agents: { defaults: { models: { "openai/gpt-5.5": { params: { responsesServerCompaction: false }, }, }, }, },}Modo GPT agéntico estricto
Para los modelos de la familia GPT-5 del proveedor openai que se ejecutan mediante el
entorno de ejecución integrado de OpenClaw, OpenClaw ya utiliza de forma predeterminada un contrato de
ejecución más estricto denominado strict-agentic. Se activa automáticamente siempre que el proveedor
resuelto sea openai y el id del modelo coincida con la familia GPT-5, salvo que la configuración
deshabilite explícitamente este comportamiento:
{ agents: { defaults: { embeddedAgent: { executionContract: "default" }, }, },}Establecer "strict-agentic" explícitamente no produce ningún efecto en una ruta compatible (ya
es el valor predeterminado) y permanece inactivo para las combinaciones de proveedor y modelo no compatibles.
Con strict-agentic activo, OpenClaw:
- Habilita automáticamente
update_planpara trabajos sustanciales - Reintenta los turnos estructuralmente vacíos o que solo contienen razonamiento con una continuación que proporciona una respuesta visible
- Utiliza eventos de planificación explícitos del entorno cuando el entorno seleccionado los proporciona
OpenClaw no clasifica el texto del asistente para decidir si un turno es un plan, una actualización del progreso o una respuesta final.
Rutas nativas frente a rutas compatibles con OpenAI
OpenClaw trata los endpoints directos de OpenAI, Codex y Azure OpenAI
de forma distinta a los proxies genéricos /v1 compatibles con OpenAI:
Rutas nativas (openai/*, Azure OpenAI):
- Conservan
reasoning: { effort: "none" }solo para los modelos compatibles con el nivel de esfuerzononede OpenAI - Omiten el razonamiento deshabilitado para los modelos o proxies que rechazan
reasoning.effort: "none" - Utilizan de forma predeterminada el modo estricto para los esquemas de herramientas
- Adjuntan encabezados de atribución ocultos únicamente en hosts nativos verificados (Azure OpenAI no recibe estos encabezados, aunque sea una ruta nativa)
- Mantienen la adaptación de solicitudes exclusiva de OpenAI (
service_tier,store, compatibilidad de razonamiento, indicaciones de caché de prompts)
Rutas de proxy/compatibles:
- Utilizan un comportamiento de compatibilidad menos estricto
- Eliminan
storede Completions de las cargas útilesopenai-completionsno nativas - Aceptan JSON avanzado de paso directo
params.extra_body/params.extraBodypara proxies de Completions compatibles con OpenAI - Aceptan
params.chat_template_kwargspara proxies de Completions compatibles con OpenAI, como vLLM - No fuerzan esquemas estrictos de herramientas ni encabezados exclusivos de rutas nativas
Temas relacionados
Selección de proveedores, referencias de modelos y comportamiento de conmutación por error.
Parámetros compartidos de la herramienta de imágenes y selección de proveedores.
Parámetros compartidos de la herramienta de vídeo y selección de proveedores.
Detalles de autenticación y reglas de reutilización de credenciales.