Providers
NVIDIA
NVIDIA ofrece modelos abiertos de forma gratuita mediante una API compatible con OpenAI en
https://integrate.api.nvidia.com/v1, autenticada con una clave de API de
build.nvidia.com. OpenClaw
establece de forma predeterminada Nemotron 3 Ultra para el proveedor NVIDIA, el modelo de razonamiento de NVIDIA con 550B de parámetros totales / 55B
activos para trabajo agéntico con contextos largos.
Primeros pasos
Obtener la clave de API
Cree una clave de API en build.nvidia.com.
Exportar la clave y ejecutar la incorporación
export NVIDIA_API_KEY="nvapi-..."openclaw onboard --auth-choice nvidia-api-keyEstablecer un modelo de NVIDIA
openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55bPara una configuración no interactiva, pase la clave directamente:
openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."Ejemplo de configuración
{ env: { NVIDIA_API_KEY: "nvapi-..." }, models: { providers: { nvidia: { baseUrl: "https://integrate.api.nvidia.com/v1", api: "openai-completions", }, }, }, agents: { defaults: { model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" }, }, },}Catálogo destacado
Cuando se configura una clave de API de NVIDIA, las rutas de configuración y selección de modelos obtienen
el catálogo público de modelos destacados de NVIDIA desde
https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json y
almacenan el resultado en caché durante 24 horas (las primeras 32 entradas, importadas como
filas gratuitas con entrada de texto). Por lo tanto, los nuevos modelos destacados de build.nvidia.com aparecen en las superficies de configuración y
selección de modelos sin esperar a una versión de OpenClaw. Cuando la
fuente en directo está disponible, el primer modelo devuelto es la opción preseleccionada
durante la configuración de NVIDIA.
La obtención utiliza una política fija de host HTTPS para assets.ngc.nvidia.com. Si no
se configura ninguna clave de API de NVIDIA, o si la fuente no está disponible o tiene un formato incorrecto,
OpenClaw recurre al catálogo incluido y al valor predeterminado incluido que se indican a continuación.
Nemotron 3 Ultra
Nemotron 3 Ultra es el modelo de NVIDIA predeterminado en OpenClaw. La página de NVIDIA Build para
nvidia/nemotron-3-ultra-550b-a55b
lo muestra como un endpoint gratuito disponible con una especificación de contexto de 1M tokens.
La fila incluida de Ultra envía
chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }
de forma predeterminada para que la salida normal del chat permanezca en la respuesta visible en lugar de
exponer el texto de razonamiento.
Use Ultra como opción predeterminada de NVIDIA con la mayor capacidad. Mantenga Super seleccionado cuando quiera la opción Nemotron 3 más pequeña, o elija uno de los modelos de terceros alojados en el catálogo de NVIDIA cuando su contexto, latencia o comportamiento resulte más adecuado.
Catálogo alternativo incluido
Las filas seleccionables incluidas son una instantánea del catálogo de modelos destacados de NVIDIA. Las filas de compatibilidad obsoletas siguen siendo accesibles mediante la referencia exacta, pero no aparecen en los selectores de modelos.
| Referencia del modelo | Nombre | Contexto | Salida máxima |
|---|---|---|---|
nvidia/nvidia/nemotron-3-ultra-550b-a55b |
Nemotron 3 Ultra 550B | 1,048,576 | 8,192 |
nvidia/nvidia/nemotron-3-super-120b-a12b |
Nemotron 3 Super 120B | 1,000,000 | 8,192 |
nvidia/z-ai/glm-5.2 |
GLM 5.2 | 202,752 | 8,192 |
nvidia/moonshotai/kimi-k2.6 |
Kimi K2.6 | 262,144 | 8,192 |
nvidia/minimaxai/minimax-m3 |
Minimax M3 | 196,608 | 8,192 |
nvidia/deepseek-ai/deepseek-v4-pro |
DeepSeek V4 Pro | 262,144 | 16,384 |
nvidia/qwen/qwen3.5-397b-a17b |
Qwen3.5 397B A17B | 262,144 | 16,384 |
El catálogo de compatibilidad completo también conserva estas referencias publicadas para las configuraciones
existentes: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1,
nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 y
nvidia/minimaxai/minimax-m2.7. Siguen estando disponibles mediante la referencia exacta, pero
nunca aparecen durante la incorporación ni en los selectores de modelos.
Configuración avanzada
Comportamiento de activación automática
El proveedor se activa automáticamente cuando se establece la variable de entorno NVIDIA_API_KEY
o cuando se ha guardado una clave durante la incorporación. No se requiere ninguna configuración explícita del proveedor
aparte de la clave.
Catálogo y precios
OpenClaw prefiere el catálogo público de modelos destacados de NVIDIA cuando la autenticación de NVIDIA está
configurada y lo almacena en caché durante 24 horas. La alternativa seleccionable incluida es una
instantánea estática del catálogo de modelos destacados de NVIDIA; las filas de compatibilidad obsoletas
accesibles mediante referencia exacta se ocultan de los selectores de modelos. Los costes tienen como valor predeterminado 0 en
el código fuente, ya que NVIDIA ofrece actualmente acceso gratuito mediante API a los modelos indicados.
Endpoint compatible con OpenAI
OpenClaw se comunica con NVIDIA mediante el adaptador openai-completions a través de la
ruta estándar de completado de chat /v1. Cualquier herramienta compatible con OpenAI debería
funcionar de inmediato con la URL base de NVIDIA.
Parámetros de razonamiento de Nemotron 3 Ultra
La solicitud de ejemplo de Ultra de NVIDIA utiliza chat_template_kwargs.enable_thinking
y reasoning_budget para la salida de razonamiento. La fila incluida de Ultra de OpenClaw
desactiva de forma predeterminada el razonamiento de la plantilla para el uso normal del chat. Si necesita
habilitar la salida de razonamiento de NVIDIA o forzar otros campos de solicitud
específicos de NVIDIA, establezca parámetros por modelo y limite las sustituciones específicas del proveedor
al modelo de NVIDIA:
{ agents: { defaults: { models: { "nvidia/nvidia/nemotron-3-ultra-550b-a55b": { params: { chat_template_kwargs: { enable_thinking: true }, extra_body: { reasoning_budget: 16384 }, }, }, }, }, },}params.chat_template_kwargs se combina con cualquier chat_template_kwargs
que ya esté en la solicitud en lugar de reemplazar el objeto completo.
params.extra_body es la sustitución final del cuerpo de la solicitud compatible con OpenAI
y sobrescribe las claves de la carga útil que coincidan, por lo que debe usarse únicamente para los campos que NVIDIA
documente para el endpoint seleccionado.
Respuestas lentas de proveedores personalizados
Algunos modelos personalizados alojados por NVIDIA pueden tardar más que los ~120s predeterminados
del supervisor de inactividad del modelo antes de emitir el primer fragmento de respuesta. Para las entradas
personalizadas del proveedor NVIDIA, aumente el tiempo de espera del proveedor en lugar del tiempo de espera de todo
el entorno de ejecución del agente; timeoutSeconds abarca las solicitudes HTTP del proveedor y
aumenta el límite del supervisor de inactividad o transmisión para ese proveedor:
{ models: { providers: { "custom-integrate-api-nvidia-com": { baseUrl: "https://integrate.api.nvidia.com/v1", api: "openai-completions", apiKey: "NVIDIA_API_KEY", timeoutSeconds: 300, }, }, }, agents: { defaults: { models: { "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": { params: { thinking: "off" }, }, }, }, },}