Providers

NVIDIA

NVIDIA ofrece modelos abiertos de forma gratuita mediante una API compatible con OpenAI en https://integrate.api.nvidia.com/v1, autenticada con una clave de API de build.nvidia.com. OpenClaw establece de forma predeterminada Nemotron 3 Ultra para el proveedor NVIDIA, el modelo de razonamiento de NVIDIA con 550B de parámetros totales / 55B activos para trabajo agéntico con contextos largos.

Primeros pasos

  • Obtener la clave de API

    Cree una clave de API en build.nvidia.com.

  • Exportar la clave y ejecutar la incorporación

    bash
    export NVIDIA_API_KEY="nvapi-..."openclaw onboard --auth-choice nvidia-api-key
  • Establecer un modelo de NVIDIA

    bash
    openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55b
  • Para una configuración no interactiva, pase la clave directamente:

    bash
    openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."

    Ejemplo de configuración

    json5
    {  env: { NVIDIA_API_KEY: "nvapi-..." },  models: {    providers: {      nvidia: {        baseUrl: "https://integrate.api.nvidia.com/v1",        api: "openai-completions",      },    },  },  agents: {    defaults: {      model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" },    },  },}

    Catálogo destacado

    Cuando se configura una clave de API de NVIDIA, las rutas de configuración y selección de modelos obtienen el catálogo público de modelos destacados de NVIDIA desde https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json y almacenan el resultado en caché durante 24 horas (las primeras 32 entradas, importadas como filas gratuitas con entrada de texto). Por lo tanto, los nuevos modelos destacados de build.nvidia.com aparecen en las superficies de configuración y selección de modelos sin esperar a una versión de OpenClaw. Cuando la fuente en directo está disponible, el primer modelo devuelto es la opción preseleccionada durante la configuración de NVIDIA.

    La obtención utiliza una política fija de host HTTPS para assets.ngc.nvidia.com. Si no se configura ninguna clave de API de NVIDIA, o si la fuente no está disponible o tiene un formato incorrecto, OpenClaw recurre al catálogo incluido y al valor predeterminado incluido que se indican a continuación.

    Nemotron 3 Ultra

    Nemotron 3 Ultra es el modelo de NVIDIA predeterminado en OpenClaw. La página de NVIDIA Build para nvidia/nemotron-3-ultra-550b-a55b lo muestra como un endpoint gratuito disponible con una especificación de contexto de 1M tokens.

    La fila incluida de Ultra envía chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } de forma predeterminada para que la salida normal del chat permanezca en la respuesta visible en lugar de exponer el texto de razonamiento.

    Use Ultra como opción predeterminada de NVIDIA con la mayor capacidad. Mantenga Super seleccionado cuando quiera la opción Nemotron 3 más pequeña, o elija uno de los modelos de terceros alojados en el catálogo de NVIDIA cuando su contexto, latencia o comportamiento resulte más adecuado.

    Catálogo alternativo incluido

    Las filas seleccionables incluidas son una instantánea del catálogo de modelos destacados de NVIDIA. Las filas de compatibilidad obsoletas siguen siendo accesibles mediante la referencia exacta, pero no aparecen en los selectores de modelos.

    Referencia del modelo Nombre Contexto Salida máxima
    nvidia/nvidia/nemotron-3-ultra-550b-a55b Nemotron 3 Ultra 550B 1,048,576 8,192
    nvidia/nvidia/nemotron-3-super-120b-a12b Nemotron 3 Super 120B 1,000,000 8,192
    nvidia/z-ai/glm-5.2 GLM 5.2 202,752 8,192
    nvidia/moonshotai/kimi-k2.6 Kimi K2.6 262,144 8,192
    nvidia/minimaxai/minimax-m3 Minimax M3 196,608 8,192
    nvidia/deepseek-ai/deepseek-v4-pro DeepSeek V4 Pro 262,144 16,384
    nvidia/qwen/qwen3.5-397b-a17b Qwen3.5 397B A17B 262,144 16,384

    El catálogo de compatibilidad completo también conserva estas referencias publicadas para las configuraciones existentes: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5 y nvidia/minimaxai/minimax-m2.7. Siguen estando disponibles mediante la referencia exacta, pero nunca aparecen durante la incorporación ni en los selectores de modelos.

    Configuración avanzada

    Comportamiento de activación automática

    El proveedor se activa automáticamente cuando se establece la variable de entorno NVIDIA_API_KEY o cuando se ha guardado una clave durante la incorporación. No se requiere ninguna configuración explícita del proveedor aparte de la clave.

    Catálogo y precios

    OpenClaw prefiere el catálogo público de modelos destacados de NVIDIA cuando la autenticación de NVIDIA está configurada y lo almacena en caché durante 24 horas. La alternativa seleccionable incluida es una instantánea estática del catálogo de modelos destacados de NVIDIA; las filas de compatibilidad obsoletas accesibles mediante referencia exacta se ocultan de los selectores de modelos. Los costes tienen como valor predeterminado 0 en el código fuente, ya que NVIDIA ofrece actualmente acceso gratuito mediante API a los modelos indicados.

    Endpoint compatible con OpenAI

    OpenClaw se comunica con NVIDIA mediante el adaptador openai-completions a través de la ruta estándar de completado de chat /v1. Cualquier herramienta compatible con OpenAI debería funcionar de inmediato con la URL base de NVIDIA.

    Parámetros de razonamiento de Nemotron 3 Ultra

    La solicitud de ejemplo de Ultra de NVIDIA utiliza chat_template_kwargs.enable_thinking y reasoning_budget para la salida de razonamiento. La fila incluida de Ultra de OpenClaw desactiva de forma predeterminada el razonamiento de la plantilla para el uso normal del chat. Si necesita habilitar la salida de razonamiento de NVIDIA o forzar otros campos de solicitud específicos de NVIDIA, establezca parámetros por modelo y limite las sustituciones específicas del proveedor al modelo de NVIDIA:

    json5
    {  agents: {    defaults: {      models: {        "nvidia/nvidia/nemotron-3-ultra-550b-a55b": {          params: {            chat_template_kwargs: { enable_thinking: true },            extra_body: { reasoning_budget: 16384 },          },        },      },    },  },}

    params.chat_template_kwargs se combina con cualquier chat_template_kwargs que ya esté en la solicitud en lugar de reemplazar el objeto completo. params.extra_body es la sustitución final del cuerpo de la solicitud compatible con OpenAI y sobrescribe las claves de la carga útil que coincidan, por lo que debe usarse únicamente para los campos que NVIDIA documente para el endpoint seleccionado.

    Respuestas lentas de proveedores personalizados

    Algunos modelos personalizados alojados por NVIDIA pueden tardar más que los ~120s predeterminados del supervisor de inactividad del modelo antes de emitir el primer fragmento de respuesta. Para las entradas personalizadas del proveedor NVIDIA, aumente el tiempo de espera del proveedor en lugar del tiempo de espera de todo el entorno de ejecución del agente; timeoutSeconds abarca las solicitudes HTTP del proveedor y aumenta el límite del supervisor de inactividad o transmisión para ese proveedor:

    json5
    {  models: {    providers: {      "custom-integrate-api-nvidia-com": {        baseUrl: "https://integrate.api.nvidia.com/v1",        api: "openai-completions",        apiKey: "NVIDIA_API_KEY",        timeoutSeconds: 300,      },    },  },  agents: {    defaults: {      models: {        "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": {          params: { thinking: "off" },        },      },    },  },}

    Contenido relacionado

    Was this useful?
    On this page

    On this page