Comenzar

Plugin de Llama Cpp

Plugin Llama Cpp

Inferencia de texto y embeddings locales con GGUF mediante node-llama-cpp.

Distribución

  • Paquete: @openclaw/llama-cpp-provider
  • Vía de instalación: npm; ClawHub

Superficie

proveedores: llama-cpp; contratos: embeddingProviders

Modelo de texto predeterminado

Durante la configuración interactiva, OpenClaw ofrece Gemma 4 E4B IT Q4_K_M como una descarga incluida de aproximadamente 5.0 GB. La oferta requiere al menos 16 GiB de RAM total. Los modelos existentes en caché siguen detectándose en equipos más pequeños.

Para usar otro modelo, establezca params.modelPath en cualquier GGUF personalizado. Los modelos personalizados no están sujetos al requisito de RAM de la descarga incluida. En equipos que no cumplen el requisito, también se puede ejecutar un modelo más pequeño mediante Ollama o LM Studio, o elegir un proveedor en la nube.

Documentación relacionada

Was this useful?
On this page

On this page