Comenzar
Plugin de Llama Cpp
Plugin Llama Cpp
Inferencia de texto y embeddings locales con GGUF mediante node-llama-cpp.
Distribución
- Paquete:
@openclaw/llama-cpp-provider - Vía de instalación: npm; ClawHub
Superficie
proveedores: llama-cpp; contratos: embeddingProviders
Modelo de texto predeterminado
Durante la configuración interactiva, OpenClaw ofrece Gemma 4 E4B IT Q4_K_M como una descarga incluida de aproximadamente 5.0 GB. La oferta requiere al menos 16 GiB de RAM total. Los modelos existentes en caché siguen detectándose en equipos más pequeños.
Para usar otro modelo, establezca params.modelPath en cualquier GGUF personalizado. Los modelos personalizados
no están sujetos al requisito de RAM de la descarga incluida. En equipos que no cumplen el
requisito, también se puede ejecutar un modelo más pequeño mediante Ollama o LM Studio, o
elegir un proveedor en la nube.
Documentación relacionada
Was this useful?