Mulai

Plugin Llama Cpp

Plugin Llama Cpp

Inferensi teks dan embedding GGUF lokal melalui node-llama-cpp.

Distribusi

  • Paket: @openclaw/llama-cpp-provider
  • Rute instalasi: npm; ClawHub

Permukaan

penyedia: llama-cpp; kontrak: embeddingProviders

Model teks default

Selama penyiapan interaktif, OpenClaw menawarkan Gemma 4 E4B IT Q4_K_M sebagai unduhan bawaan berukuran sekitar 5.0 GB. Penawaran ini memerlukan setidaknya 16 GiB RAM total. Model yang sudah tersimpan dalam cache tetap terdeteksi pada mesin yang lebih kecil.

Untuk menggunakan model lain, atur params.modelPath ke GGUF kustom apa pun. Model kustom tidak tunduk pada persyaratan RAM untuk unduhan bawaan. Pada mesin yang tidak memenuhi persyaratan, Anda juga dapat menjalankan model yang lebih kecil melalui Ollama atau LM Studio, atau memilih penyedia cloud.

Dokumentasi terkait

Was this useful?
On this page

On this page