Get started

Plugin Llama Cpp

Plugin Llama Cpp

Suy luận văn bản và tạo embedding GGUF cục bộ thông qua node-llama-cpp.

Phân phối

  • Gói: @openclaw/llama-cpp-provider
  • Đường dẫn cài đặt: npm; ClawHub

Bề mặt

nhà cung cấp: llama-cpp; hợp đồng: embeddingProviders

Mô hình văn bản mặc định

Trong quá trình thiết lập tương tác, OpenClaw cung cấp Gemma 4 E4B IT Q4_K_M dưới dạng bản tải xuống đi kèm có dung lượng khoảng 5.0 GB. Tùy chọn này yêu cầu tổng RAM ít nhất 16 GiB. Các mô hình đã được lưu vào bộ nhớ đệm vẫn được phát hiện trên những máy có cấu hình thấp hơn.

Để sử dụng mô hình khác, hãy đặt params.modelPath thành GGUF tùy chỉnh bất kỳ. Các mô hình tùy chỉnh không phải tuân theo yêu cầu về RAM của bản tải xuống đi kèm. Trên các máy không đáp ứng yêu cầu, bạn cũng có thể chạy một mô hình nhỏ hơn thông qua Ollama hoặc LM Studio, hoặc chọn một nhà cung cấp đám mây.

Tài liệu liên quan

Was this useful?
On this page

On this page