Get started
Plugin Llama Cpp
Plugin Llama Cpp
Suy luận văn bản và tạo embedding GGUF cục bộ thông qua node-llama-cpp.
Phân phối
- Gói:
@openclaw/llama-cpp-provider - Đường dẫn cài đặt: npm; ClawHub
Bề mặt
nhà cung cấp: llama-cpp; hợp đồng: embeddingProviders
Mô hình văn bản mặc định
Trong quá trình thiết lập tương tác, OpenClaw cung cấp Gemma 4 E4B IT Q4_K_M dưới dạng bản tải xuống đi kèm có dung lượng khoảng 5.0 GB. Tùy chọn này yêu cầu tổng RAM ít nhất 16 GiB. Các mô hình đã được lưu vào bộ nhớ đệm vẫn được phát hiện trên những máy có cấu hình thấp hơn.
Để sử dụng mô hình khác, hãy đặt params.modelPath thành GGUF tùy chỉnh bất kỳ. Các mô hình tùy chỉnh
không phải tuân theo yêu cầu về RAM của bản tải xuống đi kèm. Trên các máy không đáp ứng
yêu cầu, bạn cũng có thể chạy một mô hình nhỏ hơn thông qua Ollama hoặc LM Studio, hoặc
chọn một nhà cung cấp đám mây.
Tài liệu liên quan
Was this useful?