Get started
Plugin Llama Cpp
Plugin Llama Cpp
การอนุมานข้อความและการฝังเวกเตอร์จาก GGUF ภายในเครื่องผ่าน node-llama-cpp
การเผยแพร่
- แพ็กเกจ:
@openclaw/llama-cpp-provider - ช่องทางการติดตั้ง: npm; ClawHub
พื้นผิว
ผู้ให้บริการ: llama-cpp; สัญญา: embeddingProviders
โมเดลข้อความเริ่มต้น
ระหว่างการตั้งค่าแบบโต้ตอบ OpenClaw จะเสนอ Gemma 4 E4B IT Q4_K_M เป็นไฟล์ดาวน์โหลดที่รวมมาให้ขนาดประมาณ 5.0 GB ข้อเสนอนี้กำหนดให้มี RAM รวมอย่างน้อย 16 GiB ระบบจะยังคงตรวจพบโมเดลที่แคชไว้แล้วบนเครื่องที่มีทรัพยากรน้อยกว่า
หากต้องการใช้โมเดลอื่น ให้ตั้งค่า params.modelPath เป็น GGUF แบบกำหนดเองใดก็ได้ โมเดลแบบกำหนดเองไม่อยู่ภายใต้ข้อกำหนดด้าน RAM สำหรับไฟล์ดาวน์โหลดที่รวมมาให้ บนเครื่องที่มีทรัพยากรต่ำกว่าข้อกำหนด ยังสามารถเรียกใช้โมเดลขนาดเล็กกว่าผ่าน Ollama หรือ LM Studio หรือเลือกผู้ให้บริการคลาวด์ได้
เอกสารที่เกี่ยวข้อง
Was this useful?