はじめに
Llama Cpp Plugin
Llama Cpp Plugin
node-llama-cpp を介したローカル GGUF テキスト推論および埋め込み。
配布
- パッケージ:
@openclaw/llama-cpp-provider - インストール経路: npm、ClawHub
サーフェス
プロバイダー: llama-cpp、コントラクト: embeddingProviders
デフォルトのテキストモデル
対話形式のセットアップ中、OpenClaw は約 5.0 GB のバンドルダウンロードとして Gemma 4 E4B IT Q4_K_M を提示します。この提示には、合計 RAM が 16 GiB 以上必要です。より小規模なマシンでも、既存のキャッシュ済みモデルは引き続き検出されます。
別のモデルを使用するには、params.modelPath を任意のカスタム GGUF に設定します。カスタムモデルには、バンドルダウンロードの RAM 要件は適用されません。要件を下回るマシンでは、Ollama または LM Studio を介してより小さいモデルを実行するか、クラウドプロバイダーを選択することもできます。
関連ドキュメント
Was this useful?