はじめに

Llama Cpp Plugin

Llama Cpp Plugin

node-llama-cpp を介したローカル GGUF テキスト推論および埋め込み。

配布

  • パッケージ: @openclaw/llama-cpp-provider
  • インストール経路: npm、ClawHub

サーフェス

プロバイダー: llama-cpp、コントラクト: embeddingProviders

デフォルトのテキストモデル

対話形式のセットアップ中、OpenClaw は約 5.0 GB のバンドルダウンロードとして Gemma 4 E4B IT Q4_K_M を提示します。この提示には、合計 RAM が 16 GiB 以上必要です。より小規模なマシンでも、既存のキャッシュ済みモデルは引き続き検出されます。

別のモデルを使用するには、params.modelPath を任意のカスタム GGUF に設定します。カスタムモデルには、バンドルダウンロードの RAM 要件は適用されません。要件を下回るマシンでは、Ollama または LM Studio を介してより小さいモデルを実行するか、クラウドプロバイダーを選択することもできます。

関連ドキュメント

Was this useful?
On this page

On this page