OpenClaw: ハードウェア要件・ローカル接続・コンテキスト計画
公式ソースに基づく OpenClaw. OpenClaw はローカルファーストのオープンソース エージェントゲートウェイで、クラウド/ローカル両方のモデルプロバイダーを扱えます。
概要
OpenClaw は状態と認証情報を手元デバイスに保持するアシスタントスタックとして設計され、モデル/ランタイムのバックエンドを差し替え可能です。
Gateway はセッション、ツール、チャネル、モデルルーティングを管理するローカル制御プレーンとして機能します。
公式ランタイム要件
- Node ランタイム要件: OpenClaw のインストール docs は Node 24.16+ または 26.1+ を要求し、Node 26 を推奨しています。Node が無い場合はインストーラーが補完します。 (OpenClaw インストールドキュメント)
- 対応プラットフォーム: OpenClaw のインストール docs では macOS、Linux、Windows が対応対象として記載されています。 (OpenClaw インストールドキュメント)
- ローカルモデルのメモリ注記: OpenClaw のローカルモデル docs は、必要メモリがモデル重み、コンテキスト、ランタイム、ホスト負荷で変動すると説明しています。管理された llama.cpp レシピは 64K コンテキストを使い、最小レシピは 8 GiB ホストメモリ下限を示します。 (OpenClaw ローカルモデルドキュメント)
ローカルモデル接続スニペット(公式)
Ollama
openclaw onboard # choose Ollama: Cloud + Local, Cloud only, or Local only openclaw models list --provider ollama
Ollama
models: {
providers: {
ollama: {
api: 'ollama',
baseUrl: 'http://host:11434',
},
},
}OpenClaw Ollama docs では、ネイティブ Ollama provider モードで /v1 を使わないよう明記されています。
LM Studio
models: {
providers: {
lmstudio: {
api: 'openai-responses',
baseUrl: 'http://127.0.0.1:1234/v1',
models: [{ id: 'my-local-model', contextWindow: 196608 }],
},
},
}vLLM
models: {
providers: {
local: {
api: 'openai-completions',
baseUrl: 'http://127.0.0.1:8000/v1',
apiKey: 'sk-local',
},
},
}OpenClaw ローカルモデル docs では vLLM を OpenAI 互換ローカルプロキシとして挙げています。
llama.cpp
# Managed local server path from OpenClaw local-model docs openclaw onboard # choose Managed local server (llama.cpp plugin)
長文脈とツール呼び出し対応が重要な理由
- OpenClaw のローカルモデル docs は、短いプロンプトでは通っても、ツール schema・履歴・システムプロンプトでコンテキストを消費し、本番のエージェントターンで失敗する可能性を強調しています。
- OpenClaw セットアップは、既定ローカルモデルを切り替える前に実際のツール呼び出しチェックを実行します。
プリセット計算機
以下は Q4_K_M / batch=1 の推定であり、公式最小要件ではありません。
VRAM / RAM 計算ツール
GPU VRAM、Apple統合メモリ、CPU/RAMオフロードを想定して、モデル適合性を比較できます。
カスタム Hugging Face モデルID / パラメータ(任意)
未知のrepo idの場合は手入力値で推定計算します。
| 量子化 | 重み | KV | Overhead | 合計 |
|---|---|---|---|---|
| FP16 / BF16 | 13.04 GiB | 8 GiB | 1.54 GiB | 22.58 GiB |
| INT8 / Q8_0 | 6.68 GiB | 8 GiB | 1.54 GiB | 16.22 GiB |
| Q6_K | 5.17 GiB | 8 GiB | 1.54 GiB | 14.71 GiB |
| Q5_K_M | 4.44 GiB | 8 GiB | 1.54 GiB | 13.98 GiB |
| Q4_K_M | 3.75 GiB | 8 GiB | 1.54 GiB | 13.29 GiB |
| Q3_K_M / Q3 | 2.85 GiB | 8 GiB | 1.54 GiB | 12.39 GiB |
| Q2_K / Q2 | 2.04 GiB | 8 GiB | 1.54 GiB | 11.58 GiB |
| ハードウェア | メモリ | 判定 | 推定 tok/s |
|---|---|---|---|
| NVIDIA GeForce RTX 4090 24GB | 24 GiB | 実行可能 | 170.3 |
| NVIDIA GeForce RTX 5090 32GB | 32 GiB | 実行可能 | 302.75 |
| NVIDIA GeForce RTX 4080 SUPER 16GB | 16 GiB | 実行可能 | 124.34 |
| NVIDIA GeForce RTX 4070 Ti SUPER 16GB | 16 GiB | 実行可能 | 113.53 |
| AMD Radeon RX 7900 XTX 24GB | 24 GiB | 実行可能 | 162.19 |
| NVIDIA A100 80GB PCIe | 80 GiB | 実行可能 | 326.91 |
| Apple Silicon M3 Max (128GB unified memory) | 128 GiB | 実行可能 | 57.64 |
| Apple Silicon M2 Ultra (192GB unified memory) | 192 GiB | 実行可能 | 115.28 |
| 2× NVIDIA GeForce RTX 4090 (aggregate) | 48 GiB | 実行可能 | 306.46 |
計算式と前提
- Weight memory uses resident params × effective_bits / 8 (total params when available, otherwise active/fallback estimate).
- KV cache = 2 × layers × kv_heads × head_dim × kv_bytes × context × batch.
- Runtime overhead = 1.3 GiB base + 3% of KV-cache memory.
- Tokens/sec estimate uses active_params for decode bandwidth and should be treated as a rough directional number.
- Apple Silicon fit checks use an estimated usable unified-memory budget (about 75% by default, about 68% on 16GB systems) aligned with macOS recommendedMaxWorkingSetSize behavior.
- Recommended quantization keeps at least 10% memory headroom relative to usable memory budget.
- CPU/RAM offload (for example llama.cpp partial offload with lower GPU layer count) can reduce VRAM needs at the cost of speed.
- When config values are unavailable, fallback defaults are used and flagged as estimated on the page.
メモリ階層ごとのローカルモデル適合表(LLMRAM推定)
以下は Q4_K_M / batch=1 の推定であり、公式最小要件ではありません。
32K コンテキスト
GPU階層
| モデルプロファイル | 推定総メモリ | 8 GB | 12 GB | 16 GB | 24 GB | 32 GB | 48 GB |
|---|---|---|---|---|---|---|---|
| Mistral 7B Instruct v0.3 | 9.17 GiB | ✕ 非適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| Qwen 3.8 27B | 24 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| GLM 5.3 (Flash) | 195.84 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 |
Mac統合メモリ階層
| モデルプロファイル | 推定総メモリ | 16 GB | 36 GB | 64 GB | 128 GB |
|---|---|---|---|---|---|
| Mistral 7B Instruct v0.3 | 9.17 GiB | ✓ 適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| Qwen 3.8 27B | 24 GiB | ✕ 非適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| GLM 5.3 (Flash) | 195.84 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 |
64K コンテキスト
GPU階層
| モデルプロファイル | 推定総メモリ | 8 GB | 12 GB | 16 GB | 24 GB | 32 GB | 48 GB |
|---|---|---|---|---|---|---|---|
| Mistral 7B Instruct v0.3 | 13.29 GiB | ✕ 非適合 | ✕ 非適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| Qwen 3.8 27B | 32.24 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✓ 適合 |
| GLM 5.3 (Flash) | 219.01 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 |
Mac統合メモリ階層
| モデルプロファイル | 推定総メモリ | 16 GB | 36 GB | 64 GB | 128 GB |
|---|---|---|---|---|---|
| Mistral 7B Instruct v0.3 | 13.29 GiB | ✕ 非適合 | ✓ 適合 | ✓ 適合 | ✓ 適合 |
| Qwen 3.8 27B | 32.24 GiB | ✕ 非適合 | ✕ 非適合 | ✓ 適合 | ✓ 適合 |
| GLM 5.3 (Flash) | 219.01 GiB | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 | ✕ 非適合 |
FAQ
OpenClaw はクラウド API が必須ですか?
必須ではありません。OpenClaw docs はローカルファースト構成と、Ollama/managed local server を含むローカルモデル経路を示しています。
なぜ OpenClaw は Ollama ネイティブ API と OpenAI 互換 /v1 の両方を説明しているのですか?
Ollama provider モードは Ollama ネイティブ API を使い、vLLM/LM Studio などは OpenAI 互換 provider として設定するためです。
OpenClaw docs から固定の最小メモリを断定できますか?
できません。OpenClaw は必要メモリがモデル、コンテキスト、ランタイム、ホスト状況で変わると明記しており、レシピ下限は適合保証ではありません。
検証メモ
- ランタイム要件セクションには、このページで示した公式ドキュメントに明記された内容のみを記載しています。
- 適合テーブルは、現在のモデルページと計算機前提に基づく LLMRAM の計画用推定です。
- 公式リンクに特定ランタイムの明示スニペットがない場合(例: Hermes llama.cpp)、推測せず不足として明記します。