一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ128GB) で動くローカルLLM一覧(2026年9月)
0快適(20 tok/s以上)
6実用(8〜20 tok/s)
0CPUオフロードで動く
0動かない
まず試すなら: Qwen3 4B(8bit(Q8_0)・必要5.7GB・約8.3 tok/s推定)。4Bながら日本語が破綻しにくい。メモリ8GBのノートでも動く入門機
載るモデル(メモリに全量が入る)
各モデルについて、載る中で最も高精度な量子化を表示。速度は推定(「較正」は同機種の公開ベンチで係数を合わせたもの)。
| モデル | 量子化 | 必要 | 判定 | 推定速度 |
|---|---|---|---|---|
| gpt-oss-20b | 4bit(MXFP4) | 12GB | 実用 | 約11 tok/s推定 |
| Llama 3.2 3B | 8bit(Q8_0) | 4.7GB | 実用 | 約10 tok/s推定 |
| Gemma 3 4B | 8bit(Q8_0) | 4.7GB | 実用 | 約9.4 tok/s推定 |
| Phi-4-mini 3.8B | 8bit(Q8_0) | 5.4GB | 実用 | 約8.7 tok/s推定 |
| gpt-oss-120b | 4bit(MXFP4) | 62GB | 実用 | 約8.3 tok/s推定 |
| Qwen3 4B | 8bit(Q8_0) | 5.7GB | 実用 | 約8.3 tok/s推定 |
| Qwen3.6 35B-A3B | 8bit(Q8_0) | 36GB | 遅い | 約7.4 tok/s推定 |
| Qwen3.5 35B-A3B | 8bit(Q8_0) | 36GB | 遅い | 約7.4 tok/s推定 |
| Llama-3-ELYZA-JP-8B | 4bit(Q4_K_M) | 6.2GB | 遅い | 約7.4 tok/s推定 |
| Qwen3-Next 80B-A3B | 8bit(Q8_0) | 82GB | 遅い | 約7.3 tok/s推定 |
| GLM-4.7-Flash 30B-A3B | 8bit(Q8_0) | 32GB | 遅い | 約6.7 tok/s推定 |
| Qwen3 30B-A3B | 8bit(Q8_0) | 32GB | 遅い | 約6.2 tok/s推定 |
| Qwen3-Coder 30B-A3B | 8bit(Q8_0) | 32GB | 遅い | 約6.2 tok/s推定 |
| Gemma 4 26B-A4B | 8bit(Q8_0) | 27GB | 遅い | 約5.4 tok/s推定 |
| Gemma 3n E4B | 8bit(Q8_0) | 7.7GB | 遅い | 約5.4 tok/s推定 |
| DeepSeek-R1 Distill Qwen 7B | 8bit(Q8_0) | 8.7GB | 遅い | 約4.8 tok/s推定 |
| Qwen2.5-Coder 7B | 8bit(Q8_0) | 8.7GB | 遅い | 約4.8 tok/s推定 |
| Llama 3.1 8B | 8bit(Q8_0) | 9.7GB | 遅い | 約4.4 tok/s推定 |
| DeepSeek-R1-0528 Qwen3 8B | 8bit(Q8_0) | 10.0GB | 遅い | 約4.3 tok/s推定 |
| Qwen3 8B | 8bit(Q8_0) | 10.0GB | 遅い | 約4.3 tok/s推定 |
| GLM-4.6V-Flash 9B | 8bit(Q8_0) | 10GB | 遅い | 約4.0 tok/s推定 |
| Qwen3.5 122B-A10B | 4bit(Q4_K_M) | 74GB | 遅い | 約3.8 tok/s推定 |
| Gemma 3 12B | 8bit(Q8_0) | 13GB | 遅い | 約3.1 tok/s推定 |
| Mistral Nemo 12B | 8bit(Q8_0) | 14GB | 遅い | 約2.9 tok/s推定 |
| Qwen3 235B-A22B | 2bit(Q2_K) | 84GB | 遅い | 約2.7 tok/s推定 |
| GLM-4.5-Air 106B-A12B | 5bit(Q5_K_M) | 82GB | 遅い | 約2.5 tok/s推定 |
| Qwen3 14B | 8bit(Q8_0) | 17GB | 遅い | 約2.5 tok/s推定 |
| Phi-4 14B | 8bit(Q8_0) | 17GB | 遅い | 約2.5 tok/s推定 |
| DeepSeek-R1 Distill Qwen 14B | 8bit(Q8_0) | 17GB | 遅い | 約2.4 tok/s推定 |
| DeepSeek-R1 Distill Qwen 14B Japanese | 8bit(Q8_0) | 17GB | 遅い | 約2.4 tok/s推定 |
| Qwen2.5-Coder 14B | 8bit(Q8_0) | 17GB | 遅い | 約2.4 tok/s推定 |
| Llama 4 Scout 17B-16E | 5bit(Q5_K_M) | 75GB | 動かない | 約1.9 tok/s推定 |
| Mistral Small 3.2 24B | 8bit(Q8_0) | 26GB | 動かない | 約1.6 tok/s推定 |
| Qwen3.5 27B | 8bit(Q8_0) | 28GB | 動かない | 約1.4 tok/s推定 |
| Gemma 3 27B | 8bit(Q8_0) | 29GB | 動かない | 約1.4 tok/s推定 |
| Gemma 4 31B | 8bit(Q8_0) | 33GB | 動かない | 約1.2 tok/s推定 |
| Qwen3 32B | 8bit(Q8_0) | 36GB | 動かない | 約1.1 tok/s推定 |
| DeepSeek-R1 Distill Qwen 32B | 8bit(Q8_0) | 36GB | 動かない | 約1.1 tok/s推定 |
| Qwen2.5-Coder 32B | 8bit(Q8_0) | 36GB | 動かない | 約1.1 tok/s推定 |
| Llama 3.3 70B | 8bit(Q8_0) | 75GB | 動かない | 約0.5 tok/s推定 |
動かないモデルと不足分
| モデル | 量子化 | 必要 | 不足 |
|---|---|---|---|
| なし(すべて載ります) | |||
今のPCで足りる人の、効く買い足し
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
メモリ増設(32GB化)
エージェント・Docker・ブラウザ大量タブの詰まりはメモリで解消する
NVMe / 外付けSSD 2TB
モデル・Dockerイメージ・リポジトリで内蔵SSDはすぐ埋まる
この機種の公開実測は未収録のため、同系統機種の実効係数(45%)で推定しています。
よくある質問
一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ128GB)でローカルLLMは動く?
動きます。メモリ128GB(実効約86GB)に、収録40モデル中40本が載ります。日本語チャットならQwen3 4B(8bit(Q8_0))が推定約8.3 tok/sです。
一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ128GB)で動かないモデルは?
収録した人気モデルはすべて載ります。