一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ8GB) で動くローカルLLM一覧(2026年9月)
0快適(20 tok/s以上)
0実用(8〜20 tok/s)
0CPUオフロードで動く
29動かない
まず試すなら: Phi-4-mini 3.8B(6bit(Q6_K)・必要4.5GB・約6.2 tok/s推定)。GPUなしでも動く小型
足りないのは: Qwen3 8Bを動かすにはメモリがあと約1.1GB必要(必要6.5GB / 実効5.4GB)。
載るモデル(メモリに全量が入る)
各モデルについて、載る中で最も高精度な量子化を表示。速度は推定(「較正」は同機種の公開ベンチで係数を合わせたもの)。
| モデル | 量子化 | 必要 | 判定 | 推定速度 |
|---|---|---|---|---|
| Phi-4-mini 3.8B | 6bit(Q6_K) | 4.5GB | 遅い | 約6.2 tok/s推定 |
| DeepSeek-R1-0528 Qwen3 8B | 2bit(Q2_K) | 4.8GB | 遅い | 約5.9 tok/s推定 |
| Qwen3 4B | 6bit(Q6_K) | 4.8GB | 遅い | 約5.9 tok/s推定 |
| Llama 3.2 3B | 8bit(Q8_0) | 4.7GB | 遅い | 約5.9 tok/s推定 |
| GLM-4.6V-Flash 9B | 2bit(Q2_K) | 4.7GB | 遅い | 約5.5 tok/s推定 |
| Gemma 3 4B | 8bit(Q8_0) | 4.7GB | 遅い | 約5.4 tok/s推定 |
| DeepSeek-R1 Distill Qwen 7B | 4bit(IQ4_XS) | 5.0GB | 遅い | 約5.2 tok/s推定 |
| Qwen2.5-Coder 7B | 4bit(IQ4_XS) | 5.0GB | 遅い | 約5.2 tok/s推定 |
| Qwen3 8B | 3bit(IQ3_M) | 5.4GB | 遅い | 約5.1 tok/s推定 |
| Llama 3.1 8B | 3bit(Q3_K_M) | 5.4GB | 遅い | 約5.1 tok/s推定 |
| Gemma 3n E4B | 4bit(Q4_K_M) | 5.0GB | 遅い | 約5.0 tok/s推定 |
動かないモデルと不足分
| モデル | 量子化 | 必要 | 不足 |
|---|---|---|---|
| Llama-3-ELYZA-JP-8B | 4bit(Q4_K_M) | 6.2GB | あと0.8GB |
| Gemma 3 12B | 4bit(Q4_K_M) | 8.3GB | あと2.9GB |
| Mistral Nemo 12B | 4bit(Q4_K_M) | 8.9GB | あと3.5GB |
| Qwen3 14B | 4bit(Q4_K_M) | 10GB | あと5.0GB |
| DeepSeek-R1 Distill Qwen 14B | 4bit(Q4_K_M) | 11GB | あと5.2GB |
| DeepSeek-R1 Distill Qwen 14B Japanese | 4bit(Q4_K_M) | 11GB | あと5.2GB |
| Qwen2.5-Coder 14B | 4bit(Q4_K_M) | 11GB | あと5.2GB |
| Phi-4 14B | 4bit(Q4_K_M) | 11GB | あと5.3GB |
| gpt-oss-20b | 4bit(MXFP4) | 12GB | あと6.9GB |
| Mistral Small 3.2 24B | 4bit(Q4_K_M) | 16GB | あと10GB |
| Qwen3.5 27B | 4bit(Q4_K_M) | 17GB | あと12GB |
| Gemma 4 26B-A4B | 4bit(Q4_K_M) | 17GB | あと12GB |
| Gemma 3 27B | 4bit(Q4_K_M) | 17GB | あと12GB |
| GLM-4.7-Flash 30B-A3B | 4bit(Q4_K_M) | 19GB | あと13GB |
| Qwen3 30B-A3B | 4bit(Q4_K_M) | 19GB | あと14GB |
| Qwen3-Coder 30B-A3B | 4bit(Q4_K_M) | 19GB | あと14GB |
| Gemma 4 31B | 4bit(Q4_K_M) | 19GB | あと14GB |
| Qwen3 32B | 4bit(Q4_K_M) | 21GB | あと16GB |
| DeepSeek-R1 Distill Qwen 32B | 4bit(Q4_K_M) | 22GB | あと16GB |
| Qwen2.5-Coder 32B | 4bit(Q4_K_M) | 22GB | あと16GB |
| Qwen3.5 35B-A3B | 4bit(Q4_K_M) | 22GB | あと16GB |
| Qwen3.6 35B-A3B | 4bit(Q4_K_M) | 22GB | あと16GB |
| Llama 3.3 70B | 4bit(Q4_K_M) | 44GB | あと38GB |
| Qwen3-Next 80B-A3B | 4bit(Q4_K_M) | 47GB | あと42GB |
| gpt-oss-120b | 4bit(MXFP4) | 62GB | あと56GB |
| Llama 4 Scout 17B-16E | 4bit(Q4_K_M) | 65GB | あと59GB |
| GLM-4.5-Air 106B-A12B | 4bit(Q4_K_M) | 72GB | あと67GB |
| Qwen3.5 122B-A10B | 4bit(Q4_K_M) | 74GB | あと69GB |
| Qwen3 235B-A22B | 4bit(Q4_K_M) | 138GB | あと133GB |
Qwen3 8Bまで届くPC・Macに買い替えるなら
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
ぴったりデスクトップ(BTO)
RTX 5060(8GB)デスクトップ・メモリ32GB
画像生成の入門と8BクラスのローカルLLM。最安のGPU機
RTX 5060(VRAM 8GB)・メモリ32GB・NVMe 1TB ・ 目安 15〜21万円
要件を満たす中で最も手頃
余裕を持つならデスクトップ(BTO)
RTX 5070(12GB)デスクトップ・メモリ32GB
SDXLの画像生成が快適。14BクラスのローカルLLMがGPU完結
RTX 5070(VRAM 12GB)・メモリ32GB・NVMe 1TB ・ 目安 20〜28万円
将来の用途拡張(大きなモデル・並列エージェント)に余裕
別の形ならMac
Mac mini M4 Pro(メモリ48GB・SSD 1TB)
30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心
M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円
Macで同じ仕事をするなら
この機種の公開実測は未収録のため、同系統機種の実効係数(45%)で推定しています。
よくある質問
一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ8GB)でローカルLLMは動く?
動きます。メモリ8GB(実効約5.4GB)に、収録40モデル中11本が載ります。日本語チャットならPhi-4-mini 3.8B(6bit(Q6_K))が推定約6.2 tok/sです。
一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ8GB)で動かないモデルは?
Qwen3 8Bは4bitで約6.5GB必要で、メモリがあと約1.1GB足りません。