AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップPC別 › Snapdragon X Elite(Copilot+ PC)(メモリ16GB)

Snapdragon X Elite(Copilot+ PC)(メモリ16GB) で動くローカルLLM一覧(2026年9月)

1快適(20 tok/s以上)
6実用(8〜20 tok/s)
0CPUオフロードで動く
18動かない

まず試すなら: Llama-3-ELYZA-JP-8B(4bit(Q4_K_M)・必要6.2GB・約11 tok/s推定)。国産の日本語特化8B。VRAM 8GB

足りないのは: gpt-oss-20bを動かすにはメモリがあと約1.6GB必要(必要12GB / 実効11GB)。

載るモデル(メモリに全量が入る)

各モデルについて、載る中で最も高精度な量子化を表示。速度は推定(「較正」は同機種の公開ベンチで係数を合わせたもの)。

モデル量子化必要判定推定速度
Gemma 4 26B-A4B2bit(IQ2_M)10GB快適約21 tok/s推定
Llama 3.2 3B8bit(Q8_0)4.7GB実用約16 tok/s推定
Gemma 3 4B8bit(Q8_0)4.7GB実用約14 tok/s推定
Phi-4-mini 3.8B8bit(Q8_0)5.4GB実用約13 tok/s推定
Qwen3 4B8bit(Q8_0)5.7GB実用約12 tok/s推定
Llama-3-ELYZA-JP-8B4bit(Q4_K_M)6.2GB実用約11 tok/s推定
Gemma 3n E4B8bit(Q8_0)7.7GB実用約8.2 tok/s推定
DeepSeek-R1 Distill Qwen 7B8bit(Q8_0)8.7GB遅い約7.3 tok/s推定
Qwen2.5-Coder 7B8bit(Q8_0)8.7GB遅い約7.3 tok/s推定
Phi-4 14B4bit(IQ4_XS)9.7GB遅い約6.9 tok/s推定
Llama 3.1 8B8bit(Q8_0)9.7GB遅い約6.7 tok/s推定
DeepSeek-R1-0528 Qwen3 8B8bit(Q8_0)10.0GB遅い約6.5 tok/s推定
Qwen3 8B8bit(Q8_0)10.0GB遅い約6.5 tok/s推定
Mistral Nemo 12B5bit(Q5_K_M)10GB遅い約6.5 tok/s推定
Mistral Small 3.2 24B2bit(Q2_K)10GB遅い約6.4 tok/s推定
Qwen3 14B4bit(Q4_K_M)10GB遅い約6.3 tok/s推定
DeepSeek-R1 Distill Qwen 14B4bit(Q4_K_M)11GB遅い約6.2 tok/s推定
DeepSeek-R1 Distill Qwen 14B Japanese4bit(Q4_K_M)11GB遅い約6.2 tok/s推定
Qwen2.5-Coder 14B4bit(Q4_K_M)11GB遅い約6.2 tok/s推定
GLM-4.6V-Flash 9B8bit(Q8_0)10GB遅い約6.0 tok/s推定
Gemma 3 12B6bit(Q6_K)11GB遅い約6.0 tok/s推定
Gemma 3 27B2bit(IQ2_M)11GB遅い約6.0 tok/s推定

動かないモデルと不足分

モデル量子化必要不足
gpt-oss-20b4bit(MXFP4)12GBあと1.6GB
Qwen3.5 27B4bit(Q4_K_M)17GBあと6.4GB
GLM-4.7-Flash 30B-A3B4bit(Q4_K_M)19GBあと8.2GB
Qwen3 30B-A3B4bit(Q4_K_M)19GBあと8.3GB
Qwen3-Coder 30B-A3B4bit(Q4_K_M)19GBあと8.3GB
Gemma 4 31B4bit(Q4_K_M)19GBあと8.8GB
Qwen3 32B4bit(Q4_K_M)21GBあと11GB
DeepSeek-R1 Distill Qwen 32B4bit(Q4_K_M)22GBあと11GB
Qwen2.5-Coder 32B4bit(Q4_K_M)22GBあと11GB
Qwen3.5 35B-A3B4bit(Q4_K_M)22GBあと11GB
Qwen3.6 35B-A3B4bit(Q4_K_M)22GBあと11GB
Llama 3.3 70B4bit(Q4_K_M)44GBあと33GB
Qwen3-Next 80B-A3B4bit(Q4_K_M)47GBあと37GB
gpt-oss-120b4bit(MXFP4)62GBあと51GB
Llama 4 Scout 17B-16E4bit(Q4_K_M)65GBあと54GB
GLM-4.5-Air 106B-A12B4bit(Q4_K_M)72GBあと61GB
Qwen3.5 122B-A10B4bit(Q4_K_M)74GBあと63GB
Qwen3 235B-A22B4bit(Q4_K_M)138GBあと128GB

gpt-oss-20bまで届くPC・Macに買い替えるなら

PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

ぴったり自作

自作: RTX 5070 Ti(16GB)・メモリ32GB

BTOより同予算で一段上のGPUに届く。画像生成とローカルLLMの定番

Ryzen 7 9700X・DDR5 16GB×2・RTX 5070 Ti・NVMe 2TB・電源850W ・ 目安 27〜35万円

要件を満たす中で最も手頃

余裕を持つなら自作

自作: RTX 5090(32GB)・メモリ96GB

動画生成・学習・32B LLM。メモリ96GBで大型MoEのCPUオフロードも

Ryzen 9 9950X・DDR5 48GB×2・RTX 5090・NVMe 4TB・電源1000W・大型ケース ・ 目安 60〜80万円

将来の用途拡張(大きなモデル・並列エージェント)に余裕

別の形ならMac

Mac mini M4 Pro(メモリ48GB・SSD 1TB)

30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心

M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円

Macで同じ仕事をするなら

この機種の公開実測は未収録のため、同系統機種の実効係数(45%)で推定しています。

よくある質問

Snapdragon X Elite(Copilot+ PC)(メモリ16GB)でローカルLLMは動く?

動きます。メモリ16GB(実効約11GB)に、収録40モデル中22本が載ります。日本語チャットならLlama-3-ELYZA-JP-8B(4bit(Q4_K_M))が推定約11 tok/sです。

Snapdragon X Elite(Copilot+ PC)(メモリ16GB)で動かないモデルは?

gpt-oss-20bは4bitで約12GB必要で、メモリがあと約1.6GB足りません。

この機種で判定ツールを開く