AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップGPU別 › GeForce RTX 5080 Laptop

GeForce RTX 5080 Laptop で動くローカルLLM一覧(2026年9月)

33快適(20 tok/s以上)
0実用(8〜20 tok/s)
0CPUオフロードで動く
7動かない

この機種を積んだおすすめ構成: GPUノート(RTX 5080 Laptop 16GB・メモリ64GB)

まず試すなら: Qwen3.5 27B(4bit(IQ4_XS)・必要15GB・約51 tok/s推定)。2026年の主力dense。VRAM 24GBでQ4〜Q5

足りないのは: Gemma 3 27Bを動かすにはVRAMがあと約1.9GB必要(必要17GB / 実効16GB)。システムメモリに逃がすオフロードなら動きますが、速度は数分の一になります。

載るモデル(VRAMに全量が入る)

各モデルについて、載る中で最も高精度な量子化を表示。速度は推定(「較正」は同機種の公開ベンチで係数を合わせたもの)。

モデル量子化必要判定推定速度
Qwen3.5 35B-A3B2bit(IQ2_M)12GB快適約440 tok/s推定
Qwen3.6 35B-A3B2bit(IQ2_M)12GB快適約430 tok/s推定
GLM-4.7-Flash 30B-A3B3bit(Q3_K_M)15GB快適約250 tok/s推定
Qwen3 30B-A3B3bit(Q3_K_M)15GB快適約230 tok/s推定
Qwen3-Coder 30B-A3B3bit(Q3_K_M)15GB快適約230 tok/s推定
gpt-oss-20b4bit(MXFP4)12GB快適約210 tok/s推定
Llama 3.2 3B8bit(Q8_0)4.7GB快適約200 tok/s推定
Gemma 4 26B-A4B4bit(IQ4_XS)14GB快適約200 tok/s推定
Gemma 3 4B8bit(Q8_0)4.7GB快適約180 tok/s推定
Phi-4-mini 3.8B8bit(Q8_0)5.4GB快適約170 tok/s推定
Qwen3 4B8bit(Q8_0)5.7GB快適約160 tok/s推定
Llama-3-ELYZA-JP-8B4bit(Q4_K_M)6.2GB快適約140 tok/s推定
Gemma 3n E4B8bit(Q8_0)7.7GB快適約110 tok/s推定
DeepSeek-R1 Distill Qwen 7B8bit(Q8_0)8.7GB快適約94 tok/s推定
Qwen2.5-Coder 7B8bit(Q8_0)8.7GB快適約94 tok/s推定
Llama 3.1 8B8bit(Q8_0)9.7GB快適約86 tok/s推定
DeepSeek-R1-0528 Qwen3 8B8bit(Q8_0)10.0GB快適約84 tok/s推定
Qwen3 8B8bit(Q8_0)10.0GB快適約84 tok/s推定
GLM-4.6V-Flash 9B8bit(Q8_0)10GB快適約77 tok/s推定
Gemma 4 31B2bit(IQ2_M)12GB快適約68 tok/s推定
Qwen3 14B6bit(Q6_K)13GB快適約61 tok/s推定
Phi-4 14B6bit(Q6_K)14GB快適約61 tok/s推定
DeepSeek-R1 Distill Qwen 14B6bit(Q6_K)14GB快適約60 tok/s推定
DeepSeek-R1 Distill Qwen 14B Japanese6bit(Q6_K)14GB快適約60 tok/s推定
Qwen2.5-Coder 14B6bit(Q6_K)14GB快適約60 tok/s推定
Gemma 3 12B8bit(Q8_0)13GB快適約60 tok/s推定
DeepSeek-R1 Distill Qwen 32B2bit(Q2_K)14GB快適約58 tok/s推定
Qwen2.5-Coder 32B2bit(Q2_K)14GB快適約58 tok/s推定
Qwen3 32B2bit(Q2_K)14GB快適約58 tok/s推定
Mistral Nemo 12B8bit(Q8_0)14GB快適約57 tok/s推定
Gemma 3 27B3bit(Q3_K_M)14GB快適約56 tok/s推定
Mistral Small 3.2 24B4bit(Q4_K_M)16GB快適約52 tok/s推定
Qwen3.5 27B4bit(IQ4_XS)15GB快適約51 tok/s推定

動かないモデルと不足分

モデル量子化必要不足
Llama 3.3 70B4bit(Q4_K_M)44GBあと28GB
Qwen3-Next 80B-A3B4bit(Q4_K_M)47GBあと32GB
gpt-oss-120b4bit(MXFP4)62GBあと46GB
Llama 4 Scout 17B-16E4bit(Q4_K_M)65GBあと49GB
GLM-4.5-Air 106B-A12B4bit(Q4_K_M)72GBあと56GB
Qwen3.5 122B-A10B4bit(Q4_K_M)74GBあと59GB
Qwen3 235B-A22B4bit(Q4_K_M)138GBあと123GB

Gemma 3 27Bまで届くPC・Macに買い替えるなら

PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

ぴったりノートPC

MacBook Pro 14/16 M4 Pro(メモリ48GB・SSD 1TB)

開発者の定番。Claude Code並列運用+30BクラスのローカルLLMを1台で

M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 42〜52万円

要件を満たす中で最も手頃

余裕を持つならノートPC

MacBook Pro 16 M4 Max(メモリ128GB・SSD 2TB)

70B〜120B MoEのローカルLLMを持ち歩く。帯域546GB/sでミドルGPU級の速度

M4 Max・ユニファイドメモリ128GB・SSD 2TB ・ 目安 70〜85万円

将来の用途拡張(大きなモデル・並列エージェント)に余裕

別の形なら常時稼働サーバー型

Ryzen AI Max+ 395 ミニPC(メモリ128GB)

Windows/Linuxで128GBユニファイド。gpt-oss-120b・70BクラスをGPU側に96GB割り当てて常時サービング

Ryzen AI Max+ 395・LPDDR5X 128GB(256GB/s)・NVMe 2TB ・ 目安 32〜48万円

Windowsで同じ仕事をするなら

この機種の公開実測は未収録のため、同系統機種の実効係数(87%)で推定しています。

よくある質問

GeForce RTX 5080 LaptopでローカルLLMは動く?

動きます。VRAM16GB(実効約16GB)に、収録40モデル中33本が載ります。日本語チャットならQwen3.5 27B(4bit(IQ4_XS))が推定約51 tok/sです。

GeForce RTX 5080 Laptopで動かないモデルは?

Gemma 3 27Bは4bitで約17GB必要で、VRAMがあと約1.9GB足りません。

この機種で判定ツールを開く