gpt-oss-20b を動かすPCスペック(必要VRAM・メモリ・速度の目安)
OpenAI初のオープンモデル。MXFP4でVRAM 16GBに載る
量子化別の必要メモリ
ファイルサイズは Hugging Face(ggml-org/gpt-oss-20b-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(24層・うち12層はスライディングウィンドウ)から計算。必要メモリ合計には計算バッファを含みます。
| 量子化 | ファイル | KV(8k) | 必要合計 | GPUなら | Macなら |
|---|---|---|---|---|---|
| 4bit(MXFP4) gpt-oss公式形式 | 11GB | 0.2GB | 12GB | VRAM 16GB〜 | 24GB〜 |
4bit(MXFP4)が動く機種と推定速度
速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。
快適 20 tok/s以上(57機種)
- GeForce RTX 5090 約300 tok/s較正
- GeForce RTX 5080 Laptop 約210 tok/s推定
- GeForce RTX 5090 Laptop 約210 tok/s推定
- GeForce RTX 4090 約200 tok/s較正
- GeForce RTX 5080 約190 tok/s較正
- GeForce RTX 5070 Ti 約190 tok/s較正
- GeForce RTX 3090 Ti 約180 tok/s較正
- GeForce RTX 3090 約170 tok/s較正
- Radeon RX 7900 XTX 約160 tok/s推定
- GeForce RTX 4080 SUPER 約160 tok/s較正
- GeForce RTX 4080 約150 tok/s較正
- GeForce RTX 4070 Ti SUPER 約140 tok/s較正
- GeForce RTX 4090 Laptop 約140 tok/s推定
- Radeon RX 7900 XT 約130 tok/s推定
- Apple M2 Ultra(64GB) 約130 tok/s較正
- Apple M2 Ultra(128GB) 約130 tok/s較正
- Apple M2 Ultra(192GB) 約130 tok/s較正
- Apple M3 Ultra(96GB) 約130 tok/s較正
- Apple M3 Ultra(256GB) 約130 tok/s較正
- Apple M3 Ultra(512GB) 約130 tok/s較正
- Apple M1 Ultra(64GB) 約120 tok/s較正
- Apple M1 Ultra(128GB) 約120 tok/s較正
- Radeon RX 9070 XT 約110 tok/s推定
- Apple M4 Max(36GB) 約110 tok/s較正
- Apple M4 Max(48GB) 約110 tok/s較正
- Apple M4 Max(64GB) 約110 tok/s較正
- Apple M4 Max(128GB) 約110 tok/s較正
- Radeon RX 7800 XT 約100 tok/s推定
- Radeon RX 9070 約100 tok/s推定
- GeForce RTX 5060 Ti 16GB 約95 tok/s較正
- Apple M3 Max(36GB) 約84 tok/s較正
- Apple M3 Max(48GB) 約84 tok/s較正
- Apple M3 Max(64GB) 約84 tok/s較正
- Apple M3 Max(96GB) 約84 tok/s較正
- Apple M3 Max(128GB) 約84 tok/s較正
- Apple M2 Max(32GB) 約82 tok/s較正
- Apple M2 Max(64GB) 約82 tok/s較正
- Apple M2 Max(96GB) 約82 tok/s較正
- Apple M1 Max(32GB) 約79 tok/s較正
- Apple M1 Max(64GB) 約79 tok/s較正
- ほか17機種
実用 8〜20 tok/s(7機種)
- AMD Ryzen AI 300(Strix Point・Copilot+ PC)(メモリ32GB) 約20 tok/s推定
- AMD Ryzen AI 300(Strix Point・Copilot+ PC)(メモリ64GB) 約20 tok/s推定
- Intel Core Ultra 200V(Lunar Lake・Copilot+ PC)(メモリ32GB) 約17 tok/s推定
- Snapdragon X Elite(Copilot+ PC)(メモリ32GB) 約17 tok/s推定
- 一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ32GB) 約11 tok/s推定
- 一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ64GB) 約11 tok/s推定
- 一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ128GB) 約11 tok/s推定
遅い 載るが遅い(2機種)
- 一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ32GB) 約6.3 tok/s推定
- 一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ64GB) 約6.3 tok/s推定
CPUオフロードで動く(24機種・システムメモリ32GB想定)
- GeForce RTX 3080 12GB 約91 tok/s推定
- GeForce RTX 3080 Ti 約91 tok/s推定
- GeForce RTX 5070 Ti Laptop 約85 tok/s推定
- GeForce RTX 5070 約77 tok/s較正
- GeForce RTX 4080 Laptop 約67 tok/s推定
- GeForce RTX 4070 約66 tok/s推定
- GeForce RTX 4070 SUPER 約66 tok/s推定
- GeForce RTX 4070 Ti 約66 tok/s推定
- GeForce RTX 3060 12GB 約56 tok/s較正
- Radeon RX 7700 XT 約52 tok/s推定
- GeForce RTX 3080 10GB 約39 tok/s較正
- GeForce RTX 3070 Ti 約25 tok/s推定
- GeForce RTX 3060 Ti 約24 tok/s推定
- GeForce RTX 3070 約24 tok/s推定
- GeForce RTX 5060 約24 tok/s推定
- GeForce RTX 5060 Ti 8GB 約24 tok/s推定
- GeForce RTX 5060 Laptop 約24 tok/s推定
- GeForce RTX 5070 Laptop 約24 tok/s推定
- GeForce RTX 4060 Ti 8GB 約23 tok/s較正
- GeForce RTX 4060 Laptop 約22 tok/s推定
- ほか4機種
動かない機種(17)を見る
- Apple M1(8GB) あと6.9GB
- Apple M1(16GB) あと1.6GB
- Apple M1 Pro(16GB) あと1.6GB
- Apple M2(8GB) あと6.9GB
- Apple M2(16GB) あと1.6GB
- Apple M2 Pro(16GB) あと1.6GB
- Apple M3(8GB) あと6.9GB
- Apple M3(16GB) あと1.6GB
- Apple M3 Pro(18GB) あと0.2GB
- Apple M4(16GB) あと1.6GB
- Apple M5(16GB) あと1.6GB
- 一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ8GB) あと6.9GB
- 一般的なデスクトップ/ノートPC(DDR4-3200・GPUなし)(メモリ16GB) あと1.6GB
- 一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ16GB) あと1.6GB
- Intel Core Ultra 200V(Lunar Lake・Copilot+ PC)(メモリ16GB) あと1.6GB
- AMD Ryzen AI 300(Strix Point・Copilot+ PC)(メモリ16GB) あと1.6GB
- Snapdragon X Elite(Copilot+ PC)(メモリ16GB) あと1.6GB
gpt-oss-20bを動かせるPC・Macを今日買うなら
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
自作: RTX 5070 Ti(16GB)・メモリ32GB
BTOより同予算で一段上のGPUに届く。画像生成とローカルLLMの定番
Ryzen 7 9700X・DDR5 16GB×2・RTX 5070 Ti・NVMe 2TB・電源850W ・ 目安 27〜35万円
要件を満たす中で最も手頃
自作: RTX 5090(32GB)・メモリ96GB
動画生成・学習・32B LLM。メモリ96GBで大型MoEのCPUオフロードも
Ryzen 9 9950X・DDR5 48GB×2・RTX 5090・NVMe 4TB・電源1000W・大型ケース ・ 目安 60〜80万円
将来の用途拡張(大きなモデル・並列エージェント)に余裕
Mac mini M4 Pro(メモリ48GB・SSD 1TB)
30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心
M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円
Macで同じ仕事をするなら
よくある質問
gpt-oss-20bを動かすのに必要なVRAMは?
4bit量子化(4bit(MXFP4))でファイル11GB、8,192トークンのKVキャッシュを含めて約12GBが必要です。GPU単体ならGeForce RTX 5080 Laptop(VRAM 16GB)から実用速度で動きます。
gpt-oss-20bはMacで動く?
動きます。ユニファイドメモリ24GB以上のApple Silicon(例: Apple M4 Pro(24GB))で4bit量子化が実用速度です。