gpt-oss-120b を動かすPCスペック(必要VRAM・メモリ・速度の目安)
メモリ64GB以上のMac/Strix Haloで現実的
量子化別の必要メモリ
ファイルサイズは Hugging Face(ggml-org/gpt-oss-120b-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(36層・うち18層はスライディングウィンドウ)から計算。必要メモリ合計には計算バッファを含みます。
| 量子化 | ファイル | KV(8k) | 必要合計 | GPUなら | Macなら |
|---|---|---|---|---|---|
| 4bit(MXFP4) gpt-oss公式形式 | 59GB | 0.3GB | 62GB | GPU単体では不可 | 96GB〜 |
4bit(MXFP4)が動く機種と推定速度
速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。
快適 20 tok/s以上(11機種)
- Apple M2 Ultra(128GB) 約98 tok/s較正
- Apple M2 Ultra(192GB) 約98 tok/s較正
- Apple M3 Ultra(96GB) 約94 tok/s較正
- Apple M3 Ultra(256GB) 約94 tok/s較正
- Apple M3 Ultra(512GB) 約94 tok/s較正
- Apple M1 Ultra(128GB) 約88 tok/s較正
- Apple M4 Max(128GB) 約80 tok/s較正
- Apple M3 Max(96GB) 約63 tok/s較正
- Apple M3 Max(128GB) 約63 tok/s較正
- Apple M2 Max(96GB) 約62 tok/s較正
- AMD Ryzen AI Max+ 395(Strix Halo)(メモリ128GB) 約32 tok/s推定
実用 8〜20 tok/s(1機種)
- 一般的なデスクトップ/ノートPC(DDR5-5600・GPUなし)(メモリ128GB) 約8.3 tok/s推定
遅い 載るが遅い(0機種)
- なし
CPUオフロードで動く(0機種・システムメモリ32GB想定)
- なし
動かない機種(95)を見る
- GeForce RTX 3060 12GB あと50GB
- GeForce RTX 3060 Ti あと54GB
- GeForce RTX 3070 あと54GB
- GeForce RTX 3070 Ti あと54GB
- GeForce RTX 3080 10GB あと52GB
- GeForce RTX 3080 12GB あと50GB
- GeForce RTX 3080 Ti あと50GB
- GeForce RTX 3090 あと38GB
- GeForce RTX 3090 Ti あと38GB
- GeForce RTX 4060 あと54GB
- GeForce RTX 4060 Ti 8GB あと54GB
- GeForce RTX 4060 Ti 16GB あと46GB
- GeForce RTX 4070 あと50GB
- GeForce RTX 4070 SUPER あと50GB
- GeForce RTX 4070 Ti あと50GB
- GeForce RTX 4070 Ti SUPER あと46GB
- GeForce RTX 4080 あと46GB
- GeForce RTX 4080 SUPER あと46GB
- GeForce RTX 4090 あと38GB
- GeForce RTX 5060 あと54GB
- GeForce RTX 5060 Ti 8GB あと54GB
- GeForce RTX 5060 Ti 16GB あと46GB
- GeForce RTX 5070 あと50GB
- GeForce RTX 5070 Ti あと46GB
- GeForce RTX 5080 あと46GB
- GeForce RTX 5090 あと30GB
- GeForce RTX 4050 Laptop あと56GB
- GeForce RTX 4060 Laptop あと54GB
- GeForce RTX 4070 Laptop あと54GB
- GeForce RTX 4080 Laptop あと50GB
- GeForce RTX 4090 Laptop あと46GB
- GeForce RTX 5060 Laptop あと54GB
- GeForce RTX 5070 Laptop あと54GB
- GeForce RTX 5070 Ti Laptop あと50GB
- GeForce RTX 5080 Laptop あと46GB
- GeForce RTX 5090 Laptop あと38GB
- Radeon RX 7600 あと54GB
- Radeon RX 7700 XT あと50GB
- Radeon RX 7800 XT あと46GB
- Radeon RX 7900 XT あと42GB
- Radeon RX 7900 XTX あと38GB
- Radeon RX 9060 XT 16GB あと46GB
- Radeon RX 9070 あと46GB
- Radeon RX 9070 XT あと46GB
- Apple M1(8GB) あと56GB
- Apple M1(16GB) あと51GB
- Apple M1 Pro(16GB) あと51GB
- Apple M1 Pro(32GB) あと40GB
- Apple M1 Max(32GB) あと40GB
- Apple M1 Max(64GB) あと14GB
- Apple M1 Ultra(64GB) あと14GB
- Apple M2(8GB) あと56GB
- Apple M2(16GB) あと51GB
- Apple M2(24GB) あと45GB
- Apple M2 Pro(16GB) あと51GB
- Apple M2 Pro(32GB) あと40GB
- Apple M2 Max(32GB) あと40GB
- Apple M2 Max(64GB) あと14GB
- Apple M2 Ultra(64GB) あと14GB
- Apple M3(8GB) あと56GB
gpt-oss-120bを動かせるPC・Macを今日買うなら
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
Ryzen AI Max+ 395 ミニPC(メモリ128GB)
Windows/Linuxで128GBユニファイド。gpt-oss-120b・70BクラスをGPU側に96GB割り当てて常時サービング
Ryzen AI Max+ 395・LPDDR5X 128GB(256GB/s)・NVMe 2TB ・ 目安 32〜48万円
要件を満たす中で最も手頃
Mac Studio M3 Ultra(メモリ512GB)をLLMサーバに
DeepSeek V3級(671B)の4bitを1台で。チームのローカルLLMサーバ
M3 Ultra・ユニファイドメモリ512GB・SSD 4TB ・ 目安 150〜200万円
将来の用途拡張(大きなモデル・並列エージェント)に余裕
Mac Studio M4 Max(メモリ128GB・SSD 2TB)
gpt-oss-120b・Qwen3.5 122Bが載り、帯域546GB/sで実用速度。個人向けローカルLLMの本命
M4 Max・ユニファイドメモリ128GB・SSD 2TB ・ 目安 62〜72万円
Macで同じ仕事をするなら
よくある質問
gpt-oss-120bを動かすのに必要なVRAMは?
4bit量子化(4bit(MXFP4))でファイル59GB、8,192トークンのKVキャッシュを含めて約62GBが必要です。GPU単体のVRAMには載らず、Macのユニファイドメモリか複数GPUが必要です。
gpt-oss-120bはMacで動く?
動きます。ユニファイドメモリ96GB以上のApple Silicon(例: Apple M3 Ultra(96GB))で4bit量子化が実用速度です。