AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップモデル別 › gpt-oss-120b

gpt-oss-120b を動かすPCスペック(必要VRAM・メモリ・速度の目安)

メモリ64GB以上のMac/Strix Haloで現実的

62GB4bitで必要なメモリ(KV 8k込み)
要ユニファイドGPU単体では不足
96GBMac最小構成: M3 Ultra(96GB)
131,072最大コンテキスト(学習時)

量子化別の必要メモリ

ファイルサイズは Hugging Face(ggml-org/gpt-oss-120b-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(36層・うち18層はスライディングウィンドウ)から計算。必要メモリ合計には計算バッファを含みます。

量子化ファイルKV(8k)必要合計GPUならMacなら
4bit(MXFP4)
gpt-oss公式形式
59GB0.3GB62GBGPU単体では不可96GB〜

4bit(MXFP4)が動く機種と推定速度

速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。

快適 20 tok/s以上(11機種)

遅い 載るが遅い(0機種)

  • なし

CPUオフロードで動く(0機種・システムメモリ32GB想定)

  • なし
動かない機種(95)を見る

gpt-oss-120bを動かせるPC・Macを今日買うなら

PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

ぴったり常時稼働サーバー型

Ryzen AI Max+ 395 ミニPC(メモリ128GB)

Windows/Linuxで128GBユニファイド。gpt-oss-120b・70BクラスをGPU側に96GB割り当てて常時サービング

Ryzen AI Max+ 395・LPDDR5X 128GB(256GB/s)・NVMe 2TB ・ 目安 32〜48万円

要件を満たす中で最も手頃

余裕を持つなら常時稼働サーバー型

Mac Studio M3 Ultra(メモリ512GB)をLLMサーバに

DeepSeek V3級(671B)の4bitを1台で。チームのローカルLLMサーバ

M3 Ultra・ユニファイドメモリ512GB・SSD 4TB ・ 目安 150〜200万円

将来の用途拡張(大きなモデル・並列エージェント)に余裕

別の形ならMac

Mac Studio M4 Max(メモリ128GB・SSD 2TB)

gpt-oss-120b・Qwen3.5 122Bが載り、帯域546GB/sで実用速度。個人向けローカルLLMの本命

M4 Max・ユニファイドメモリ128GB・SSD 2TB ・ 目安 62〜72万円

Macで同じ仕事をするなら

よくある質問

gpt-oss-120bを動かすのに必要なVRAMは?

4bit量子化(4bit(MXFP4))でファイル59GB、8,192トークンのKVキャッシュを含めて約62GBが必要です。GPU単体のVRAMには載らず、Macのユニファイドメモリか複数GPUが必要です。

gpt-oss-120bはMacで動く?

動きます。ユニファイドメモリ96GB以上のApple Silicon(例: Apple M3 Ultra(96GB))で4bit量子化が実用速度です。

手持ちのPCで判定する