Qwen3 235B-A22B を動かすPCスペック(必要VRAM・メモリ・速度の目安)
メモリ128GB級のMac Studio/Strix Haloで狙う巨大MoE
138GB4bitで必要なメモリ(KV 8k込み)
要ユニファイドGPU単体では不足
192GBMac最小構成: M2 Ultra(192GB)
40,960最大コンテキスト(学習時)
量子化別の必要メモリ
ファイルサイズは Hugging Face(unsloth/Qwen3-235B-A22B-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(94層)から計算。必要メモリ合計には計算バッファを含みます。
| 量子化 | ファイル | KV(8k) | 必要合計 | GPUなら | Macなら |
|---|---|---|---|---|---|
| 2bit(Q2_K) 品質劣化大。最後の手段 | 80GB | 1.5GB | 84GB | GPU単体では不可 | 128GB〜 |
| 3bit(Q3_K_M) メモリ優先 | 105GB | 1.5GB | 110GB | GPU単体では不可 | 192GB〜 |
| 4bit(IQ4_XS) Q4_K_Mより一回り小さい | 117GB | 1.5GB | 122GB | GPU単体では不可 | 192GB〜 |
| 4bit(Q4_K_M) 標準。迷ったらこれ | 132GB | 1.5GB | 138GB | GPU単体では不可 | 192GB〜 |
| 5bit(Q5_K_M) 品質重視 | 155GB | 1.5GB | 162GB | GPU単体では不可 | 256GB〜 |
| 6bit(Q6_K) ほぼ無劣化 | 180GB | 1.5GB | 187GB | GPU単体では不可 | 256GB〜 |
| 8bit(Q8_0) 無劣化に近い | 233GB | 1.5GB | 242GB | GPU単体では不可 | 512GB〜 |
| 16bit(BF16) 元精度 | 438GB | 1.5GB | 453GB | GPU単体では不可 | 不可 |
4bit(Q4_K_M)が動く機種と推定速度
速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。
快適 20 tok/s以上(1機種)
- Apple M2 Ultra(192GB) 約20 tok/s較正
実用 8〜20 tok/s(2機種)
- Apple M3 Ultra(256GB) 約20 tok/s較正
- Apple M3 Ultra(512GB) 約20 tok/s較正
遅い 載るが遅い(0機種)
- なし
CPUオフロードで動く(0機種・システムメモリ32GB想定)
- なし
動かない機種(104)を見る
- GeForce RTX 3060 12GB あと127GB
- GeForce RTX 3060 Ti あと131GB
- GeForce RTX 3070 あと131GB
- GeForce RTX 3070 Ti あと131GB
- GeForce RTX 3080 10GB あと129GB
- GeForce RTX 3080 12GB あと127GB
- GeForce RTX 3080 Ti あと127GB
- GeForce RTX 3090 あと115GB
- GeForce RTX 3090 Ti あと115GB
- GeForce RTX 4060 あと131GB
- GeForce RTX 4060 Ti 8GB あと131GB
- GeForce RTX 4060 Ti 16GB あと123GB
- GeForce RTX 4070 あと127GB
- GeForce RTX 4070 SUPER あと127GB
- GeForce RTX 4070 Ti あと127GB
- GeForce RTX 4070 Ti SUPER あと123GB
- GeForce RTX 4080 あと123GB
- GeForce RTX 4080 SUPER あと123GB
- GeForce RTX 4090 あと115GB
- GeForce RTX 5060 あと131GB
- GeForce RTX 5060 Ti 8GB あと131GB
- GeForce RTX 5060 Ti 16GB あと123GB
- GeForce RTX 5070 あと127GB
- GeForce RTX 5070 Ti あと123GB
- GeForce RTX 5080 あと123GB
- GeForce RTX 5090 あと107GB
- GeForce RTX 4050 Laptop あと133GB
- GeForce RTX 4060 Laptop あと131GB
- GeForce RTX 4070 Laptop あと131GB
- GeForce RTX 4080 Laptop あと127GB
- GeForce RTX 4090 Laptop あと123GB
- GeForce RTX 5060 Laptop あと131GB
- GeForce RTX 5070 Laptop あと131GB
- GeForce RTX 5070 Ti Laptop あと127GB
- GeForce RTX 5080 Laptop あと123GB
- GeForce RTX 5090 Laptop あと115GB
- Radeon RX 7600 あと131GB
- Radeon RX 7700 XT あと127GB
- Radeon RX 7800 XT あと123GB
- Radeon RX 7900 XT あと119GB
- Radeon RX 7900 XTX あと115GB
- Radeon RX 9060 XT 16GB あと123GB
- Radeon RX 9070 あと123GB
- Radeon RX 9070 XT あと123GB
- Apple M1(8GB) あと133GB
- Apple M1(16GB) あと128GB
- Apple M1 Pro(16GB) あと128GB
- Apple M1 Pro(32GB) あと117GB
- Apple M1 Max(32GB) あと117GB
- Apple M1 Max(64GB) あと90GB
- Apple M1 Ultra(64GB) あと90GB
- Apple M1 Ultra(128GB) あと42GB
- Apple M2(8GB) あと133GB
- Apple M2(16GB) あと128GB
- Apple M2(24GB) あと122GB
- Apple M2 Pro(16GB) あと128GB
- Apple M2 Pro(32GB) あと117GB
- Apple M2 Max(32GB) あと117GB
- Apple M2 Max(64GB) あと90GB
- Apple M2 Max(96GB) あと66GB
Qwen3 235B-A22Bを動かせるPC・Macを今日買うなら
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
ぴったりMac
Mac Studio M3 Ultra(メモリ256GB・SSD 2TB)
235B級MoEを1台で。帯域800GB/s。個人で持てる上限
M3 Ultra・ユニファイドメモリ256GB・SSD 2TB ・ 目安 95〜115万円
要件を満たす中で最も手頃
別の形なら常時稼働サーバー型
Mac Studio M3 Ultra(メモリ512GB)をLLMサーバに
DeepSeek V3級(671B)の4bitを1台で。チームのローカルLLMサーバ
M3 Ultra・ユニファイドメモリ512GB・SSD 4TB ・ 目安 150〜200万円
別の形で同じ仕事をするなら
よくある質問
Qwen3 235B-A22Bを動かすのに必要なVRAMは?
4bit量子化(4bit(Q4_K_M))でファイル132GB、8,192トークンのKVキャッシュを含めて約138GBが必要です。GPU単体のVRAMには載らず、Macのユニファイドメモリか複数GPUが必要です。
Qwen3 235B-A22BはMacで動く?
動きます。ユニファイドメモリ192GB以上のApple Silicon(例: Apple M2 Ultra(192GB))で4bit量子化が実用速度です。