AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップモデル別 › Qwen3.6 35B-A3B

Qwen3.6 35B-A3B を動かすPCスペック(必要VRAM・メモリ・速度の目安)

Qwen3.5 35B-A3Bの改良版

22GB4bitで必要なメモリ(KV 8k込み)
VRAM 24GB最安で実用: GeForce RTX 5090 Laptop
36GBMac最小構成: M4 Max(36GB)
262,144最大コンテキスト(学習時)

量子化別の必要メモリ

ファイルサイズは Hugging Face(unsloth/Qwen3.6-35B-A3B-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(40層・全域注意は10層のみ)から計算。必要メモリ合計には計算バッファを含みます。

量子化ファイルKV(8k)必要合計GPUならMacなら
2bit(IQ2_M)
品質劣化大。最後の手段
11GB0.2GB12GBVRAM 16GB〜18GB〜
3bit(Q3_K_M)
メモリ優先
15GB0.2GB17GBVRAM 20GB〜32GB〜
4bit(IQ4_XS)
Q4_K_Mより一回り小さい
17GB0.2GB18GBVRAM 20GB〜32GB〜
4bit(MXFP4 MoE)
MoE専用のMXFP4
20GB0.2GB21GBVRAM 24GB〜36GB〜
4bit(Q4_K_M)
標準。迷ったらこれ
21GB0.2GB22GBVRAM 24GB〜36GB〜
5bit(Q5_K_M)
品質重視
25GB0.2GB26GBVRAM 32GB〜48GB〜
6bit(Q6_K)
ほぼ無劣化
27GB0.2GB29GBVRAM 32GB〜48GB〜
8bit(Q8_0)
無劣化に近い
34GB0.2GB36GBGPU単体では不可64GB〜
16bit(BF16)
元精度
65GB0.2GB67GBGPU単体では不可96GB〜

4bit(Q4_K_M)が動く機種と推定速度

速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。

快適 20 tok/s以上(32機種)

CPUオフロードで動く(38機種・システムメモリ32GB想定)

動かない機種(34)を見る

Qwen3.6 35B-A3Bを動かせるPC・Macを今日買うなら

PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

ぴったりMac

Mac mini M4 Pro(メモリ48GB・SSD 1TB)

30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心

M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円

要件を満たす中で最も手頃

余裕を持つならMac

Mac mini M4 Pro(メモリ64GB・SSD 1TB)

70BクラスのローカルLLMまで。同価格帯のGeForce機より載るモデルが大きい

M4 Pro・ユニファイドメモリ64GB・SSD 1TB ・ 目安 36〜42万円

将来の用途拡張(大きなモデル・並列エージェント)に余裕

別の形なら常時稼働サーバー型

Ryzen AI Max+ 395 ミニPC(メモリ128GB)

Windows/Linuxで128GBユニファイド。gpt-oss-120b・70BクラスをGPU側に96GB割り当てて常時サービング

Ryzen AI Max+ 395・LPDDR5X 128GB(256GB/s)・NVMe 2TB ・ 目安 32〜48万円

Windowsで同じ仕事をするなら

よくある質問

Qwen3.6 35B-A3Bを動かすのに必要なVRAMは?

4bit量子化(4bit(Q4_K_M))でファイル21GB、8,192トークンのKVキャッシュを含めて約22GBが必要です。GPU単体ならGeForce RTX 5090 Laptop(VRAM 24GB)から実用速度で動きます。

Qwen3.6 35B-A3BはMacで動く?

動きます。ユニファイドメモリ36GB以上のApple Silicon(例: Apple M4 Max(36GB))で4bit量子化が実用速度です。

手持ちのPCで判定する