AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップモデル別 › Qwen3.5 4B

Qwen3.5 4B を動かすPCスペック(必要VRAM・メモリ・速度の目安)

GPUなしのノートでも動く2026年の小型。メモリ8GBで可

3.4GB4bitで必要なメモリ(KV 8k込み)
VRAM 6GB最安で実用: GeForce RTX 4050 Laptop
8GBMac最小構成: M2(8GB)
262,144最大コンテキスト(学習時)

量子化別の必要メモリ

ファイルサイズは Hugging Face(unsloth/Qwen3.5-4B-GGUF) の実サイズ(事実)。KVキャッシュは8,192トークン・fp16でモデル構造(32層・全域注意は8層のみ)から計算。必要メモリ合計には計算バッファを含みます。

量子化ファイルKV(8k)必要合計GPUならMacなら
2bit(IQ2_M)
品質劣化大。最後の手段
1.6GB0.3GB2.4GBVRAM 6GB〜8GB〜
3bit(Q3_K_M)
メモリ優先
2.1GB0.3GB2.9GBVRAM 6GB〜8GB〜
4bit(IQ4_XS)
Q4_K_Mより一回り小さい
2.3GB0.3GB3.1GBVRAM 6GB〜8GB〜
4bit(Q4_K_M)
標準。迷ったらこれ
2.6GB0.3GB3.4GBVRAM 6GB〜8GB〜
5bit(Q5_K_M)
品質重視
2.9GB0.3GB3.8GBVRAM 6GB〜8GB〜
6bit(Q6_K)
ほぼ無劣化
3.3GB0.3GB4.1GBVRAM 6GB〜8GB〜
8bit(Q8_0)
無劣化に近い
4.2GB0.3GB5.0GBVRAM 6GB〜8GB〜
16bit(BF16)
元精度
7.8GB0.3GB8.8GBVRAM 10GB〜16GB〜

4bit(Q4_K_M)が動く機種と推定速度

速度はテキスト生成(tok/s)の推定。「較正」= 同機種のllama.cpp公開ベンチマークで実効係数を合わせた推定、「推定」= 同系統機種の係数を流用。10 tok/s で人が読む速さの約2倍です。

快適 20 tok/s以上(101機種)

遅い 載るが遅い(0機種)

  • なし

CPUオフロードで動く(0機種・システムメモリ32GB想定)

  • なし
動かない機種(0)を見る

    Qwen3.5 4Bを動かせるPC・Macを今日買うなら

    PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

    ぴったりデスクトップ(BTO)

    RTX 5060(8GB)デスクトップ・メモリ32GB

    画像生成の入門と8BクラスのローカルLLM。最安のGPU機

    RTX 5060(VRAM 8GB)・メモリ32GB・NVMe 1TB ・ 目安 15〜21万円

    要件を満たす中で最も手頃

    余裕を持つならデスクトップ(BTO)

    RTX 5070(12GB)デスクトップ・メモリ32GB

    SDXLの画像生成が快適。14BクラスのローカルLLMがGPU完結

    RTX 5070(VRAM 12GB)・メモリ32GB・NVMe 1TB ・ 目安 20〜28万円

    将来の用途拡張(大きなモデル・並列エージェント)に余裕

    別の形ならMac

    Mac mini M4 Pro(メモリ48GB・SSD 1TB)

    30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心

    M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円

    Macで同じ仕事をするなら

    よくある質問

    Qwen3.5 4Bを動かすのに必要なVRAMは?

    4bit量子化(4bit(Q4_K_M))でファイル2.6GB、8,192トークンのKVキャッシュを含めて約3.4GBが必要です。GPU単体ならGeForce RTX 4050 Laptop(VRAM 6GB)から実用速度で動きます。

    Qwen3.5 4BはMacで動く?

    動きます。ユニファイドメモリ8GB以上のApple Silicon(例: Apple M2(8GB))で4bit量子化が実用速度です。

    このクラスの選び方: ローカルLLM(8Bクラス)に必要なPC / MacかWindowsか

    手持ちのPCで判定する