AI PCナビ使うAIと、させたい仕事に合うPC・Macを。
トップGPU別 › Intel Arc B570

Intel Arc B570 で動くローカルLLM一覧(2026年9月)

26快適(20 tok/s以上)
0実用(8〜20 tok/s)
21CPUオフロードで動く
8動かない

まず試すなら: Mistral Nemo Japanese 12B(4bit(Q4_K_M)・必要8.9GB・約28 tok/s推定)。日本語追加学習の12B。VRAM 8〜12GB

足りないのは: Qwen3 14Bを動かすにはVRAMがあと約0.9GB必要(必要10GB / 実効9.5GB)。システムメモリに逃がすオフロードなら動きますが、速度は数分の一になります。

載るモデル(VRAMに全量が入る)

各モデルについて、載る中で最も高精度な量子化を表示。速度は推定(「較正」は同機種の公開ベンチで係数を合わせたもの)。

モデル量子化必要判定推定速度
Llama 3.2 3B8bit(Q8_0)4.7GB快適約59 tok/s推定
Gemma 3 4B8bit(Q8_0)4.7GB快適約53 tok/s推定
Qwen3.5 4B8bit(Q8_0)5.0GB快適約49 tok/s推定
Phi-4-mini 3.8B8bit(Q8_0)5.4GB快適約49 tok/s推定
Qwen3 4B8bit(Q8_0)5.7GB快適約47 tok/s推定
Gemma 4 E2B8bit(Q8_0)5.5GB快適約45 tok/s推定
Llama-3-ELYZA-JP-8B4bit(Q4_K_M)6.2GB快適約42 tok/s推定
Llama 3.1 8B6bit(Q6_K)7.8GB快適約32 tok/s推定
Qwen3-VL 8B6bit(Q6_K)8.1GB快適約31 tok/s推定
DeepSeek-R1-0528 Qwen3 8B6bit(Q6_K)8.1GB快適約31 tok/s推定
Qwen3 8B6bit(Q6_K)8.1GB快適約31 tok/s推定
Gemma 3n E4B8bit(Q8_0)7.7GB快適約31 tok/s推定
Qwen3.5 9B6bit(Q6_K)7.9GB快適約30 tok/s推定
Qwen3 14B3bit(Q3_K_M)8.8GB快適約29 tok/s推定
DeepSeek-R1 Distill Qwen 14B3bit(Q3_K_M)9.0GB快適約28 tok/s推定
DeepSeek-R1 Distill Qwen 14B Japanese3bit(Q3_K_M)9.0GB快適約28 tok/s推定
Qwen2.5-Coder 14B3bit(Q3_K_M)9.0GB快適約28 tok/s推定
Mistral Nemo Japanese 12B4bit(Q4_K_M)8.9GB快適約28 tok/s推定
Mistral Nemo 12B4bit(Q4_K_M)8.9GB快適約28 tok/s推定
Phi-4 14B3bit(Q3_K_M)9.1GB快適約28 tok/s推定
Gemma 4 E4B8bit(Q8_0)8.6GB快適約27 tok/s推定
DeepSeek-R1 Distill Qwen 7B8bit(Q8_0)8.7GB快適約27 tok/s推定
Qwen2.5-Coder 7B8bit(Q8_0)8.7GB快適約27 tok/s推定
GLM-4.6V-Flash 9B6bit(Q6_K)8.7GB快適約27 tok/s推定
Gemma 4 12B5bit(Q5_K_M)9.0GB快適約26 tok/s推定
Gemma 3 12B5bit(Q5_K_M)9.4GB快適約26 tok/s推定

CPUオフロードなら動く(システムメモリ32GB想定)

モデル量子化必要判定推定速度
Gemma 4 26B-A4B4bit(Q4_K_M)17GB実用CPUオフロード約16 tok/s推定
Gemma 4 31B4bit(Q4_K_M)19GB遅いCPUオフロード約3.5 tok/s推定
Qwen3.6 27B4bit(Q4_K_M)17GB遅いCPUオフロード約4.3 tok/s推定
Qwen3.6 35B-A3B4bit(Q4_K_M)22GB実用CPUオフロード約19 tok/s推定
Qwen3.5 27B4bit(Q4_K_M)17GB遅いCPUオフロード約4.4 tok/s推定
Qwen3.5 35B-A3B4bit(Q4_K_M)22GB実用CPUオフロード約19 tok/s推定
GLM-4.7-Flash 30B-A3B4bit(Q4_K_M)19GB実用CPUオフロード約18 tok/s推定
Qwen3-VL 32B4bit(Q4_K_M)21GB遅いCPUオフロード約3.0 tok/s推定
Magistral Small 25094bit(Q4_K_M)16GB遅いCPUオフロード約5.4 tok/s推定
gpt-oss-20b4bit(MXFP4)12GB快適CPUオフロード約30 tok/s推定
Seed-OSS 36B4bit(Q4_K_M)23GB遅いCPUオフロード約2.7 tok/s推定
Devstral Small 25074bit(Q4_K_M)16GB遅いCPUオフロード約5.4 tok/s推定
Qwen3 30B-A3B4bit(Q4_K_M)19GB実用CPUオフロード約17 tok/s推定
Qwen3-Coder 30B-A3B4bit(Q4_K_M)19GB実用CPUオフロード約17 tok/s推定
Mistral Small 3.2 24B4bit(Q4_K_M)16GB遅いCPUオフロード約5.4 tok/s推定
ELYZA-Shortcut-1.0 Qwen 32B4bit(Q4_K_M)22GB遅いCPUオフロード約3.0 tok/s推定
LLM-jp-3.1 13B4bit(Q4_K_M)15GB遅いCPUオフロード約7.3 tok/s推定
Qwen3 32B4bit(Q4_K_M)21GB遅いCPUオフロード約3.0 tok/s推定
Gemma 3 27B4bit(Q4_K_M)17GB遅いCPUオフロード約4.3 tok/s推定
DeepSeek-R1 Distill Qwen 32B4bit(Q4_K_M)22GB遅いCPUオフロード約3.0 tok/s推定
Qwen2.5-Coder 32B4bit(Q4_K_M)22GB遅いCPUオフロード約3.0 tok/s推定

動かないモデルと不足分

モデル量子化必要不足
Llama 3.3 70B4bit(Q4_K_M)44GBあと34GB
Qwen3-Next 80B-A3B4bit(Q4_K_M)47GBあと38GB
Qwen3-Coder-Next 80B-A3B4bit(Q4_K_M)47GBあと38GB
gpt-oss-120b4bit(MXFP4)62GBあと52GB
Llama 4 Scout 17B-16E4bit(Q4_K_M)65GBあと55GB
GLM-4.5-Air 106B-A12B4bit(Q4_K_M)72GBあと62GB
Qwen3.5 122B-A10B4bit(Q4_K_M)74GBあと65GB
Qwen3 235B-A22B4bit(Q4_K_M)138GBあと129GB

Qwen3 14Bまで届くPC・Macに買い替えるなら

PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。

ぴったりデスクトップ(BTO)

RTX 5070(12GB)デスクトップ・メモリ32GB

SDXLの画像生成が快適。14BクラスのローカルLLMがGPU完結

RTX 5070(VRAM 12GB)・メモリ32GB・NVMe 1TB ・ 目安 20〜28万円

要件を満たす中で最も手頃

余裕を持つならデスクトップ(BTO)

RTX 5070 Ti(16GB)デスクトップ・メモリ32GB

FLUX・27B MoE・gpt-oss-20b。ローカルAIの定番ライン

RTX 5070 Ti(VRAM 16GB)・メモリ32GB・NVMe 2TB・電源750W ・ 目安 28〜38万円

将来の用途拡張(大きなモデル・並列エージェント)に余裕

別の形ならMac

Mac mini M4 Pro(メモリ48GB・SSD 1TB)

30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心

M4 Pro・ユニファイドメモリ48GB・SSD 1TB・帯域273GB/s ・ 目安 30〜36万円

Macで同じ仕事をするなら

この機種の公開実測は未収録のため、同系統機種の実効係数(60%)で推定しています。

よくある質問

Intel Arc B570でローカルLLMは動く?

動きます。VRAM10GB(実効約9.5GB)に、収録55モデル中26本が載ります。日本語チャットならMistral Nemo Japanese 12B(4bit(Q4_K_M))が推定約28 tok/sです。

Intel Arc B570で動かないモデルは?

Qwen3 14Bは4bitで約10GB必要で、VRAMがあと約0.9GB足りません。

この機種で判定ツールを開く