Mac Studio M3 Ultra(メモリ256GB・SSD 2TB)
向いている人: 235B級MoEを1台で。帯域800GB/s。個人で持てる上限
32コアCPU目安
256GBユニファイドメモリ
統合GPUGPUはメモリ共有
2TBSSD
最適常時稼働
どこで買うか(複数社を並べています)
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
この1台でできること
合うAI
足りないAI(3)と理由
- Stable Diffusion / SDXL: CUDA前提のツールが多くMacは不向き
- FLUX / 高品質画像生成: CUDA前提のツールが多くMacは不向き
- 動画生成AI(Wan / Hunyuan / LTX): CUDA前提のツールが多くMacは不向き
この1台で動くローカルモデル(Apple M3 Ultra(256GB)として計算)
4bit以上で載る中から抜粋。速度は推定(この機種の全モデル一覧)。
まず試すなら: Qwen3.6 35B-A3B(8bit(Q8_0)・必要36GB・約84 tok/s較正)。Qwen3.5 35B-A3Bの改良版
| モデル | 量子化 | 必要 | 判定 | 推定速度 |
|---|---|---|---|---|
| gpt-oss-20b | 4bit(MXFP4) | 12GB | 快適 | 約130 tok/s較正 |
| Llama 3.2 3B | 8bit(Q8_0) | 4.7GB | 快適 | 約120 tok/s較正 |
| Gemma 3 4B | 8bit(Q8_0) | 4.7GB | 快適 | 約110 tok/s較正 |
| Phi-4-mini 3.8B | 8bit(Q8_0) | 5.4GB | 快適 | 約99 tok/s較正 |
| gpt-oss-120b | 4bit(MXFP4) | 62GB | 快適 | 約94 tok/s較正 |
| Qwen3 4B | 8bit(Q8_0) | 5.7GB | 快適 | 約94 tok/s較正 |
| Llama-3-ELYZA-JP-8B | 4bit(Q4_K_M) | 6.2GB | 快適 | 約84 tok/s較正 |
| Qwen3.6 35B-A3B | 8bit(Q8_0) | 36GB | 快適 | 約84 tok/s較正 |
| Qwen3.5 35B-A3B | 8bit(Q8_0) | 36GB | 快適 | 約84 tok/s較正 |
| Qwen3-Next 80B-A3B | 8bit(Q8_0) | 82GB | 快適 | 約83 tok/s較正 |
| GLM-4.7-Flash 30B-A3B | 8bit(Q8_0) | 32GB | 快適 | 約76 tok/s較正 |
| Qwen3 30B-A3B | 8bit(Q8_0) | 32GB | 快適 | 約70 tok/s較正 |
同じ形の他の構成
| 構成 | 向いている人 | 目安 |
|---|---|---|
| Mac mini M4(メモリ24GB・SSD 512GB) | 最安で「クラウドAI+Claude Code+8〜14BのローカルLLM」。静音・省電力で常時稼働にも | 14〜17万円 |
| Mac mini M4 Pro(メモリ48GB・SSD 1TB) | 30BクラスのローカルLLMとエージェント並列運用を1台で。コスパの中心 | 30〜36万円 |
| Mac mini M4 Pro(メモリ64GB・SSD 1TB) | 70BクラスのローカルLLMまで。同価格帯のGeForce機より載るモデルが大きい | 36〜42万円 |
| Mac Studio M4 Max(メモリ128GB・SSD 2TB) | gpt-oss-120b・Qwen3.5 122Bが載り、帯域546GB/sで実用速度。個人向けローカルLLMの本命 | 62〜72万円 |