Ryzen AI Max+ 395 ミニPC(メモリ128GB)
向いている人: Windows/Linuxで128GBユニファイド。gpt-oss-120b・70BクラスをGPU側に96GB割り当てて常時サービング
16コアCPU目安
128GBメモリ
96GBGPU VRAM
2TBSSD
最適常時稼働
どこで買うか(複数社を並べています)
PR: 以下は広告リンクを含みます(Amazonアソシエイト・各社アフィリエイト)。価格の目安は執筆時点のもので変動します。価格・在庫はリンク先でご確認ください。
この1台でできること
合うAI
足りないAI(3)と理由
- Stable Diffusion / SDXL: CUDA(NVIDIA GPU)前提のツールが多い
- FLUX / 高品質画像生成: CUDA(NVIDIA GPU)前提のツールが多い
- 動画生成AI(Wan / Hunyuan / LTX): CUDA(NVIDIA GPU)前提のツールが多い
この1台で動くローカルモデル(AMD Ryzen AI Max+ 395(Strix Halo)(メモリ128GB)として計算)
4bit以上で載る中から抜粋。速度は推定(この機種の全モデル一覧)。
まず試すなら: Qwen3.6 35B-A3B(8bit(Q8_0)・必要36GB・約28 tok/s推定)。Qwen3.5 35B-A3Bの改良版
| モデル | 量子化 | 必要 | 判定 | 推定速度 |
|---|---|---|---|---|
| gpt-oss-20b | 4bit(MXFP4) | 12GB | 快適 | 約42 tok/s推定 |
| Llama 3.2 3B | 8bit(Q8_0) | 4.7GB | 快適 | 約40 tok/s推定 |
| Gemma 3 4B | 8bit(Q8_0) | 4.7GB | 快適 | 約36 tok/s推定 |
| Phi-4-mini 3.8B | 8bit(Q8_0) | 5.4GB | 快適 | 約33 tok/s推定 |
| gpt-oss-120b | 4bit(MXFP4) | 62GB | 快適 | 約32 tok/s推定 |
| Qwen3 4B | 8bit(Q8_0) | 5.7GB | 快適 | 約31 tok/s推定 |
| Qwen3.6 35B-A3B | 8bit(Q8_0) | 36GB | 快適 | 約28 tok/s推定 |
| Qwen3.5 35B-A3B | 8bit(Q8_0) | 36GB | 快適 | 約28 tok/s推定 |
| Llama-3-ELYZA-JP-8B | 4bit(Q4_K_M) | 6.2GB | 快適 | 約28 tok/s推定 |
| Qwen3-Next 80B-A3B | 8bit(Q8_0) | 82GB | 快適 | 約28 tok/s推定 |
| GLM-4.7-Flash 30B-A3B | 8bit(Q8_0) | 32GB | 快適 | 約26 tok/s推定 |
| Qwen3 30B-A3B | 8bit(Q8_0) | 32GB | 快適 | 約24 tok/s推定 |
同じ形の他の構成
| 構成 | 向いている人 | 目安 |
|---|---|---|
| 静音ミニPC(Ryzen 9・メモリ64GB・GPUなし) | n8n・Dify・エージェントのルーティンを24時間回す。省電力・小型・静音で置き場所を選ばない | 13〜22万円 |
| Mac mini M4 Pro(メモリ64GB)を常時稼働サーバに | ローカルLLM API(Ollama)+自動化を静音・低消費電力で24時間。macOSでClaude Codeも本流 | 36〜42万円 |
| ワークステーション(RTX 5090・メモリ128GB・SSD 4TB) | 動画生成・学習ジョブを夜通し回す。ECC・高耐久電源・保守付きのBTOワークステーション | 75〜110万円 |
| Mac Studio M3 Ultra(メモリ512GB)をLLMサーバに | DeepSeek V3級(671B)の4bitを1台で。チームのローカルLLMサーバ | 150〜200万円 |