容量重視 · 公式販売製品 · 2026-09-06 更新
27Bは入れられます。速度よりも容量を重視した構成です。
マックミニ M4 32GB でのローカルLLM 27Bの動作性能
小型本体で27B Q4級モデルの適載を優先し、生成速度を待つことが可能な場合に適しています。
主要仕様
- 使用可能なメモリ
- 27GB
- メモリ帯域幅
- 120GB/s
- ローカルLLMの継続的負荷
- 約48W
- 韓国の参考価格(ウォン)
- 180–240万ウォン
良い人
- 27B Q4 実行
- 低消費電力の個人サーバー
- 容量優先のユーザー
購入前に確認
M4基本チップの帯域幅のため、同じメモリを持つProシリーズよりもデコードが遅いです。
どのタスクに適するか
| 作業 | 判断 | 理由 |
|---|---|---|
| 27B チャット | 適切 | Q4量化は可能ですが、長い回答は待ち時間があります。 |
| 個人の文書 | 適切 | 文書作業を常に低消費電力で実行できます。 |
| 画像生成 | 条件付き | メモリーは優れているものの、専用GPUに比べて生成速度は低いです。 |
基準:構成選択の基準
最初に衝突するボトルネック
27Bをロードしてもメモリは余りますが、基本的なM4の帯域幅のため回答生成が長くなります。
おすすめ購入構成
M4 · ユニファイドメモリ 32GB · SSD 512GB以上
より多くのお金をかける基準
27Bのプリフィルが目的なら意味があります。速い応答が重要であれば、M4 Pro 48GBとの価格差を確認してください。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B MLX 4ビット | 8GB | 11.6 ~ 12.9 tok/s | 12.8 ~ 31.1秒 | 132 ~ 323 tok/s |
| Qwen3.8 27B MLX 4ビット | 17.56GB | 5.1 ~ 5.7 tok/s | 16.4 ~ 35.5秒 | 116 ~ 252 tok/s |
| Qwen3.6 35B-A3B (MoE) MLX 4ビット | 21.28GB | 7.8 ~ 22.5 tok/s | 5.5 ~ 15.7秒 | 263 ~ 757 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
M4搭載のMac mini 32GBで実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、Qwen3.8 27B、Qwen3.6 35B-A3B (MoE)などを、4K入力と機器ごとの推奨形式で比較できます。必要なメモリは、モデルとコンテキスト長によって変わります。
Mac mini M4 32GBのローカルLLMにおける電力消費はどのくらいですか?
継続的な負荷基準では約48Wで、実際の範囲は32–63Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。