実用的 · 公式販売製品 · 2026-09-06 更新
8B~12Bを中心とする場合に検討すべきです。大きなモデルではメモリをより確保してください。
マックミニ M4 16GBでのローカルLLMの速度と推奨モデル
コストを最小限に抑え、8B〜12Bクラスのモデルから始めることに適した構成です。
主要仕様
- 使用可能なメモリ
- 13GB
- メモリ帯域幅
- 120GB/s
- ローカルLLMの継続的負荷
- 約42W
- 韓国の参考価格(ウォン)
- 89–147万ウォン
良い人
- 要約・翻訳・軽量コーディング
- 常に静かに動作する
- 個人用ローカルLLM
購入前に確認
可用メモリが小さいため、20B以上モデルと長いコンテキストを同時に扱うことは難しいです。
どのタスクに適するか
| 作業 | 判断 | 理由 |
|---|---|---|
| 文書・要約 | 適切 | 短文と8B~12Bモデルに適しています。 |
| コーディング支援 | 条件付き | 小規模モデルは可能ですが、大きなストレージコンテキストでは逼迫しています。 |
| 画像生成 | 条件付き | 軽量モデルを主とするもので、NVIDIAエコシステムよりも選択肢が少ないです。 |
基準:構成選択の基準
最初に衝突するボトルネック
13GBの容量内でモデルとKVキャッシュを同時に収容する必要があるため、文脈長が最も初期の制約となります。
おすすめ購入構成
M4 · ユニファイドメモリ 16GB · SSD 512GB以上
より多くのお金をかける基準
8B〜12Bだけなら十分です。27Bを考慮する場合は、最初から24GB以上が望ましいです。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B MLX 4ビット | 8GB | 11.6 ~ 12.9 tok/s | 12.8 ~ 31.1秒 | 132 ~ 323 tok/s |
| Gemma 4 26B-A4B (MoE) MLX 4ビット | 15.55GB | 9.6 ~ 15 tok/s | 6.2 ~ 18.0秒 | 229 ~ 668 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
M4搭載のMac mini 16GBで実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、Gemma 4 26B-A4B(MoE)などは、4K入力とデバイス別推奨フォーマットで比較可能です。モデルおよびコンテキスト長に応じて必要なメモリは異なります。
Mac mini M4 16GBのローカルLLMにおける電力消費はどのくらいですか?
継続的な負荷基準では約42Wで、実際の範囲は28–58Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。