実用的 · 公式販売製品 · 2026-09-06 更新

8B~12Bを中心とする場合に検討すべきです。大きなモデルではメモリをより確保してください。

マックミニ M4 16GBでのローカルLLMの速度と推奨モデル

コストを最小限に抑え、8B〜12Bクラスのモデルから始めることに適した構成です。

主要仕様

使用可能なメモリ
13GB
メモリ帯域幅
120GB/s
ローカルLLMの継続的負荷
約42W
韓国の参考価格(ウォン)
89–147万ウォン

良い人

  • 要約・翻訳・軽量コーディング
  • 常に静かに動作する
  • 個人用ローカルLLM

購入前に確認

可用メモリが小さいため、20B以上モデルと長いコンテキストを同時に扱うことは難しいです。

どのタスクに適するか

作業判断理由
文書・要約適切短文と8B~12Bモデルに適しています。
コーディング支援条件付き小規模モデルは可能ですが、大きなストレージコンテキストでは逼迫しています。
画像生成条件付き軽量モデルを主とするもので、NVIDIAエコシステムよりも選択肢が少ないです。

基準:構成選択の基準

最初に衝突するボトルネック

13GBの容量内でモデルとKVキャッシュを同時に収容する必要があるため、文脈長が最も初期の制約となります。

おすすめ購入構成

M4 · ユニファイドメモリ 16GB · SSD 512GB以上

より多くのお金をかける基準

8B〜12Bだけなら十分です。27Bを考慮する場合は、最初から24GB以上が望ましいです。

4Kコンテキスト・Q4モデル別予想パフォーマンス

モデル必要なメモリトークン生成最初のトークンプリフィル
Gemma 4 12B
MLX 4ビット
8GB11.6 ~ 12.9 tok/s12.8 ~ 31.1秒132 ~ 323 tok/s
Gemma 4 26B-A4B (MoE)
MLX 4ビット
15.55GB9.6 ~ 15 tok/s6.2 ~ 18.0秒229 ~ 668 tok/s

単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。

よくある質問

M4搭載のMac mini 16GBで実行可能なローカルLLMはどのようなものがありますか?

Gemma 4 12B、Gemma 4 26B-A4B(MoE)などは、4K入力とデバイス別推奨フォーマットで比較可能です。モデルおよびコンテキスト長に応じて必要なメモリは異なります。

Mac mini M4 16GBのローカルLLMにおける電力消費はどのくらいですか?

継続的な負荷基準では約42Wで、実際の範囲は28–58Wと予想されます。

表示されたトークン速度は実測値ですか?

公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。