大規模モデル · 公式販売製品 · 2026-09-06 更新
ユニファイドメモリ 128GB · モデルが使用できる空間は約114GB
MacBook Pro M3 Max 128GB ローカル LLM 速度・メモリ・電気代
400GB/sのユニファイドメモリ帯域と128GBの大容量メモリで、70BクラスおよびFlash-Next(180B常在)Q4モデルを単独に読み込むM3世代ハイエンドラップトップ構成です。
主要仕様
- 使用可能なメモリ
- 114GB
- メモリ帯域幅
- 400GB/s
- ローカルLLMの継続的負荷
- 約110W
- 韓国の参考価格(ウォン)
- 509–630万ウォン
良い人
- 114GBの利用可能なメモリを活用する
- 静かな完成構成
- Qwen3.8-Flash-Nextクラスのローカル推論
購入前に確認
ユニファイドメモリは大きなモデルのロードに有利ですが、CUDA専用ツールおよびマルチGPUワークフローについては別途確認が必要です。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B MLX 4ビット | 8GB | 41.9 ~ 46.5 tok/s | 5.4 ~ 11.0秒 | 372 ~ 757 tok/s |
| Qwen3.8-Flash-Next MLX 4ビット | 107.13GB | 15.4 ~ 32.2 tok/s | 5.9 ~ 12.3秒 | 335 ~ 702 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
128GBのメモリを持つMBP M3 Maxで実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、Qwen3.8-Flash-Nextなどを4K入力とデバイス別推奨フォーマットで比較できます。モデルおよびコンテキスト長によって必要なメモリは異なります。
MBP M3 Max 128GB のローカル LLM の電力消費はどのくらいですか?
継続的な負荷基準では約110Wで、実際の範囲は75–140Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。