大規模モデル · 公式販売製品 · 2026-09-06 更新
ユニファイドメモリ 512GB · モデルが使用できる空間は約480GB
Mac Studio M3 Ultra 512GB ローカル LLM 速度・メモリ・電気代
819GB/sのユニファイドメモリ帯域幅と512GBの大容量メモリを備えた、M3世代の最高スペックワークステーションで、大規模オープンモデルベンチマーキングの標準基準点を担います。
主要仕様
- 使用可能なメモリ
- 480GB
- メモリ帯域幅
- 819GB/s
- ローカルLLMの継続的負荷
- 約230W
- 韓国の参考価格(ウォン)
- 2,400–2,600万ウォン
良い人
- 480GBの利用可能なメモリを活用する
- 静かな完成構成
- GLM-5.3-Flash (MoE)クラスのローカル推論
購入前に確認
ユニファイドメモリは大きなモデルのロードに有利ですが、CUDA専用ツールおよびマルチGPUワークフローについては別途確認が必要です。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B MLX 4ビット | 8GB | 83.5 ~ 92.8 tok/s | 3.9 ~ 5.2秒 | 785 ~ 1,060 tok/s |
| GLM-5.3-Flash (MoE) MLX 4ビット | 190.21GB | 55.5 ~ 61.6 tok/s | 19.3 ~ 26.1秒 | 157 ~ 212 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
Studio M3 Ultra 512GBで利用可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、GLM-5.3-Flash(MoE)などについて、4K入力とデバイス別推奨フォーマットで比較可能です。モデルやコンテキスト長によって必要なメモリは異なります。
Studio M3 Ultra 512GBのローカルLLMの電力はどのくらいですか?
継続的な負荷基準では約230Wで、実際の範囲は180–270Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。