大規模モデル · 公式販売製品 · 2026-09-06 更新
GPUメモリ 96GB · 基本費用は別途です
NVIDIA RTX PRO 6000 Blackwell 96GB ローカル LLM 速度・メモリ・電気代
1,792GB/s 96GB ECC VRAMワークステーションGPU。利用可能な93GB VRAM予算内での70B〜120Bクラスの4ビットモデルを単一カードに完全に収める。
主要仕様
- 使用可能なメモリ
- 93GB
- メモリ帯域幅
- 1792GB/s
- ローカルLLMの継続的負荷
- 約650W
- 韓国の参考価格(ウォン)
- 2,450–2,650万ウォン
良い人
- 93GBの利用可能なメモリを活用する
- CUDAベースのローカル推論
- GLM-5.3-Flash (MoE)クラスの高速生成
購入前に確認
表示価格と電力はGPU中心の比較です。実際のシステムではホストPC、電源装置、冷却およびスロット構成が追加されます。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B llama.cpp CUDA · Q4_K_M | 8GB | 198 ~ 218.3 tok/s | 1.1 ~ 1.4秒 | 3,025 ~ 3,698 tok/s |
| GLM-5.3-Flash (MoE) llama.cpp CUDA · Q4_K_M | 190.21GB | 6.6 ~ 6.6 tok/s | 4.2 ~ 5.1秒 | 823 ~ 1,006 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
RTX PRO 6000 96GBで実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、GLM-5.3-Flash(MoE)などについて、4K入力とデバイス別推奨フォーマットで比較可能です。モデルやコンテキスト長によって必要なメモリは異なります。
RTX PRO 6000 96GBのローカルLLMの電力消費はどのくらいですか?
継続的な負荷基準では約650Wで、実際の範囲は520–780Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。