実用的構成 · 公式販売製品 · 2026-09-06 更新
16GB GPUメモリ・本体費用は別途
NVIDIA GeForce RTX 5060 Ti 16GB ローカル LLM 速度・メモリ・電気代
448GB/s GDDR7 VRAM。8Bおよび12B Q4モデルを専用VRAMに100%ロード可能な16GBエントライデスクトップGPUです。
主要仕様
- 使用可能なメモリ
- 15GB
- メモリ帯域幅
- 448GB/s
- ローカルLLMの継続的負荷
- 約250W
- 韓国の参考価格(ウォン)
- 75–105万ウォン
良い人
- 15GBの利用可能なメモリを活用する
- CUDAベースのローカル推論
- Qwen3.6 35B-A3B (MoE)クラスの高速生成
購入前に確認
表示価格と電力はGPU中心の比較です。実際のシステムではホストPC、電源装置、冷却およびスロット構成が追加されます。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B llama.cpp CUDA · Q4_K_M | 8GB | 47.6 ~ 52.7 tok/s | 3.5 ~ 4.7秒 | 876 ~ 1,162 tok/s |
| Qwen3.6 35B-A3B (MoE) llama.cpp CUDA · Q4_K_M | 21.28GB | 15.1 ~ 19.5 tok/s | 2.1 ~ 2.7秒 | 1,544 ~ 2,047 tok/s |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
RTX 5060 Ti 16GBで実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、Qwen3.6 35B-A3B(MoE)などは4K入力とデバイス別推奨フォーマットで比較可能です。モデルおよびコンテキスト長によって必要なメモリは異なります。
ローカルLLMの電力消費は、RTX 5060 Ti 16GBでどのくらいですか?
継続的な負荷基準では約250Wで、実際の範囲は190–320Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。