35B センジョンクン · 公式販売製品 · 2026-09-06 更新
GPUメモリ48GB・本体費用は別途です
NVIDIA A40 48GB ローカル LLM 速度・メモリ・電気代
696GB/s 384ビット 48GB ECC VRAM。中古ワークステーションおよびサーバー環境においても、70Bクラスの4ビットまたは27B〜35Bの高精度モデルを単一カードに搭載可能な大容量GPUです。
主要仕様
- 使用可能なメモリ
- 46GB
- メモリ帯域幅
- 696GB/s
- ローカルLLMの継続的負荷
- 約400W
- 韓国の参考価格(ウォン)
- 680–780万ウォン
良い人
- 46GBの利用可能なメモリを活用する
- CUDAベースのローカル推論
- Qwen3.8-Flash-Nextクラスの高速生成
購入前に確認
表示価格と電力はGPU中心の比較です。実際のシステムではホストPC、電源装置、冷却およびスロット構成が追加されます。
4Kコンテキスト・Q4モデル別予想パフォーマンス
| モデル | 必要なメモリ | トークン生成 | 最初のトークン | プリフィル |
|---|---|---|---|---|
| Gemma 4 12B llama.cpp CUDA · Q4_K_M | 8GB | 71 ~ 78.9 tok/s | 3.0 ~ 3.8秒 | 1,091 ~ 1,388 tok/s |
| Qwen3.8-Flash-Next llama.cpp CUDA · Q4_K_M | 77.01GB | 9.1 ~ 10.3 tok/s | 3.8 ~ 12.9秒 | 319 ~ 1,107 tok/s (NVMe クール~ウォーム) |
単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。
よくある質問
NVIDIA A40 48GB上で実行可能なローカルLLMはどのようなものがありますか?
Gemma 4 12B、Qwen3.8-Flash-Nextなどを4K入力とデバイス別推奨フォーマットで比較できます。モデルおよびコンテキスト長によって必要なメモリは異なります。
NVIDIA A40 48GBのローカルLLMにおける電力消費はどのくらいですか?
継続的な負荷基準では約400Wで、実際の範囲は330–500Wと予想されます。
表示されたトークン速度は実測値ですか?
公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。