35B センジョンクン · 公式販売製品 · 2026-09-06 更新

GPUメモリ48GB・本体費用は別途です

NVIDIA A40 48GB ローカル LLM 速度・メモリ・電気代

696GB/s 384ビット 48GB ECC VRAM。中古ワークステーションおよびサーバー環境においても、70Bクラスの4ビットまたは27B〜35Bの高精度モデルを単一カードに搭載可能な大容量GPUです。

主要仕様

使用可能なメモリ
46GB
メモリ帯域幅
696GB/s
ローカルLLMの継続的負荷
約400W
韓国の参考価格(ウォン)
680–780万ウォン

良い人

  • 46GBの利用可能なメモリを活用する
  • CUDAベースのローカル推論
  • Qwen3.8-Flash-Nextクラスの高速生成

購入前に確認

表示価格と電力はGPU中心の比較です。実際のシステムではホストPC、電源装置、冷却およびスロット構成が追加されます。

4Kコンテキスト・Q4モデル別予想パフォーマンス

モデル必要なメモリトークン生成最初のトークンプリフィル
Gemma 4 12B
llama.cpp CUDA · Q4_K_M
8GB71 ~ 78.9 tok/s3.0 ~ 3.8秒1,091 ~ 1,388 tok/s
Qwen3.8-Flash-Next
llama.cpp CUDA · Q4_K_M
77.01GB9.1 ~ 10.3 tok/s3.8 ~ 12.9秒319 ~ 1,107 tok/s (NVMe クール~ウォーム)

単一ユーザーでの予想範囲であり、ランタイムや冷却、量子化ファイルによって異なる可能性があります。

よくある質問

NVIDIA A40 48GB上で実行可能なローカルLLMはどのようなものがありますか?

Gemma 4 12B、Qwen3.8-Flash-Nextなどを4K入力とデバイス別推奨フォーマットで比較できます。モデルおよびコンテキスト長によって必要なメモリは異なります。

NVIDIA A40 48GBのローカルLLMにおける電力消費はどのくらいですか?

継続的な負荷基準では約400Wで、実際の範囲は330–500Wと予想されます。

表示されたトークン速度は実測値ですか?

公式ハードウェア仕様および検証済みベンチマーキング範囲に基づき、計算機に合わせて補正した予想範囲です。ランタイム、冷却、量子化ファイルおよび文脈長によって変化する可能性があります。