멀티 장비 · 공식 출시 제품 · 2026-09-01 업데이트

48GB VRAM과 1,872GB/s 대역폭, 실제 선택 기준을 확인하세요.

2× NVIDIA GeForce RTX 3090 NVLink 48GB 로컬 LLM 속도·메모리·전기요금

2× 24GB VRAM(합산 48GB, 합산 로컬 대역폭 1,872 GB/s)과 3세대 NVLink(112.5 GB/s 양방향)로 연결된 듀얼 GPU 구성입니다. 텐서/파이프라인 병렬화 지원 시 70B급 모델을 온전 적재합니다.

핵심 사양

사용 가능 메모리
45GB
메모리 대역폭
1872GB/s
로컬 LLM 지속 부하
약 780W
현재 참고 범위
210–260만원

잘 맞는 사람

  • 45GB 가용 메모리 활용
  • 두 장비 분산 추론
  • DeepSeek-V4-Flash-0731 (MoE)급 모델 비교

구매 전 확인

장비를 두 대 연결해도 메모리가 자동으로 하나처럼 합쳐지지 않습니다. 분산 런타임 지원과 인터커넥트 병목을 함께 확인해야 합니다.

4K 문맥·Q4 모델별 예상 성능

모델필요 메모리토큰 생성첫 토큰프리필
Gemma 4 12B8GB129.8 ~ 180.3 tok/s1.6 ~ 2.7초1,510 ~ 2,562 tok/s
DeepSeek-V4-Flash-0731 (MoE)168.72GB3.4 ~ 3.4 tok/s5.8 ~ 9.7초435 ~ 739 tok/s

단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.

자주 묻는 질문

2× RTX 3090 48GB (NVLink)에서 어떤 로컬 LLM을 돌릴 수 있나요?

Gemma 4 12B, DeepSeek-V4-Flash-0731 (MoE) 등을 Q4·4K 조건에서 비교할 수 있습니다. 모델과 문맥 길이에 따라 필요한 메모리는 달라집니다.

2× RTX 3090 48GB (NVLink)의 로컬 LLM 전력은 어느 정도인가요?

지속 부하 기준 약 780W이며 실제 범위는 650–920W로 예상합니다.

표시된 토큰 속도는 실측값인가요?

공식 하드웨어 사양과 검증된 벤치마크 범위를 계산기에 맞춰 보정한 예상 범위입니다. 런타임, 냉각, 양자화 파일과 문맥 길이에 따라 달라질 수 있습니다.