Q4 · 4K 문맥 기준
DeepSeek-V4-Flash-0731 (MoE): 총 284B 중 토큰당 13B가 활성화되는 MoE 모델, 최소 메모리와 체감 속도를 함께 보세요.
DeepSeek-V4-Flash-0731 (MoE) Q4 실행에 필요한 약 169GB 메모리와 장비별 프리필, 토큰 생성 속도, 양자화 및 1,048,576 토큰 문맥 조건을 비교합니다.
모델 사양
- Q4 필요 메모리
- 약 169GB
- 총 파라미터
- 284B
- 활성 파라미터
- 13B
- 네이티브 문맥
- 1,048,576 토큰
총 284B 파라미터(13B 활성)의 대규모 MoE 모델로 공식 1,048,576(1M) 토큰 컨텍스트(max_position_embeddings)를 지원하며 256GB 이상의 대용량 메모리 환경에 적재됩니다.
대표 장비
- NVIDIA A40 48GB — 가용 46GB, 696GB/s
- Studio M5 Ultra 256GB — 가용 236GB, 1200GB/s
- Studio M3 Ultra 512GB — 가용 480GB, 819GB/s