Q4 · 4K 문맥 기준
Qwen3.6 35B-A3B (MoE): 총 35B 중 토큰당 3B가 활성화되는 MoE 모델, 최소 메모리와 체감 속도를 함께 보세요.
Qwen3.6 35B-A3B (MoE) Q4 실행에 필요한 약 22GB 메모리와 장비별 프리필, 토큰 생성 속도, 양자화 및 262,144 토큰 문맥 조건을 비교합니다.
모델 사양
- Q4 필요 메모리
- 약 22GB
- 총 파라미터
- 35B
- 활성 파라미터
- 3B
- 네이티브 문맥
- 262,144 토큰
총 35B 파라미터 중 토큰당 약 3B가 활성화되는 MoE 모델입니다. 메모리 적재는 35B 용량이 필요하고, 디코딩 대역폭은 3B 활성 파라미터 기준으로 소비됩니다.
대표 장비
- RTX 5060 Ti 16GB — 가용 15GB, 448GB/s
- 2× RTX 5090 64GB (PCIe) — 가용 61GB, 3584GB/s
- MBA M4 24GB — 가용 20GB, 120GB/s