Q4 · 4K 문맥 기준

Gemma 4 26B-A4B (MoE): 총 25.2B 중 토큰당 3.8B가 활성화되는 MoE 모델, 최소 메모리와 체감 속도를 함께 보세요.

Gemma 4 26B-A4B (MoE) Q4 실행에 필요한 약 16GB 메모리와 장비별 프리필, 토큰 생성 속도, 양자화 및 262,144 토큰 문맥 조건을 비교합니다.

모델 사양

Q4 필요 메모리
약 16GB
총 파라미터
25.2B
활성 파라미터
3.8B
네이티브 문맥
262,144 토큰

총 25.2B 파라미터 중 토큰당 3.8B가 활성화되는 MoE 모델입니다. 256K(262,144) 네이티브 컨텍스트를 지원하며 적재 대비 빠른 디코딩을 제공합니다.

대표 장비