속도 우선 · 로컬 AI 장비 구매 가이드 · 2026-09-01 업데이트

큰 모델보다 빠른 12B. 메모리보다 응답성을 사는 구성입니다.

맥 미니 M4 Pro 24GB 로컬 LLM 속도 비교

큰 모델보다 12B급 모델의 빠른 응답과 작은 설치 공간을 우선할 때 맞습니다.

핵심 사양

사용 가능 메모리
20GB
메모리 대역폭
273GB/s
로컬 LLM 지속 부하
약 86W

잘 맞는 사람

  • 빠른 12B급 응답
  • 코딩 보조
  • 소형 고성능 데스크

이 경우에는 건너뛰기

칩 성능에 비해 메모리 용량이 작아 대형 모델 확장성은 제한됩니다.

4K 문맥·Q4 모델별 예상 성능

모델필요 메모리토큰 생성첫 토큰프리필
Gemma 4 12B8GB27.8 ~ 30.9 tok/s6.3 ~ 14.2초289 ~ 656 tok/s
Qwen3.6 35B-A3B (MoE)21.28GB27.8 ~ 43.2 tok/s2.8 ~ 6.5초631 ~ 1,482 tok/s

표시 값은 단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.