입문용 · 로컬 AI 장비 구매 가이드 · 2026-09-01 업데이트
가볍게 시작하기엔 충분합니다. 큰 모델 욕심은 버려야 합니다.
맥 미니 M4 16GB 로컬 LLM 속도와 추천 모델
비용을 최소화해 8B~12B급 모델부터 시작할 때 맞는 구성입니다.
핵심 사양
- 사용 가능 메모리
- 13GB
- 메모리 대역폭
- 120GB/s
- 로컬 LLM 지속 부하
- 약 42W
잘 맞는 사람
- 요약·번역·가벼운 코딩
- 조용한 상시 구동
- 로컬 LLM 첫 입문
이 경우에는 건너뛰기
가용 메모리가 작아 20B 이상 모델과 긴 문맥을 함께 쓰기 어렵습니다.
4K 문맥·Q4 모델별 예상 성능
| 모델 | 필요 메모리 | 토큰 생성 | 첫 토큰 | 프리필 |
|---|---|---|---|---|
| Gemma 4 12B | 8GB | 11.6 ~ 12.9 tok/s | 12.8 ~ 31.1초 | 132 ~ 323 tok/s |
| Gemma 4 26B-A4B (MoE) | 15.55GB | 9.6 ~ 15 tok/s | 6.2 ~ 18.0초 | 229 ~ 668 tok/s |
표시 값은 단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.