실속형 · 로컬 AI 장비 구매 가이드 · 2026-09-01 업데이트
12B를 편하게 쓰는 실속형. 27B부터는 조건을 탑니다.
맥 미니 M4 24GB 로컬 LLM 성능과 적정 모델
12B급 모델을 자주 쓰면서 본체 가격과 전력 사용을 낮추고 싶을 때 균형이 좋습니다.
핵심 사양
- 사용 가능 메모리
- 20GB
- 메모리 대역폭
- 120GB/s
- 로컬 LLM 지속 부하
- 약 45W
잘 맞는 사람
- 12B급 일상 업무
- 개인 문서 요약
- 작은 데스크 환경
이 경우에는 건너뛰기
27B급은 양자화와 문맥 길이에 따라 메모리 여유가 빠르게 줄어듭니다.
4K 문맥·Q4 모델별 예상 성능
| 모델 | 필요 메모리 | 토큰 생성 | 첫 토큰 | 프리필 |
|---|---|---|---|---|
| Gemma 4 12B | 8GB | 11.6 ~ 12.9 tok/s | 12.8 ~ 31.1초 | 132 ~ 323 tok/s |
| Qwen3.6 35B-A3B (MoE) | 21.28GB | 12.2 ~ 19 tok/s | 5.7 ~ 16.3초 | 252 ~ 725 tok/s |
표시 값은 단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.