속도 우선 · 로컬 AI 장비 구매 가이드 · 2026-09-01 업데이트
큰 모델보다 빠른 12B. 메모리보다 응답성을 사는 구성입니다.
맥 미니 M4 Pro 24GB 로컬 LLM 속도 비교
큰 모델보다 12B급 모델의 빠른 응답과 작은 설치 공간을 우선할 때 맞습니다.
핵심 사양
- 사용 가능 메모리
- 20GB
- 메모리 대역폭
- 273GB/s
- 로컬 LLM 지속 부하
- 약 86W
잘 맞는 사람
- 빠른 12B급 응답
- 코딩 보조
- 소형 고성능 데스크
이 경우에는 건너뛰기
칩 성능에 비해 메모리 용량이 작아 대형 모델 확장성은 제한됩니다.
4K 문맥·Q4 모델별 예상 성능
| 모델 | 필요 메모리 | 토큰 생성 | 첫 토큰 | 프리필 |
|---|---|---|---|---|
| Gemma 4 12B | 8GB | 27.8 ~ 30.9 tok/s | 6.3 ~ 14.2초 | 289 ~ 656 tok/s |
| Qwen3.6 35B-A3B (MoE) | 21.28GB | 27.8 ~ 43.2 tok/s | 2.8 ~ 6.5초 | 631 ~ 1,482 tok/s |
표시 값은 단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.