35B 안정권 · 로컬 AI 장비 구매 가이드 · 2026-09-01 업데이트

작은 본체에서 35B를 오래 쓰려면 여기부터입니다.

맥 미니 M4 Pro 64GB 로컬 LLM 추천 구성

작은 완제품에서 35B급 모델과 긴 문맥을 안정적으로 운용하려는 사람에게 맞습니다.

핵심 사양

사용 가능 메모리
56GB
메모리 대역폭
273GB/s
로컬 LLM 지속 부하
약 95W

잘 맞는 사람

  • 35B급 장기 사용
  • 긴 문서 처리
  • 작은 본체의 메모리 여유

이 경우에는 건너뛰기

동일 예산의 CUDA 장비보다 생성 속도가 낮을 수 있어 설치 편의와 비교해야 합니다.

4K 문맥·Q4 모델별 예상 성능

모델필요 메모리토큰 생성첫 토큰프리필
Gemma 4 12B8GB27.8 ~ 30.9 tok/s6.3 ~ 14.2초289 ~ 656 tok/s
Qwen3.6 35B-A3B (MoE)21.28GB19.6 ~ 46.1 tok/s2.7 ~ 6.3초658 ~ 1,547 tok/s

표시 값은 단일 사용자 예상 범위이며 런타임, 냉각, 양자화 파일에 따라 달라질 수 있습니다.