사기 전에 속도와 비용부터

로컬 AI 장비 가이드

로컬 LLM 대표 속도 결과

검색과 구매 수요가 높은 장비·모델 20개 조합의 프리필, 첫 토큰 시간과 토큰 생성 속도를 권장 설정으로 확인합니다.

이 목록을 보는 순서

내 장비나 구매 후보와 가까운 조합을 고르세요. 이 목록에 없는 조합은 속도 계산기에서 확인할 수 있지만 검색 페이지로 따로 만들지는 않습니다.

Q4_K_M · 4K

Mac mini M4 24GB에서 Gemma 4 12B 속도: 프리필·토큰 생성

Mac mini M4 24GB에서 Gemma 4 12B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Mac mini M4 32GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

Mac mini M4 32GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Mac mini M4 Pro 48GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

Mac mini M4 Pro 48GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Mac mini M4 Pro 64GB에서 Qwen3.6 35B-A3B (MoE) 속도: 프리필·토큰 생성

Mac mini M4 Pro 64GB에서 Qwen3.6 35B-A3B (MoE) 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

MBP M5 Pro 64GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

MBP M5 Pro 64GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Studio M4 Max 128GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

Studio M4 Max 128GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Studio M4 Max 128GB에서 Qwen3.6 35B-A3B (MoE) 속도: 프리필·토큰 생성

Studio M4 Max 128GB에서 Qwen3.6 35B-A3B (MoE) 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Studio M3 Ultra 512GB에서 Qwen3.8-Flash-Next 속도: 프리필·토큰 생성

Studio M3 Ultra 512GB에서 Qwen3.8-Flash-Next 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Studio M5 Ultra 512GB에서 Qwen3.8-Flash-Next 속도: 프리필·토큰 생성

Studio M5 Ultra 512GB에서 Qwen3.8-Flash-Next 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX 3090 24GB에서 Gemma 4 12B 속도: 프리필·토큰 생성

RTX 3090 24GB에서 Gemma 4 12B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX 3090 24GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

RTX 3090 24GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX 4090 24GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

RTX 4090 24GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX 5090 32GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

RTX 5090 32GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX 5090 32GB에서 Gemma 4 26B-A4B (MoE) 속도: 프리필·토큰 생성

RTX 5090 32GB에서 Gemma 4 26B-A4B (MoE) 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

RTX PRO 6000 96GB에서 Qwen3.8-Flash-Next 속도: 프리필·토큰 생성

RTX PRO 6000 96GB에서 Qwen3.8-Flash-Next 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

DGX Spark 128GB에서 Qwen3.6 35B-A3B (MoE) 속도: 프리필·토큰 생성

DGX Spark 128GB에서 Qwen3.6 35B-A3B (MoE) 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

2× DGX Spark 256GB에서 Qwen3.8-Flash-Next 속도: 프리필·토큰 생성

2× DGX Spark 256GB에서 Qwen3.8-Flash-Next 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

2× RTX 3090 48GB (NVLink)에서 Qwen3.6 35B-A3B (MoE) 속도: 프리필·토큰 생성

2× RTX 3090 48GB (NVLink)에서 Qwen3.6 35B-A3B (MoE) 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

2× RTX 5090 64GB (PCIe)에서 Qwen3.8-Flash-Next 속도: 프리필·토큰 생성

2× RTX 5090 64GB (PCIe)에서 Qwen3.8-Flash-Next 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.

Q4_K_M · 4K

Ryzen AI Max+ 395 128GB에서 Qwen3.8 27B 속도: 프리필·토큰 생성

Ryzen AI Max+ 395 128GB에서 Qwen3.8 27B 모델을 권장 설정으로 실행할 때의 프리필, 첫 토큰 시간과 토큰 생성 속도를 같은 4K 입력 조건으로 체감합니다.