새로 나온 모델 · 2026-09-04

Qwen3.8-27B 공개: 32GB급 장비에서 돌릴 만할까

새 모델이 나왔다는 소식을 들으면 지금 장비에서도 될지부터 궁금해집니다. Qwen3.8-27B는 개인 장비에서 양자화해 검토할 만한 크기지만, ‘27B니까 27GB’로 계산할 수는 없습니다. 내가 쓸 파일과 문서 길이를 정해 실제 필요한 공간부터 보겠습니다.

이 모델로 해보고 싶은 일을 하나 고릅니다

Qwen3.8-27B는 텍스트와 시각 자료를 입력으로 다루는 밀집형 모델입니다. 문서를 정리하면서 화면 캡처도 함께 묻고 싶은 경우에 살펴볼 수 있습니다. 이미지를 이해한다는 말은 새 이미지나 영상을 생성한다는 뜻과는 다릅니다.

새 모델이라는 이유만으로 기존 모델을 바로 지울 필요는 없습니다. 평소 잘 안 풀리던 코드나 문서 질문을 준비해 결과를 비교해보세요. 모델 소개의 장점이 내 질문에서도 나타나는지 확인하는 것이 교체의 첫 단계입니다.

창가의 작업대에 놓인 고메모리 소형 컴퓨터와 그래픽카드 데스크톱 장비 사진
Qwen3.8-27B Q4는 24GB에서도 짧은 문맥으로 시작할 수 있지만, 다른 앱과 긴 문맥까지 생각하면 32GB 이상에서 운용 여유가 생깁니다.

원본과 Q4 변환본은 다른 구매 조건입니다

공식 BF16 가중치와 데스크톱용 Q4 변환본은 크기와 실행 경로가 다릅니다. 27B 숫자는 파라미터 규모이지 파일의 GB 표기가 아닙니다. 같은 이름의 파일도 양자화와 포함된 구성 요소에 따라 용량이 달라집니다.

기존 가이드에서 잡은 Q4 가중치 약 17GB대는 출발점으로만 사용하고 받을 파일을 직접 확인하세요. GPU에 들어간 뒤에도 작업 공간과 KV 캐시가 필요합니다. 24GB 카드에서 로드가 됐다고 긴 문서와 이미지까지 같은 여유로 처리할 수 있는 것은 아닙니다.

균일한 메모리 모듈 전체가 하나의 계산 보드로 이어지는 27B 밀집 모델 표현 사진
밀집 모델은 토큰을 만들 때 넓은 가중치 영역을 계속 사용하므로 모델이 들어가는 용량과 메모리 대역폭을 함께 봐야 합니다.

32GB라는 숫자도 어디에 있는지 봐야 합니다

외장 GPU의 VRAM과 맥의 통합 메모리는 다른 조건입니다. 맥은 운영체제와 다른 앱이 공간을 함께 쓰므로 모델 전용으로 전부 사용할 수 없습니다. 브라우저와 편집기를 켜놓고 사용할 계획이라면 그 상태의 여유도 필요합니다.

현재 장비가 있다면 짧은 문맥과 한 요청에서 먼저 시작합니다. 긴 문서가 일상적인 작업인지, 가끔만 필요한지에 따라 메모리를 더 살 이유가 달라집니다. 실행 가능 용량만으로 가장 쾌적한 장비까지 고를 수는 없습니다.

사진과 도면, 긴 문서를 로컬 워크스테이션 옆에 펼쳐 놓은 멀티모달 작업대 사진
문서뿐 아니라 이미지와 영상 입력도 다룰 수 있어, 로컬 장비를 고를 때는 비전 입력이 추가로 쓰는 메모리도 남겨 두는 편이 안전합니다.

긴 문맥과 MTP는 지원과 실사용을 나눕니다

모델이 지원하는 최대 문맥은 내 장비에 곧바로 적용할 기본값이 아닙니다. 필요한 길이로 시작해 메모리와 첫 토큰을 확인하고 늘리세요. 입력이 길어지면 생성 속도보다 앞쪽 기다림이 더 중요해질 수 있습니다.

MTP 역시 변환본에 관련 가중치가 있고 런타임이 지원해야 합니다. 일반 생성부터 기준을 남긴 뒤 켜야 효과를 분리할 수 있습니다. 이미지 입력과 생각 과정 처리도 현재 앱에서 정상적으로 전달되는지 따로 확인합니다.

더 작은 모델로 충분하다면

짧은 답변과 간단한 문서 처리에서 작은 모델의 결과가 충분할 수 있습니다. 27B를 위해 장비를 키우기 전에 내가 얻고 싶은 개선이 실제로 있는지 확인해보세요. 코드 오류가 줄거나 놓치던 문서 조건을 더 잘 찾는다면 추가 메모리의 이유가 됩니다.

그다음 장비 선택기에서 같은 Q4와 입력 길이로 예상 체감을 비교하세요. 이 글은 모든 후보를 직접 측정한 구매 보증이 아닙니다. 새 모델의 발표가 장비 구매의 마감일은 아니므로, 현재 하려는 일이 되는지 먼저 시험해도 늦지 않습니다.