새로 나온 모델 · 2026-09-04

Gemma 4 공개: 12B와 26B-A4B 중 내 장비에 맞는 모델

Gemma 4에는 여러 크기가 있어 고르기가 오히려 어렵습니다. 작은 모델을 받았다가 더 큰 모델의 답변을 놓치는 것은 아닐까 걱정될 수 있습니다. 하지만 내 장비에서 계속 켜두고 쓸 수 있는지도 중요합니다. 12B와 26B-A4B를 중심으로 그 차이를 읽어보겠습니다.

크기보다 사용할 장면을 먼저 놓습니다

노트북에서 짧은 문서를 정리할 모델과 긴 코드를 계속 생성할 모델의 조건은 다를 수 있습니다. 텍스트 외에 이미지나 음성 입력이 필요한지도 정해야 합니다. 제품군 전체에 소개된 기능이 모든 크기와 변환본에서 똑같이 된다고 보면 안 됩니다.

처음에는 평소 질문 몇 개를 작은 후보에 보내봅니다. 답변이 충분한지, 잘못된 부분을 확인하기 쉬운지 보는 것이 출발점입니다. 크기가 작다는 이유만으로 탈락시키면 이미 가진 장비로 할 수 있는 일을 놓칠 수 있습니다.

노트북과 소형 컴퓨터 옆에 카메라와 마이크, 헤드폰이 놓인 로컬 멀티모달 작업대 사진
Gemma 4의 작은 크기들은 노트북과 소형 데스크톱에서 문서·이미지·오디오 입력을 한 모델로 다루려는 경우에 잘 맞습니다.

12B와 26B-A4B는 숫자만 다른 것이 아닙니다

12B는 밀집형, 26B-A4B는 전체 가중치 중 일부를 토큰마다 사용하는 MoE입니다. 더 큰 총규모가 매 토큰의 계산량도 같은 비율로 늘어난다는 뜻은 아닙니다. 그렇다고 활성 부분만 메모리에 올리면 되는 것도 아닙니다.

실제로 받을 Q4 파일과 실행 후 캐시·작업 공간을 합쳐보세요. 12B의 공식 가중치는 약 24GB 규모로 확인되지만 이를 데스크톱 Q4 파일의 요구량과 섞으면 안 됩니다. 원본과 변환본은 다른 실행 조건입니다.

하나의 연속 계산 장치와 여러 전문 모듈이 담긴 큰 장치를 나란히 놓은 비교 모형 사진
12B 밀집 모델과 26B-A4B MoE는 이름의 크기뿐 아니라 전체 적재량과 토큰당 활성 계산량이 서로 다릅니다.

작은 메모리에서 먼저 확인할 것

16GB급 장비라면 호환되는 12B Q4를 짧은 문맥과 한 요청에서 시험하는 식으로 접근할 수 있습니다. 맥에서는 운영체제와 다른 앱도 같은 메모리를 쓰므로 표시 용량만 보고 성공을 보장할 수는 없습니다.

26B-A4B는 전체 전문가 가중치를 보관할 공간이 더 필요합니다. 현재 장비에서 일부가 RAM으로 넘어간다면 낮은 활성 계산량의 이점이 전송 대기에 가려질 수 있습니다. 메모리에 충분히 들어가는 조건과 속도를 함께 확인하세요.

얇은 노트북과 통풍구가 큰 데스크톱을 같은 작업대에 나란히 놓은 장비 선택 사진
16GB급은 12B Q4의 가벼운 사용부터, 24GB 이상은 26B-A4B Q4와 긴 문맥을 검토하는 출발점이 됩니다.

이미지와 음성을 더할 때

텍스트 질문이 잘 된 뒤 이미지나 오디오 입력을 하나씩 추가합니다. 현재 모델 크기와 앱이 지원하는 입력인지 확인하고 메모리와 첫 토큰 시간이 어떻게 달라지는지 봅니다. 입력 처리 구성 요소가 추가되면 텍스트만 보던 때와 여유가 다를 수 있습니다.

지원 최대 문맥도 처음부터 전부 켤 필요는 없습니다. 실제 문서 길이로 시작해 늘리면서 중요한 내용을 제대로 찾는지 확인하세요. 긴 문서를 받아들였다는 사실과 끝까지 정확하게 활용했다는 사실은 별개입니다.

큰 모델로 바꿀 이유가 생겼을 때

작은 모델에서 반복해서 틀리는 질문을 큰 모델에도 보내보세요. 실제 오류가 줄고 기다림이 감당할 만하다면 추가 메모리에 비용을 쓸 이유가 있습니다. 결과 차이가 작다면 작은 모델을 여유 있게 유지하는 선택도 가능합니다.

새 제품군의 가장 큰 모델을 모두 따라갈 필요는 없습니다. 지금의 문서와 코드를 처리하는 모델 하나를 안정적으로 남기는 것도 좋은 선택입니다. 장비 비교는 그 모델과 입력 길이가 정해진 뒤에 해도 됩니다.