Q4_K_M · 4K 문맥 기준
LFM2.5-VL-3B 3B 밀도형 모델 · Q4_K_M 예상 메모리 약 3GB
OCR·문서 레이아웃·이미지 설명처럼 짧은 단일 요청을 빠르게 처리하도록 설계된 약 3B 비전 언어 모델입니다. 별도 DSpark 초안 모델을 쓰면 지원 장비에서 디코드가 빨라집니다.
- Q4_K_M 예상 메모리
- 약 3GB
- 총 파라미터
- 3B
- 활성 파라미터
- 3B
- 네이티브 문맥
- 32K
모델에서 장비로
이 모델을 돌릴 장비 찾기
문서 검색도 함께 돌린다면
임베딩·재정렬 모델을 같은 GPU 또는 통합 메모리에 올릴 때 남겨둘 공간입니다. CPU에서 따로 실행한다면 추가 없음으로 두세요.
조건에 맞는 장비 44· 5개 표시
가격은 범위의 중간값이며 GPU 단품에는 기본 본체 비용을 더했습니다. 속도는 동일 모델·4K 입력의 추정 범위입니다.
장비부터 다시 고르고 싶다면
예산, 소음, 운영체제와 중고 허용 여부를 기준으로 모델이 들어가는 구성을 먼저 좁힐 수 있습니다.