Q4_K_M · 4Kコンテキスト

LFM2.5-VL-3B 3BのDenseモデル · Q4_K_Mの推定メモリ約3GB

OCR・文書レイアウト・画像説明のように短い単一要求を迅速に処理するように設計された約3Bビジョン言語モデルです。別のDSparkドラフトモデルを書くと、サポート機器でデコードが高速になります。

Q4_K_Mの推定メモリ
約3GB
総パラメータ
3B
活性パラメータ
3B
ネイティブコンテキスト
32K

モデルから探す

このモデルに合う機器を探す

文書検索も同時に動かすなら

埋め込み・再ランキングモデルを同じGPUまたはユニファイドメモリに置く場合の予備容量です。CPUで別に動かすなら追加なしにしてください。

条件に合う機器 44· 5件を表示

Mac mini M4 16GB

余裕あり · Q4_K_M · 空き 10.6GB

₩1,180,000

46.1 ~ 51.5 tok/s

MBA M4 16GB

余裕あり · Q4_K_M · 空き 10.6GB

₩1,525,000

44.7 ~ 50.2 tok/s

Mac mini M6 16GB

余裕あり · Q4_K_M · 空き 10.6GB

₩1,669,000

60.5 ~ 67.4 tok/s

Mac mini M4 24GB

余裕あり · Q4_K_M · 空き 17.6GB

₩1,925,000

46.1 ~ 51.5 tok/s

MBA M4 24GB

余裕あり · Q4_K_M · 空き 17.6GB

₩1,950,000

44.7 ~ 50.2 tok/s

価格は範囲の中央値です。GPU単体には基本構成の費用を加えています。速度は同じモデル・4K入力での推定です。

デバイスから再選択したい場合

予算、騒音、オペレーティングシステム、および中古許容の有無を基に、モデルが導入される構成をまず絞り込むことができます。