Q4_K_M · 4Kコンテキスト

Holo4 35B-A3B 総35Bのうちトークンごとに3Bが動作するMoEモデル · Q4_K_Mの推定メモリ約22GB

35B全体の中で、トークンあたり約3Bを有効にするコンピュータ使用MoEモデルです。アクティブパラメータは計算量を説明し、ローカル積載には全体の重みとビジョン・KVキャッシュ余裕が必要です。

Q4_K_Mの推定メモリ
約22GB
総パラメータ
35B
活性パラメータ
3B
ネイティブコンテキスト
256K

モデルから探す

このモデルに合う機器を探す

文書検索も同時に動かすなら

埋め込み・再ランキングモデルを同じGPUまたはユニファイドメモリに置く場合の予備容量です。CPUで別に動かすなら追加なしにしてください。

条件に合う機器 40· 5件を表示

Mac mini M4 32GB

余裕あり · Q4_K_M · 空き 5.7GB

₩2,100,000

46.1 ~ 51.5 tok/s

Mac mini M6 32GB

余裕あり · Q4_K_M · 空き 5.7GB

₩2,774,000

67.2 ~ 74.9 tok/s

MBP M3 Pro 36GB

余裕あり · Q4_K_M · 空き 8.7GB

₩2,850,000

59.3 ~ 66.1 tok/s

Mac mini M4 Pro 48GB

余裕あり · Q4_K_M · 空き 19.7GB

₩3,035,000

111.1 ~ 123.4 tok/s

MBA M5 32GB

余裕あり · Q4_K_M · 空き 5.7GB

₩3,095,000

58.8 ~ 65.7 tok/s

価格は範囲の中央値です。GPU単体には基本構成の費用を加えています。速度は同じモデル・4K入力での推定です。

デバイスから再選択したい場合

予算、騒音、オペレーティングシステム、および中古許容の有無を基に、モデルが導入される構成をまず絞り込むことができます。