Q4 · 4K チャンク基準

Qwen3.8 27B: 27B プリフィルモデル · Q4実行メモリ約18GB

Qwen3.8 27B Q4実行に必要な約18GBメモリおよびデバイス別プリフィル、トークン生成速度、量子化および262,144トークン文脈条件を比較します。

モデル仕様

Q4で必要なメモリ
約18GB
総パラメータ
27B
活性パラメータ
27B
ネイティブコンテキスト
262,144 トークン

27B密度型オープン重みモデルで、多段階MTP(複数トークン予測)学習ヘッドが内蔵されています。ネイティブ262,144(256K)トークンコンテキストをサポートしています。

代表設備

デバイス別速度チューニング

デバイスを選択すると、量子化、安全なコンテキスト、GPU オフロード、Flash Attention、KVキャッシュおよびバッチ開始値を一括で確認できます。

Qwen3.8-27Bの設定:MacのoMLXとRTXのllama.cpp

このモデルのプリフィル・トークン生成速度の確認