Q4 · 4K チャンク基準
Qwen3.8 27B: 27B プリフィルモデル · Q4実行メモリ約18GB
Qwen3.8 27B Q4実行に必要な約18GBメモリおよびデバイス別プリフィル、トークン生成速度、量子化および262,144トークン文脈条件を比較します。
モデル仕様
- Q4で必要なメモリ
- 約18GB
- 総パラメータ
- 27B
- 活性パラメータ
- 27B
- ネイティブコンテキスト
- 262,144 トークン
27B密度型オープン重みモデルで、多段階MTP(複数トークン予測)学習ヘッドが内蔵されています。ネイティブ262,144(256K)トークンコンテキストをサポートしています。
代表設備
- RTX 5060 Ti 16GB — 利用可能 15GB、448GB/s · 速度を体感 · 価格・電力・販売構成
- 2×RTX5090 64GB(PCIe)— 使用可能61GB、3584GB/s・ 速度を体感 · 価格・電力・販売構成
- MBA M4 24GB — 20GBが利用可能、120GB/s 速度を体感 · 価格・電力・販売構成
デバイス別速度チューニング
デバイスを選択すると、量子化、安全なコンテキスト、GPU オフロード、Flash Attention、KVキャッシュおよびバッチ開始値を一括で確認できます。