LocalAI
ローカルLLM代表速度結果
検索・購入需要の高い20組の機器とモデルについて、推奨設定でプリフィル、最初のトークンまでの時間、生成速度を確認します。
このリストを確認する順序
手元の機器や購入候補に近い組み合わせを選んでください。ほかの組み合わせは速度計算機で確認できますが、個別の検索ページは作成しません。
Q4_K_M · 4K
Mac mini M4 24GBでのGemma 4 12B速度:プリフィル・トークン生成
Mac mini M4 24GBでGemma 4 12Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Mac mini M4 32GBでのQwen3.8 27B速度:プリフィル・トークン生成
Mac mini M4 32GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Mac mini M4 Pro 48GBでのQwen3.8 27B速度:プリフィル・トークン生成
Mac mini M4 Pro 48GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Mac mini M4 Pro 64GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成
Mac mini M4 Pro 64GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
MBP M5 Pro 64GBでのQwen3.8 27B速度:プリフィル・トークン生成
MBP M5 Pro 64GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Studio M4 Max 128GBでのQwen3.8 27B速度:プリフィル・トークン生成
Studio M4 Max 128GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Studio M4 Max 128GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成
Studio M4 Max 128GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Studio M3 Ultra 512GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成
Studio M3 Ultra 512GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Studio M5 Ultra 512GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成
Studio M5 Ultra 512GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX 3090 24GBでのGemma 4 12B速度:プリフィル・トークン生成
RTX 3090 24GBでGemma 4 12Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX 3090 24GBでのQwen3.8 27B速度:プリフィル・トークン生成
RTX 3090 24GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX 4090 24GBでのQwen3.8 27B速度:プリフィル・トークン生成
RTX 4090 24GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX 5090 32GBでのQwen3.8 27B速度:プリフィル・トークン生成
RTX 5090 32GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX 5090 32GBでのGemma 4 26B-A4B (MoE)速度:プリフィル・トークン生成
RTX 5090 32GBでGemma 4 26B-A4B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
RTX PRO 6000 96GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成
RTX PRO 6000 96GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
DGX Spark 128GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成
DGX Spark 128GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
2× DGX Spark 256GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成
2× DGX Spark 256GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
2× RTX 3090 48GB (NVLink)でのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成
2× RTX 3090 48GB (NVLink)でQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
2× RTX 5090 64GB (PCIe)でのQwen3.8-Flash-Next速度:プリフィル・トークン生成
2× RTX 5090 64GB (PCIe)でQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。
Q4_K_M · 4K
Ryzen AI Max+ 395 128GBでのQwen3.8 27B速度:プリフィル・トークン生成
Ryzen AI Max+ 395 128GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。