購入前に、速度と費用を確かめる

LocalAI

ローカルLLM代表速度結果

検索・購入需要の高い20組の機器とモデルについて、推奨設定でプリフィル、最初のトークンまでの時間、生成速度を確認します。

このリストを確認する順序

手元の機器や購入候補に近い組み合わせを選んでください。ほかの組み合わせは速度計算機で確認できますが、個別の検索ページは作成しません。

Q4_K_M · 4K

Mac mini M4 24GBでのGemma 4 12B速度:プリフィル・トークン生成

Mac mini M4 24GBでGemma 4 12Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Mac mini M4 32GBでのQwen3.8 27B速度:プリフィル・トークン生成

Mac mini M4 32GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Mac mini M4 Pro 48GBでのQwen3.8 27B速度:プリフィル・トークン生成

Mac mini M4 Pro 48GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Mac mini M4 Pro 64GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成

Mac mini M4 Pro 64GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

MBP M5 Pro 64GBでのQwen3.8 27B速度:プリフィル・トークン生成

MBP M5 Pro 64GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Studio M4 Max 128GBでのQwen3.8 27B速度:プリフィル・トークン生成

Studio M4 Max 128GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Studio M4 Max 128GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成

Studio M4 Max 128GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Studio M3 Ultra 512GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成

Studio M3 Ultra 512GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Studio M5 Ultra 512GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成

Studio M5 Ultra 512GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX 3090 24GBでのGemma 4 12B速度:プリフィル・トークン生成

RTX 3090 24GBでGemma 4 12Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX 3090 24GBでのQwen3.8 27B速度:プリフィル・トークン生成

RTX 3090 24GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX 4090 24GBでのQwen3.8 27B速度:プリフィル・トークン生成

RTX 4090 24GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX 5090 32GBでのQwen3.8 27B速度:プリフィル・トークン生成

RTX 5090 32GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX 5090 32GBでのGemma 4 26B-A4B (MoE)速度:プリフィル・トークン生成

RTX 5090 32GBでGemma 4 26B-A4B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

RTX PRO 6000 96GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成

RTX PRO 6000 96GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

DGX Spark 128GBでのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成

DGX Spark 128GBでQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

2× DGX Spark 256GBでのQwen3.8-Flash-Next速度:プリフィル・トークン生成

2× DGX Spark 256GBでQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

2× RTX 3090 48GB (NVLink)でのQwen3.6 35B-A3B (MoE)速度:プリフィル・トークン生成

2× RTX 3090 48GB (NVLink)でQwen3.6 35B-A3B (MoE)を推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

2× RTX 5090 64GB (PCIe)でのQwen3.8-Flash-Next速度:プリフィル・トークン生成

2× RTX 5090 64GB (PCIe)でQwen3.8-Flash-Nextを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。

Q4_K_M · 4K

Ryzen AI Max+ 395 128GBでのQwen3.8 27B速度:プリフィル・トークン生成

Ryzen AI Max+ 395 128GBでQwen3.8 27Bを推奨設定で実行した場合のプリフィル、最初のトークンまでの時間、生成速度を同じ4K入力で体感します。