両側同時体験 · 推奨実行設定

ローカルLLMデバイスの生成速度を直接比較

同じモデルを同じタイミングで開始し、数字だけでなく実際の回答が連続する速度の違いも確認してください。

比較されるデバイスとモデル

比較範囲
比較条件を展開する

同じ 203トークンごとの回答の予想時間です。公開測定があるアクセラレーションのみが自動的に選択され、各結果ではデバイスごとの実行フォーマットが表示されます。

左側

開始前

Mac mini M4 Pro 64GB

最初のトークン7.8 ~ 14.3秒
プリフィル289 ~ 530 tok/s
トークン生成12.3 ~ 13.7 tok/s

開始ボタンを押すと、双方のデバイスが同時に同じ回答を生成します。

MLX 4ビット0.0秒 · 0/203

右側

開始前

RTX 5090 32GB

最初のトークン0.27 ~ 0.39 秒
プリフィル10660.8 ~ 15662.2 tok/s
トークン生成148.2 ~ 217.8 tok/s

開始ボタンを押すと、双方のデバイスが同時に同じ回答を生成します。

vLLM 0.28.0 · CUDA 13.3.1 · driver 610.43.02 · MTP-20.0秒 · 0/203

この条件下では RTX 5090 32GBが 全体の回答を 約 18.7まず、バッチをマジます。

入力処理から203トークン回答完了までを比較します。

自分に合うのはどちら?

回答完了

RTX 5090 32GB

推定の中央値では、同じ回答を約18.7倍の速さで完了します。

入力処理

RTX 5090 32GB

入力処理速度の推定中央値は13,161 tok/sで、こちらが上回ります。

画像・動画生成

生成モデル別に確認

LLMの速度だけでは判断できません。画像・動画のモデルと解像度を別途選んでください。

実行環境

機器別の設定

MLX 4ビット / vLLM 0.28.0 · CUDA 13.3.1 · driver 610.43.02 · MTP-2。実行環境が異なる場合、速度差にはソフトウェアやモデル形式の違いも含まれます。

推定消費電力

Mac mini M4 Pro 64GB

LLM使用中の推定消費電力は約95Wで、こちらが低くなります。騒音と本体サイズは別途確認が必要です。

価格差の判断

Mac mini M4 Pro 64GBは完成品PC、RTX 5090 32GBはGPU単体の価格です。GPU単品については本体費用を加えた上で比較すべきです。

購入前に確認しておきたい項目

比較基準Mac mini M4 Pro 64GBRTX 5090 32GB
利用可能な高速メモリ56GB30.5GB
メモリ帯域幅273GB/s1792GB/s
全体完了の予想27秒1.4秒
LLM連続負荷の推定約95W約620W
韓国の参考価格(ウォン)412–620万ウォン866〜1,209万ウォン
Mac mini M4 Pro 64GB 詳細表示
RTX 5090 32GB 詳細表示

表示値は単一ユーザーの想定範囲です。マルチGPU・マルチデバイス構成では、ランタイムおよびインターフェイスによって実際の結果が異なる可能性があります。