両側同時体験 · 推奨実行設定
ローカルLLMデバイスの生成速度を直接比較
同じモデルを同じタイミングで開始し、数字だけでなく実際の回答が連続する速度の違いも確認してください。
比較されるデバイスとモデル
比較条件を展開する
同じ 203トークンごとの回答の予想時間です。公開測定があるアクセラレーションのみが自動的に選択され、各結果ではデバイスごとの実行フォーマットが表示されます。
左側
開始前Mac mini M4 Pro 64GB
開始ボタンを押すと、双方のデバイスが同時に同じ回答を生成します。
右側
開始前RTX 5090 32GB
開始ボタンを押すと、双方のデバイスが同時に同じ回答を生成します。
この条件下では RTX 5090 32GBが 全体の回答を 約 18.7まず、バッチをマジます。
入力処理から203トークン回答完了までを比較します。
自分に合うのはどちら?
回答完了
RTX 5090 32GB
推定の中央値では、同じ回答を約18.7倍の速さで完了します。
入力処理
RTX 5090 32GB
入力処理速度の推定中央値は13,161 tok/sで、こちらが上回ります。
画像・動画生成
生成モデル別に確認
LLMの速度だけでは判断できません。画像・動画のモデルと解像度を別途選んでください。
実行環境
機器別の設定
MLX 4ビット / vLLM 0.28.0 · CUDA 13.3.1 · driver 610.43.02 · MTP-2。実行環境が異なる場合、速度差にはソフトウェアやモデル形式の違いも含まれます。
推定消費電力
Mac mini M4 Pro 64GB
LLM使用中の推定消費電力は約95Wで、こちらが低くなります。騒音と本体サイズは別途確認が必要です。
価格差の判断
Mac mini M4 Pro 64GBは完成品PC、RTX 5090 32GBはGPU単体の価格です。GPU単品については本体費用を加えた上で比較すべきです。
購入前に確認しておきたい項目
| 比較基準 | Mac mini M4 Pro 64GB | RTX 5090 32GB |
|---|---|---|
| 利用可能な高速メモリ | 56GB | 30.5GB |
| メモリ帯域幅 | 273GB/s | 1792GB/s |
| 全体完了の予想 | 27秒 | 1.4秒 |
| LLM連続負荷の推定 | 約95W | 約620W |
| 韓国の参考価格(ウォン) | 412–620万ウォン | 866〜1,209万ウォン |
表示値は単一ユーザーの想定範囲です。マルチGPU・マルチデバイス構成では、ランタイムおよびインターフェイスによって実際の結果が異なる可能性があります。