既定経路
Qwen3.8 27B をローカル、単一ユーザー、単一ストリームで使い、安定した MTP/投機的ドラフトを通常経路とします。情報源が短いコンテキストと明示した測定、SGLang、DFlash/DFlash2 は既定中央値に含めません。
ModelDock リサーチ
ワークロード
読み取りはプロンプト、ファイル、履歴の取り込み、書き込みは回答生成です。長文書やコーディングは読み取り寄りのため、既定値は 75% 読み取り / 25% 書き込みです。安定した MTP は別シナリオではなく通常経路として扱います。
モデル量子化
2× GPU 構築メモ デュアルカード構成では、幅広カード用のケース余裕とスロット間隔、余裕ある安定電源と冷却が必要です。導入とマルチ GPU スケジューリングも単一カードより複雑です。
| ハードウェア | 能力 | ワークロードの経済性 | 根拠 | 市場 | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| RTX 309024GB · 単一カード | 24 GB | 705 | 55.9 | 良好 | 500W | $1,350 | $2,350 | 15.6 | $0.198 | $1.80 | $2.73 | 2,524 日 | 中央値 ↗ | |
| RTX 3090 Ti24GB · 単一カード | 24 GB | 1,458.3 | 69.8 | 良好 | 600W | $1,400 | $2,400 | 21.1 | $0.165 | $2.16 | $3.69 | 1,570 日 | 中央値 ↗ | |
| AMD Radeon RX 7900 XTX24GB GDDR6 | 24 GB | 877.8 | 43.9 | 良好 | 475W | $800 | $1,800 | 13.2 | $0.204 | $1.71 | $2.31 | 3,007 日 | 中央値 ↗ | |
| 2× RTX 5060 Ti各 16GB · デュアルカード | 32 GB | 723 | 65.9 | 良好 | 480W | $1,760 | $2,760 | 17.9 | $0.181 | $1.73 | $3.13 | 1,969 日 | 中央値 ↗ | |
| 2× RTX 5070 Ti各 16GB · デュアルカード | 32 GB | 3,250 | 113.3 | 良好 | 620W | $2,400 | $3,400 | 35.4 | $0.116 | $2.23 | $6.20 | 857 日 | 中央値 ↗ | |
| 2× RTX 4080各 16GB · デュアルカード | 32 GB | ~1,700 | ~58 | 良好 | 760W | $1,900 | $2,900 | 18.2 | $0.238 | $2.74 | $3.18 | 6,501 日 | 推定 | |
| RTX 409024GB · 単一カード | 24 GB | 2,692.3 | 68.8 | 良好 | 550W | $2,500 | $3,500 | 22.1 | $0.176 | $1.98 | $3.86 | 1,858 日 | 中央値 ↗ | |
| RTX 509032GB · 単一カード | 32 GB | 3,571.4 | 132.5 | 良好 | 700W | $4,200 | $5,200 | 41.2 | $0.130 | $2.52 | $7.21 | 1,109 日 | 中央値 ↗ | |
| Intel Arc Pro B7032GB GDDR6 | 32 GB | 424.8 | 49.3 | 良好 | 350W | $1,299 | $2,299 | 12.6 | $0.199 | $1.26 | $2.21 | 2,412 日 | 中央値 ↗ | |
| RTX PRO 5000 BlackwellGDDR7 ECC 48GB | 48 GB | 6,288 | 112.5 | 良好 | 420W | $9,085 | $10,085 | 36.9 | $0.191 | $1.51 | $6.46 | 2,040 日 | 中央値 ↗ | |
| RTX PRO 6000 BlackwellGDDR7 ECC 96GB | 96 GB | 7,756 | 109.3 | 良好 | 720W | $13,250 | $14,250 | 36.2 | $0.287 | $2.59 | $6.34 | 3,803 日 | 中央値 ↗ | |
| Mac Studio M3 Ultra 512 GB80 コア · 512GB ユニファイドメモリ | 512 GB | 462.5 | 44.3 | 良好 | 330W | — | $9,499 | 11.9 | $0.538 | $1.19 | $2.08 | 10,657 日 | 中央値 ↗ | |
| Mac Studio M4 Max 64 GB64GB ユニファイドメモリ · 現行小売参考 | 64 GB | ~274 | ~53.3 | 良好 | 145W | — | $3,499 | 11.6 | $0.210 | $0.52 | $2.04 | 2,312 日 | 推定 | |
| Mac Studio M4 Max 128 GB情報源付き oMLX プロファイル | 128 GB | — | 56.8 | 良好 | 145W | — | $6,500 | — | 保留中 | — | — | — | 中央値 ↗ | |
| MacBook Pro M5 Max 128 GB128GB ユニファイドメモリ | 128 GB | 745 | 59.2 | 良好 | 120W | — | $6,699 | 16.5 | $0.248 | $0.43 | $2.89 | 2,725 日 | 中央値 ↗ | |
| Mac mini M5 Pro 64 GB20 コア GPU · 64GB ユニファイドメモリ | 64 GB | ~373 | ~29.6 | 良好 | ~110W | — | $2,899 | 8.3 | $0.240 | $0.40 | $1.45 | 2,762 日 | 推定 | |
| Mac Studio M5 Max 64 GB40 コア GPU · 64GB ユニファイドメモリ | 64 GB | ~745 | ~59.2 | 良好 | ~180W | — | $3,799 | 16.5 | $0.165 | $0.65 | $2.89 | 1,694 日 | 推定 | |
| Mac Studio M5 Max 128 GB40 コア GPU · 128GB ユニファイドメモリ | 128 GB | ~745 | ~59.2 | 良好 | ~180W | — | $5,399 | 16.5 | $0.218 | $0.65 | $2.89 | 2,407 日 | 推定 | |
| Mac Studio M5 Ultra 96 GB30 コア CPU · 64 コア GPU · 96GB ユニファイドメモリ | 96 GB | ~1,075 | ~91 | 良好 | ~360W | — | $5,499 | 25.1 | $0.172 | $1.30 | $4.39 | 1,778 日 | 推定 | |
| Mac Studio M5 Ultra 256 GB36 コア CPU · 80 コア GPU · 256GB ユニファイドメモリ | 256 GB | ~1,075 | ~91 | 良好 | ~360W | — | $10,799 | 25.1 | $0.288 | $1.30 | $4.39 | 3,492 日 | 推定 | |
| DGX Spark128GB ユニファイドメモリ | 128 GB | 1,225.5 | 44 | 良好 | 170W | — | $4,699 | 13.7 | $0.232 | $0.61 | $2.40 | 2,623 日 | 中央値 ↗ | |
前提
75% reading / 25% writing · 24 active h/day
システム全体の電力 · Qwen3.8 27B · 通常のローカル利用
透明な計算
GPU システム総額 = GPU 価格 + $1,000 ホストローカル $/MM =(電力費 + ハードウェア配賦)/ 1 日の処理量損益分岐日数 = システム総額 /(API 相当額/日 − 電力費/日)単一ユーザーの逐次モデル:読み取り時間 + 書き込み時間。同時実行や重なりは想定しません。
根拠データ
公開済みハードウェアレコードの情報源分布を開きます。
方法
性能には、情報源を確認できる MTP 対応中央値を使用します。経済性はベンチマーク実行ではなく利用方法を表すため調整可能です。
Qwen3.8 27B をローカル、単一ユーザー、単一ストリームで使い、安定した MTP/投機的ドラフトを通常経路とします。情報源が短いコンテキストと明示した測定、SGLang、DFlash/DFlash2 は既定中央値に含めません。
読み取り(prefill)と書き込み(decode)は別々に中央値を取ります。Median をクリックすると、量子化、コンテキスト、ランタイム、トポロジー、ドラフト深度を確認できます。
Median は情報源分布にリンクします。~ 速度推定は測定・報告済みデータから公開済みの保守的なハードウェア比で換算した値で、情報源中央値とは分離します。Pending は通常レーンの情報源指標が未収集であることを示します。
単体 GPU 構成のシステム総額には、記録された GPU 価格に $1,000 のホスト/プラットフォーム予算を加えます。損益分岐は、システム総額を 1 日の API 相当額から直接電力費を引いた値で割ったもので、投資収益を保証しません。