默认路径
Qwen3.8 27B 在本地、单用户、单流条件下运行,稳定 MTP/推测解码草稿视为常规路径。来源标注的短上下文测试、SGLang 与 DFlash/DFlash2 不计入默认中位数。
ModelDock 研究
你的工作负载
读取是模型摄入提示词、文件和聊天历史;写入是模型生成答案。长文档和编程会话通常偏重读取,因此默认从 75% 读取 / 25% 写入开始。稳定 MTP 视为常规路径,而不是单独场景。
模型量化
2× GPU 装机提示 双卡机器需要为宽卡预留机箱空间和插槽间距,具备稳定且余量充足的供电与散热;安装和多 GPU 调度也比单卡节点更复杂。
| 硬件 | 能力 | 当前负载经济性 | 证据 | 市场 | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| RTX 309024GB · 单卡节点 | 24 GB | 705 | 55.9 | 良好 | 500W | $1,350 | $2,350 | 15.6 | $0.198 | $1.80 | $2.73 | 2,524 天 | 中位数 ↗ | |
| RTX 3090 Ti24GB · 单卡节点 | 24 GB | 1,458.3 | 69.8 | 良好 | 600W | $1,400 | $2,400 | 21.1 | $0.165 | $2.16 | $3.69 | 1,570 天 | 中位数 ↗ | |
| AMD Radeon RX 7900 XTX24GB GDDR6 | 24 GB | 877.8 | 43.9 | 良好 | 475W | $800 | $1,800 | 13.2 | $0.204 | $1.71 | $2.31 | 3,007 天 | 中位数 ↗ | |
| 2× RTX 5060 Ti每卡 16GB · 双卡节点 | 32 GB | 723 | 65.9 | 良好 | 480W | $1,760 | $2,760 | 17.9 | $0.181 | $1.73 | $3.13 | 1,969 天 | 中位数 ↗ | |
| 2× RTX 5070 Ti每卡 16GB · 双卡节点 | 32 GB | 3,250 | 113.3 | 良好 | 620W | $2,400 | $3,400 | 35.4 | $0.116 | $2.23 | $6.20 | 857 天 | 中位数 ↗ | |
| 2× RTX 4080每卡 16GB · 双卡节点 | 32 GB | ~1,700 | ~58 | 良好 | 760W | $1,900 | $2,900 | 18.2 | $0.238 | $2.74 | $3.18 | 6,501 天 | 估算 | |
| RTX 409024GB · 单卡节点 | 24 GB | 2,692.3 | 68.8 | 良好 | 550W | $2,500 | $3,500 | 22.1 | $0.176 | $1.98 | $3.86 | 1,858 天 | 中位数 ↗ | |
| RTX 509032GB · 单卡节点 | 32 GB | 3,571.4 | 132.5 | 良好 | 700W | $4,200 | $5,200 | 41.2 | $0.130 | $2.52 | $7.21 | 1,109 天 | 中位数 ↗ | |
| Intel Arc Pro B7032GB GDDR6 | 32 GB | 424.8 | 49.3 | 良好 | 350W | $1,299 | $2,299 | 12.6 | $0.199 | $1.26 | $2.21 | 2,412 天 | 中位数 ↗ | |
| RTX PRO 5000 Blackwell48GB GDDR7 ECC | 48 GB | 6,288 | 112.5 | 良好 | 420W | $9,085 | $10,085 | 36.9 | $0.191 | $1.51 | $6.46 | 2,040 天 | 中位数 ↗ | |
| RTX PRO 6000 Blackwell96GB GDDR7 ECC | 96 GB | 7,756 | 109.3 | 良好 | 720W | $13,250 | $14,250 | 36.2 | $0.287 | $2.59 | $6.34 | 3,803 天 | 中位数 ↗ | |
| Mac Studio M3 Ultra 512 GB80 核 · 512GB 统一内存 | 512 GB | 462.5 | 44.3 | 良好 | 330W | — | $9,499 | 11.9 | $0.538 | $1.19 | $2.08 | 10,657 天 | 中位数 ↗ | |
| Mac Studio M4 Max 64 GB64GB 统一内存 · 当前零售参考 | 64 GB | ~274 | ~53.3 | 良好 | 145W | — | $3,499 | 11.6 | $0.210 | $0.52 | $2.04 | 2,312 天 | 估算 | |
| Mac Studio M4 Max 128 GB有来源支持的 oMLX 配置 | 128 GB | — | 56.8 | 良好 | 145W | — | $6,500 | — | 待补充 | — | — | — | 中位数 ↗ | |
| MacBook Pro M5 Max 128 GB128GB 统一内存 | 128 GB | 745 | 59.2 | 良好 | 120W | — | $6,699 | 16.5 | $0.248 | $0.43 | $2.89 | 2,725 天 | 中位数 ↗ | |
| Mac mini M5 Pro 64 GB20 核 GPU · 64GB 统一内存 | 64 GB | ~373 | ~29.6 | 良好 | ~110W | — | $2,899 | 8.3 | $0.240 | $0.40 | $1.45 | 2,762 天 | 估算 | |
| Mac Studio M5 Max 64 GB40 核 GPU · 64GB 统一内存 | 64 GB | ~745 | ~59.2 | 良好 | ~180W | — | $3,799 | 16.5 | $0.165 | $0.65 | $2.89 | 1,694 天 | 估算 | |
| Mac Studio M5 Max 128 GB40 核 GPU · 128GB 统一内存 | 128 GB | ~745 | ~59.2 | 良好 | ~180W | — | $5,399 | 16.5 | $0.218 | $0.65 | $2.89 | 2,407 天 | 估算 | |
| Mac Studio M5 Ultra 96 GB30 核 CPU · 64 核 GPU · 96GB 统一内存 | 96 GB | ~1,075 | ~91 | 良好 | ~360W | — | $5,499 | 25.1 | $0.172 | $1.30 | $4.39 | 1,778 天 | 估算 | |
| Mac Studio M5 Ultra 256 GB36 核 CPU · 80 核 GPU · 256GB 统一内存 | 256 GB | ~1,075 | ~91 | 良好 | ~360W | — | $10,799 | 25.1 | $0.288 | $1.30 | $4.39 | 3,492 天 | 估算 | |
| DGX Spark128GB 统一内存 | 128 GB | 1,225.5 | 44 | 良好 | 170W | — | $4,699 | 13.7 | $0.232 | $0.61 | $2.40 | 2,623 天 | 中位数 ↗ | |
假设
75% reading / 25% writing · 24 active h/day
整机功耗 · Qwen3.8 27B · 常规本地使用
透明计算
GPU 整机总价 = GPU 价格 + $1,000 主机本地 $/MM =(能耗 + 硬件摊销)/ 每日产能回本天数 = 整机总价 /(每日 API 等值 − 每日能耗)单用户顺序模型:读取时间 + 写入时间;不假设并发或重叠。
证据数据
打开已发布硬件记录背后的来源分布。
方法
性能采用来源可见、MTP 就绪的中位数。下方经济性可调,因为它描述你的使用方式,而不是基准运行本身。
Qwen3.8 27B 在本地、单用户、单流条件下运行,稳定 MTP/推测解码草稿视为常规路径。来源标注的短上下文测试、SGLang 与 DFlash/DFlash2 不计入默认中位数。
读取(prefill)与写入(decode)分别取中位数。点击 Median 后仍可查看量化、上下文、运行时、拓扑和草稿深度等来源条件。
Median 链接到来源分布。~ 速率估算根据已测量和已报告的读取/写入数据采用公开的保守硬件比例缩放,始终与来源中位数分开。Pending 表示尚未收集常规路径来源指标。
独立显卡整机总价由记录的 GPU 价格加 $1,000 主机/平台预算构成。回本期以整机总价除以每日 API 等值减直接电费计算,不构成投资回报保证。