MODELDOCK / 本地经济性
最佳速度
面向 Qwen3.8 27B 的组合硬件速度排名:按 75% 读取与 25% 写入的实际耗时加权。
硬件 × 模型数据集
排序依据加权 token 速度越高越好
硬件配置读取 / 预填充 tok/s写入 / 解码 单流 · tok/s加权速度 75% 读取 / 25% 写入 · tok/s
3,571.4
132.5
476.9
6,288
112.5
427.1
7,756
109.3
419.3
3,250
113.3
410.1
~1,075
~91
290.3
~1,075
~91
290.3
2,692.3
68.8
255.6
1,458.3
69.8
244
~1,700
~58
210.5
723
65.9
207
745
59.2
191.2
~745
~59.2
191.2
~745
~59.2
191.2
705
55.9
180.6
1,225.5
44
159
877.8
43.9
152.7
424.8
49.3
146.4
462.5
44.3
137.5
~274
~53.3
134.6
~373
~29.6
95.6
包含内容
适配普通 Qwen3.8 27B 路径、并披露读取、写入、功耗与购置成本的硬件配置。
为何用此公式
它累加时间而非速率:慢速写入不会隐藏在快速预填充之后。
数据来源
打开基准工作台,查看源码中位数、工况、经济性假设与价格参考。