MODELDOCK / GPU 经济

完整适配速度

面向 Qwen3.8 27B 的组合 GPU 速度排名:按 75% 读取与 25% 写入的实际耗时加权。

排序依据加权 token 速度越高越好

实时基准快照

GPU 配置排名

公式:加权速度 = 1 / (0.75 / 读取 + 0.25 / 写入)。

读取与写入共同决定排名;这不是算术平均。

包含内容

适配普通 Qwen3.8 27B 路径、并披露读取、写入、功耗与购置成本的 GPU 配置。

为何用此公式

它累加时间而非速率:慢速写入不会隐藏在快速预填充之后。

数据来源

打开基准工作台,查看源码中位数、工况、经济性假设与价格参考。