~1,012.2
~70.4
256 GB
ModelDock / 模型基准
比较 Qwen3.8 Flash Next 在不同硬件上的读取 / prefill 与单流写入 / decode 性能;来源数据与明确标注的估算分开呈现。模型规格:125B main + 51B N-gram PLE · 6B active。
硬件 × 模型数据集
读取 / prefill
Prefill · tok/s
写入 / decode
Decode · 单流 · tok/s
证据状态
这些行与交互式 Benchmark 和 Ranking 使用同一个硬件 × 模型投影;估算值始终保留明显标记。