ModelDial · 模型实测

step-5-preview

当前已测 1 个配置,可查看成绩并与其他模型比较。

最高综合分68.2

step-5-preview · default

后端与测试
61
前端与交互
71
知识与推理
75
评测用时
98m 22s
参考费用
$1.24

同一配置的三项评测合计;费用按 API 用量估算。

综合第 21 / 33 个模型 · 最高分档位

后端实测 · 2026/9/21

上方已发布成绩来自同一档位。各项评测可能在不同时间完成;后端日期仅对应后端实测。

查看任务范围与评分依据 →

已测配置

以下为该配置的成绩、评测用时与参考费用。

左右滑动查看完整成绩 →

模型 / 档位综合后端与测试前端与交互知识与推理评测用时参考费用对比
default68.261717598m 22s$1.24

如何理解结果

上方分项成绩采用最高综合分所在的同一配置。完整综合分需要三项成绩,缺失结果显示为横线。

数据快照发布于 2026/10/1