35 个模型 · 83 个配置
综合前五名
满分 1001
gpt-6-astramax95.5
2
gpt-6.1-solmax93.8
3
claude-opus-5-5max90.3
4
claude-fable-5-1max89.8
5
claude-sonnet-5-5xhigh86.6
代际与档位差异
综合得分后端 40% · 前端 30% · 推理 30%,采用同一实测配置。
按任务看成绩
查看评测说明 →基于自建私有数据集,成绩反映本次任务范围。 为什么这样测 →
模型表现与评测费用
完整榜单 →左上方:费用更低,得分更高 · 每个点对应一个模型与档位
帕累托前沿新模型实测其他配置已绘制 66 / 83 个配置
点选查看成绩与费用
综合分95.5参考费用$8.35
三项评测 API 参考费用合计;对数刻度,仅展示费用完整且大于零的配置。 比较方法 →