claude-fable-5-1
比较各思考档位在私有数据集上的表现。分项成绩与费用均来自对应的实测记录。
最高综合分89.8
claude-fable-5-1 · max
- 后端与测试
- 85
- 前端与交互
- 91
- 知识与推理
- 95
- 评测用时
- 79m 7s
- 参考费用
- $26.15
同一配置的三项评测合计;费用按 API 用量估算。
档位收益与代价
比较相邻实测档位的得分、费用与用时。
xhigh max
- 综合分
- +0.7 分 89.1 → 89.8
- 参考费用
- +$10.21 $15.94 → $26.15
- 评测用时
- +42.3% 55m 35s → 79m 7s
各档位实测成绩
选择两到三个配置,比较分数与费用。
左右滑动查看完整成绩 →
| 模型 / 档位 | 综合 | 后端与测试 | 前端与交互 | 知识与推理 | 评测用时 | 参考费用 | 对比 |
|---|---|---|---|---|---|---|---|
| high | 82.0 | 73 | 86 | 90 | 66m 53s | $8.28 | |
| xhigh | 89.1 | 84 | 90 | 95 | 55m 35s | $15.94 | |
| max | 89.8 | 85 | 91 | 95 | 79m 7s | $26.15 |
如何理解结果
上方分项成绩采用最高综合分所在的同一配置。完整综合分需要三项成绩,缺失结果显示为横线。
数据快照发布于 2026/10/1