GPT-5.6
比较各思考档位在私有数据集上的表现。分项成绩与费用均来自对应的实测记录。
最高综合分78.4
gpt-5.6-sol · max
- 后端与测试
- 85
- 前端与交互
- 73
- 知识与推理
- 75
- 评测用时
- 87m 21s
- 参考费用
- $3.25
同一配置的三项评测合计;费用按 API 用量估算。
档位收益与代价
比较相邻实测档位的得分、费用与用时。
xhigh max
- 综合分
- +8.2 分 70.2 → 78.4
- 参考费用
- +$0.69 $2.56 → $3.25
- 评测用时
- +22.5% 71m 19s → 87m 21s
各档位实测成绩
选择两到三个配置,比较分数与费用。
左右滑动查看完整成绩 →
| 模型 / 档位 | 综合 | 后端与测试 | 前端与交互 | 知识与推理 | 评测用时 | 参考费用 | 对比 |
|---|---|---|---|---|---|---|---|
| gpt-5.6-sollow | 69.0 | 69 | 78 | 60 | 41m 49s | $1.53 | |
| gpt-5.6-terralow | 36.5 | 53 | 21 | 30 | 43m 42s | $0.71 | |
| gpt-5.6-lunalow | 19.7 | 32 | 18 | 5 | 52m 31s | $0.067 | |
| gpt-5.6-solmedium | 75.1 | 73 | 83 | 70 | 59m 12s | $1.72 | |
| gpt-5.6-terramedium | 49.6 | 49 | 50 | 50 | 46m 2s | $0.75 | |
| gpt-5.6-lunamedium | 31.8 | 51 | 13 | 25 | 18m 22s | $0.084 | |
| gpt-5.6-solhigh | 77.7 | 78 | 90 | 65 | 58m 24s | $2.05 | |
| gpt-5.6-terrahigh | 59.6 | 65 | 67 | 45 | 53m 5s | $1.03 | |
| gpt-5.6-lunahigh | 39.7 | 49 | 52 | 15 | 32m 18s | $0.14 | |
| gpt-5.6-solxhigh | 70.2 | 78 | 65 | 65 | 71m 19s | $2.56 | |
| gpt-5.6-terraxhigh | 58.9 | 67 | 72 | 35 | 67m 17s | $1.54 | |
| gpt-5.6-lunaxhigh | 54.8 | 56 | 83 | 25 | 75m 23s | $0.16 | |
| gpt-5.6-solmax | 78.4 | 85 | 73 | 75 | 87m 21s | $3.25 | |
| gpt-5.6-terramax | 71.7 | 81 | 76 | 55 | 133m 2s | $1.94 | |
| gpt-5.6-lunamax | 56.9 | 65 | 78 | 25 | 86m 14s | $0.35 |
如何理解结果
上方分项成绩采用最高综合分所在的同一配置。完整综合分需要三项成绩,缺失结果显示为横线。
数据快照发布于 2026/10/1