GPT-5.6 Sol挑战ARC成绩
OpenAI称GPT-5.6 Sol在特定API设置下ARC-AGI-3达38.3%,官方设置仅7.8%。
推荐理由:38.3%与7.8%的落差暴露评测已受API工具链和推理设置强影响;模型排名不再只是权重能力比较,而是系统配置竞争。
OpenAI称GPT-5.6 Sol在特定API设置下ARC-AGI-3达38.3%,官方设置仅7.8%。
推荐理由:38.3%与7.8%的落差暴露评测已受API工具链和推理设置强影响;模型排名不再只是权重能力比较,而是系统配置竞争。