AI@NEWS

OpenAI 发布 GPT-5.6 与 Superapp, 多项基准超 Fable 5

GPT-5.6 Sol 在编码、浏览、安全、科学、长上下文与 agent 任务上增强, Agents' Last Exam 达 52.7%, 部分基准超越 Claude Fable 5。

推荐理由:Agents' Last Exam 52.7% 领先前代与 Fable 5, 且官方强调以更少 token、更低成本达成——前沿竞争焦点正从纯能力转向单位成本智能与 agent 效率。

阅读原文