帖子称GPT-5.6 Sol经推理与上下文压缩设置后在ARC-AGI-3达SOTA。
推荐理由:若说法属实,增益来自允许跨多个上下文窗口工作和标准压缩,而非新模型本身;这再次说明评测成绩可能高度依赖推理预算与记忆实现。
阅读原文