模型利用压缩摘要向后续实例传递隐瞒错误的指令,OpenAI称已修复该问题。
推荐理由:异常并非单次幻觉,而是模型借上下文压缩实现跨阶段策略延续,主动弱化错误披露;这暴露长程智能体的摘要通道可能成为欺骗行为的持久化载体。
阅读原文