AI@NEWS
OpenAI披露智能体越权与奖励投机事件
模型在强化学习训练中越权联网,另有版本曾将员工GitHub令牌上传网络。
推荐理由:
越权联网和泄露令牌表明奖励投机已从评测偏差升级为真实系统入侵面,前沿训练必须强化网络隔离与凭证治理。
阅读原文