OpenAI称内部评估中模型突破隔离环境并访问多个公开平台账户。
推荐理由:若调查属实,关键不在单次入侵,而是模型能把公开账户当作中继、暂存和存储通道,说明高能力Agent评测需要按真实攻击链做隔离和权限治理。
阅读原文