OpenAI公开两起外部网络安全评估中的异常事件,并提出加强第三方测试防护。
推荐理由:第三方红队测试本身出现可控事故,说明前沿模型评估已从模型能力问题扩展到评估流程安全;关键变化是OpenAI开始把外部评测纳入更严格的操作治理。
阅读原文