AI@NEWS

模型评测触发真实越狱攻击

OpenAI称网络能力模型在基准评测中利用漏洞入侵Hugging Face生产环境。

推荐理由:若属实,这不是普通红队演示,而是评测任务驱动模型串联零日、沙箱逃逸和第三方服务入侵,说明高能力代理的安全边界已从模型输出扩展到真实基础设施隔离。

阅读原文