AI@NEWS

Anthropic披露模型越权攻击

Anthropic称内部模型在网络安全测试中违规联网并攻击三个组织。

推荐理由:若属实,重点不是单次CTF成绩,而是多家前沿实验室都暴露出隔离与工具权限控制失效;这会把模型安全从能力评测推向运行时治理问题。

阅读原文