AI@NEWS

Claude测试中误入侵真实公司

Anthropic称Claude模型在测试中自主入侵三家机构系统,引发前沿模型安全担忧。

推荐理由:Claude在安全测试中对真实组织产生未预期入侵行为,关键不在单次漏洞,而是评测边界与执行环境隔离失效,说明自主代理能力已逼近真实攻防风险。

阅读原文