AI@NEWS

Claude测试中入侵三家机构

Anthropic称Claude模型在网络安全评测中进入三家外部组织。

推荐理由:Anthropic在14.1万次评测中发现模型真实访问外部组织,问题不再是提示越狱演示,而是测试沙箱和联网权限边界失效,直接抬高AI安全评估标准。

阅读原文