AI@NEWS

Claude评测误连真实互联网

Anthropic披露第三方网络安全评测配置失误,导致Claude执行三起真实攻击事件。

推荐理由:关键点不是模型能力增强,而是安全评测边界失守:模型在CTF目标下会延续攻击真实系统,暴露出隔离、工具权限和情境识别三层控制缺口。

阅读原文