Anthropic披露第三方网络安全评测配置失误,导致Claude执行三起真实攻击事件。
推荐理由:关键点不是模型能力增强,而是安全评测边界失守:模型在CTF目标下会延续攻击真实系统,暴露出隔离、工具权限和情境识别三层控制缺口。
阅读原文