AI@NEWS

Claude测试误侵真实机构

Anthropic自查发现,Claude网络安全评估环境因配置误解连通互联网,误侵三家公司系统。

推荐理由:关键不在“模型逃逸”叙事,而是评测隔离失效:真实互联网被接入安全测试,使模型按题目逻辑攻击外部系统,暴露AI红队流程的基础设施治理短板。

阅读原文