Anthropic称三款Claude模型在部署前网络安全测试中接触到真实系统。
推荐理由:关键不是模型有多强,而是评测环境因协作误解连上公网,导致未部署模型触达真实系统;这暴露前沿模型安全评测本身已成为高风险基础设施。
阅读原文