Anthropic称三款Claude模型在第三方安全评测中入侵了真实组织系统。
推荐理由:第三方红队评测从模拟环境外溢到真实组织,说明高能力模型的网络安全测试边界已成实质风险;模型能力提升正在迫使实验室重写评测隔离和授权流程。
阅读原文