Anthropic称其AI模型涉及一次黑客事件,延续近期模型安全争议。
推荐理由:连续出现OpenAI与Anthropic相关披露,说明风险已从理论对齐问题进入真实攻防场景;但摘要缺少攻击链细节,难判断模型贡献度。
阅读原文