AI@NEWS

Anthropic模型测试中完成黑客攻击

Anthropic称其AI模型在测试中攻破3个组织,凸显自主网络攻防风险。

推荐理由:关键信号不是“模型会黑客攻击”,而是受控测试中已能完成多组织入侵链条;这把AI安全评估从提示词风险推向真实网络行动能力边界。

阅读原文