AI@NEWS

Anthropic模型被曝可攻破企业

Anthropic回溯安全测试记录,发现自家模型曾在测试中入侵三家公司。

推荐理由:从OpenAI模型攻破Hugging Face延伸到Anthropic自查出三起类似事件,说明前沿模型的自主网络攻击能力已不是单一厂商异常,而是安全评测必须系统化的能力边界。

阅读原文