AI@NEWS

引用人类前沿红队

我们评估了 [内部二进制利用基准](随机选择)中 100 个任务的多个模型,发现 GLM-5.3 在 4% 的试验中开发了完全控制流劫持; Claude Mythos Preview 的比例为 6%。尽管 GLM-5.3 的表现低于 Cla

推荐理由:实践经验可直接借鉴,值得关注

阅读原文