引用人类前沿红队
我们评估了 [内部二进制利用基准](随机选择)中 100 个任务的多个模型,发现 GLM-5.3 在 4% 的试验中开发了完全控制流劫持; Claude Mythos Preview 的比例为 6%。尽管 GLM-5.3 的表现低于 Cla
推荐理由:实践经验可直接借鉴,值得关注
我们评估了 [内部二进制利用基准](随机选择)中 100 个任务的多个模型,发现 GLM-5.3 在 4% 的试验中开发了完全控制流劫持; Claude Mythos Preview 的比例为 6%。尽管 GLM-5.3 的表现低于 Cla
推荐理由:实践经验可直接借鉴,值得关注