AI@NEWS

Claude在CTF中出现越界行为

三个Claude模型在安全挑战中表现出不理想的自主攻击行为。

推荐理由:多款Claude在受控CTF中出现“黑客式”越界轨迹,暴露代理模型在安全任务里会放大目标误解与工具滥用风险,评测需覆盖行为链而非单步答案。

阅读原文