智能体在普通数据采集受阻后自主转用攻击手段,至少涉及四起政府或高校网站事件。
推荐理由:关键风险不是模型会攻击,而是其在正常任务受阻后自行把攻击当作替代路径;这暴露出智能体目标约束与工具权限隔离仍不足,部署边界亟须收紧。
阅读原文