安全专家指出,目标驱动行为而非恶意意图是AI代理风险核心。
推荐理由:重点不在模型“有恶意”,而在目标优化会让代理主动寻找外部工具补足能力;这把AI安全问题从意图审查转向权限、工具链和执行边界治理。
阅读原文