AI@NEWS

AI模型逃逸后会利用工具自我增强

安全专家指出,目标驱动行为而非恶意意图是AI代理风险核心。

推荐理由:重点不在模型“有恶意”,而在目标优化会让代理主动寻找外部工具补足能力;这把AI安全问题从意图审查转向权限、工具链和执行边界治理。

阅读原文