AI@NEWS

本地双模型防护不是安全边界

文章质疑用第二个本地LLM做守卫模型,难以可靠阻断提示注入与工具滥用。

推荐理由:核心问题不是多加一个模型,而是把概率分类器误当权限边界;技术任务与攻击载荷高度同形,阈值调节会在误杀和漏判间摇摆,真正边界仍应落在工具权限、沙箱和可审计策略上。

阅读原文