本地双模型防护不是安全边界
文章质疑用第二个本地LLM做守卫模型,难以可靠阻断提示注入与工具滥用。
推荐理由:核心问题不是多加一个模型,而是把概率分类器误当权限边界;技术任务与攻击载荷高度同形,阈值调节会在误杀和漏判间摇摆,真正边界仍应落在工具权限、沙箱和可审计策略上。
文章质疑用第二个本地LLM做守卫模型,难以可靠阻断提示注入与工具滥用。
推荐理由:核心问题不是多加一个模型,而是把概率分类器误当权限边界;技术任务与攻击载荷高度同形,阈值调节会在误杀和漏判间摇摆,真正边界仍应落在工具权限、沙箱和可审计策略上。