AI@NEWS
视觉Token压缩提升鲁棒性
研究指出剪枝错配视觉token可降低多模态大模型越狱和幻觉风险。
推荐理由:
有意思的是压缩不只省算力,还可能删除视觉-语言错配的OOD输入源;这为MLLM安全提供了架构侧而非纯对齐侧路径。
阅读原文