AI@NEWS

SeeMe降低多模态幻觉

SeeMe通过训练-free视觉token工程减少LVLM由噪声视觉token引发的幻觉。

推荐理由:它把幻觉源头前移到视觉token选择,而非只调解码;若训练-free有效,说明多模态可靠性可通过输入表示清洗获得低成本增益。

阅读原文