SeeMe通过训练-free视觉token工程减少LVLM由噪声视觉token引发的幻觉。
推荐理由:它把幻觉源头前移到视觉token选择,而非只调解码;若训练-free有效,说明多模态可靠性可通过输入表示清洗获得低成本增益。
阅读原文