AI@NEWS

多模态模型自适应选择图文证据

按层、注意力汇聚点和模型规模动态决定是否及如何突出图文证据。

推荐理由:相比固定一次性标注证据,该方法针对任务需求、模型层级和规模差异动态选择文本句子与图像区域,可减少错误强调造成的反作用。

阅读原文