AI@NEWS
多模态模型自适应选择图文证据
按层、注意力汇聚点和模型规模动态决定是否及如何突出图文证据。
推荐理由:
相比固定一次性标注证据,该方法针对任务需求、模型层级和规模差异动态选择文本句子与图像区域,可减少错误强调造成的反作用。
阅读原文