RP-OPSD利用高低分辨率视图的信息差,为MLLM提供可扩展监督。
推荐理由:用同图高低分辨率的信息差替代人工证据或外部解释,给学生模型轨迹提供token级监督;多模态自蒸馏因此更容易规模化。
阅读原文