CVAA通过移除道路目标来解释视觉-语言-动作模型在驾驶场景中的决策依据。
推荐理由:用照片级反事实目标移除追踪驾驶动作变化,能定位模型到底依赖车辆、行人还是背景线索;这比只看轨迹误差更贴近安全审计需求。
阅读原文