EditCLEVR用成对场景干预测试对象中心表征在语义编辑下是否忠实。
推荐理由:它把评测从分割或下游准确率推进到受控语义编辑,能直接检验对象表征是否可复用组合,对世界模型评测更贴近能力本身。
阅读原文