研究建立开放权重VLM人脸比对解释基准,不再只衡量识别准确率。
推荐理由:法证场景中自然语言理由可读不等于真实,论文把解释有效性从识别分数中单独拆出评测;这能揭示模型是否事后编造看似合理的依据。
阅读原文