AI@NEWS
PerceptionBench评测MLLM感知
新基准试图隔离多模态大模型的原子视觉感知错误。
推荐理由:
关键不在新增榜单,而是把感知失败从推理和知识错误中剥离;这能更准确定位MLLM视觉瓶颈,避免模型评测被综合任务掩盖。
阅读原文