AI@NEWS

医学VLM模型编辑评测

M3Bench评估医学视觉语言模型编辑在临床变化下的可靠性和泛化。

推荐理由:模型编辑在医学VLM里不能只看单点纠错,还要跨图像、文本、模态和协议变化保持精确;M3Bench把后部署修正拉回临床约束。

阅读原文