基准以四类受控任务比较PLM、LLM和智能体在单突变生成与多突变排序上的表现。
推荐理由:它把蛋白改造评测落到单突变生成、多突变排序等实验决策界面,可直接比较专用蛋白模型与通用智能体;价值在于缩小计算指标和湿实验选择之间的鸿沟。
阅读原文