研究从科学家操作轨迹中提取判断结构,以对比干预调控冻结前沿模型的内部计算。
推荐理由:它监督的不是最终答案,而是探索、执行和复核之间的认知切换,并尝试在冻结模型上实现可控转向;这直指长程科学智能体容易一路错到底的问题。
阅读原文