AI@NEWS

模型中层可分辨八类推理动作

研究发现事实提取、分解、演绎和计算等推理动作呈现不同内部表征。

推荐理由:同一词元会因承担不同推理任务呈现不同激活,且信号在中层最清晰;这表明可绕过表面文本,直接监测模型的推理意图与过程。

阅读原文