AI@NEWS
模型中层可分辨八类推理动作
研究发现事实提取、分解、演绎和计算等推理动作呈现不同内部表征。
推荐理由:
同一词元会因承担不同推理任务呈现不同激活,且信号在中层最清晰;这表明可绕过表面文本,直接监测模型的推理意图与过程。
阅读原文