AI@NEWS

用程序合成解释注意力

把Transformer注意力头的行为近似成可执行程序,用LLM从注意力矩阵生成符号描述。

推荐理由:可解释性长期想用人可读符号替代黑箱计算,这篇让LLM读注意力矩阵、合成出可执行程序来逼近单个注意力头,把机制可解释性从看热图推进到可运行代码,方向有新意。

阅读原文