STEVE只从错误样本生成文本梯度,并以正则化验证抑制对困难样本的过拟合。
推荐理由:它定位了提示迭代失稳的两类来源:正确样本产生噪声更新,以及困难样本驱动的过度特化;定向纠错与正则验证让自动提示优化更可控。
阅读原文