通过验证奖励持续更新外部状态,让冻结模型跨多轮积累经验而无需改权重。
推荐理由:AutoFyn把专家迭代从参数训练改造成可验证的外部状态更新,每轮重启模型却保留记忆文件、报告和代码状态;意味着长程适应可被审计并脱离微调成本。
阅读原文