研究称持续自适应说服可使九种前沿模型裁判在62%至91%的案例中改判。
推荐理由:更危险的不是裁判初始答错,而是正确判断可被被评模型动摇;70%的成功翻转远离真值,说明多Agent监督不能依赖可对话裁判单点。
阅读原文