AI@NEWS

4B编码智能体SWE-bench达61.5%

FrogNano以约1500个自适应合成任务强化学习,在SWE-bench Verified获61.5%。

推荐理由:4B模型在不蒸馏前沿模型的情况下达到61.5%,关键变量是随能力动态生成可学习任务及精简为五种工具;说明课程与接口可显著弥补参数差距。

阅读原文