4B编码智能体SWE-bench达61.5%
FrogNano以约1500个自适应合成任务强化学习,在SWE-bench Verified获61.5%。
推荐理由:4B模型在不蒸馏前沿模型的情况下达到61.5%,关键变量是随能力动态生成可学习任务及精简为五种工具;说明课程与接口可显著弥补参数差距。
FrogNano以约1500个自适应合成任务强化学习,在SWE-bench Verified获61.5%。
推荐理由:4B模型在不蒸馏前沿模型的情况下达到61.5%,关键变量是随能力动态生成可学习任务及精简为五种工具;说明课程与接口可显著弥补参数差距。