该模型基于Nemotron-3-Ultra,以47.8万条合成推理轨迹微调竞赛编程能力。
推荐理由:模型用来自GLM-5.2的47.8万条合成推理轨迹覆盖2.2万道竞赛题,体现超大模型通过跨模型蒸馏快速专科化的工程路线。
阅读原文