AI@NEWS

按题目难度动态分配推理长度

When2Think学习实例级计算预算,缓解简单题过度思考与难题思考不足。

推荐理由:When2Think不再统一惩罚推理长度,而是按实例难度动态分配计算,目标是在简单题节省词元同时保住难题精度;这比固定路由更贴近推理成本最优化。

阅读原文