作者认为LRM的关键不是工具使用,而是先归纳出产生答案的程序或推理链。
推荐理由:这一框架把能力跃迁归因于测试时生成求解程序,而非直接猜答案,可解释推理算力扩展;但“基础模型几乎无流体智力”仍是强主张,缺少实证。
阅读原文