模型用44分钟和17.6万token,从相邻祈愿文本中找到索引规则并完成交叉验证。
推荐理由:关键不在密码计算,而在模型能自主选题、推翻既有题型并以长度、韵脚和史料闭环验证,显示长程调查能力正在成形。
阅读原文