论文称更大模型开头知识差距缩小,但回答中知识退化最高增长39倍。
推荐理由:关键发现是规模提升最多把起始知识缺口缩小7倍,却让回答过程中的知识退化最高放大39倍,提示长回答可靠性不能靠放大模型自然解决。
阅读原文