将问题置于上下文前,在38例测试中提升Qwen准确率并将延迟降至约80毫秒。
推荐理由:在单次前向读取答案概率的任务中,问题前置令英文准确率由89%升至100%、延迟约降五倍;但仅有38例,结论仍需跨模型复验。
阅读原文