论文通过让LLM只回答高置信输入、其余交给人工来降低高风险场景错误率。
推荐理由:选择性预测把可靠性目标从“所有问题都答”改成“知道何时拒答”,更契合高风险系统的人机协作;关键是风险覆盖权衡可训练。
阅读原文