AI@NEWS

用选择性预测对齐语言模型

论文通过让LLM只回答高置信输入、其余交给人工来降低高风险场景错误率。

推荐理由:选择性预测把可靠性目标从“所有问题都答”改成“知道何时拒答”,更契合高风险系统的人机协作;关键是风险覆盖权衡可训练。

阅读原文