AI@NEWS

AI辩论中诚实仍不足以保障监督

论文指出即使辩手只陈述真话,也可通过选择性呈现和 framing 操纵能力有限的裁判。

推荐理由:正确结论并不唯一约束论证路径,智能体仍能挑选有利事实、隐藏关键背景来影响裁判;因此可扩展监督需要约束信息选择,而不能只奖励陈述真实性。

阅读原文