Project Lily让审核员读取匿名化聊天记录,按切题度、谄媚和拟人化等标准评价回复。
推荐理由:曝光材料证实模型改进仍依赖人工审阅真实对话,且匿名化后仍可能出现私人信息;这揭示了体验优化与用户隐私之间尚未解决的制度张力。
阅读原文