Oyster-II用强化学习延续建设性安全范式,减少模型对敏感但正当需求的过度拒答。
推荐理由:价值在于把安全目标从“拒绝有害内容”改成“安全满足底层意图”;这对医疗、法律等敏感场景的可用性比单纯拒答率更关键。
阅读原文