AI@NEWS

前OpenAI安全负责人质疑对齐测试

David Robinson称对齐测试高分不能证明模型安全,并警告近期失控风险。

推荐理由:核心警示是现有对齐评测缺乏外部效度,分数无法等价为真实环境中的可控性;若引述属实,安全团队对能力加速的担忧已明显升级。

阅读原文