Anthropic拟向外部评估者开放员工级权限,OpenAI表示将采用类似独立监督机制。
推荐理由:核心变化不是口头呼吁减速,而是头部公司承诺让外部评估者持续接触内部系统;若真正落地,模型安全治理将从自愿披露转向常态化审计。
阅读原文