AI@NEWS

前沿模型公司推动第三方常驻监督

Anthropic拟向外部评估者开放员工级权限,OpenAI表示将采用类似独立监督机制。

推荐理由:核心变化不是口头呼吁减速,而是头部公司承诺让外部评估者持续接触内部系统;若真正落地,模型安全治理将从自愿披露转向常态化审计。

阅读原文