Anthropic拟向第三方评估者开放近似员工权限,推动头部实验室共同建立安全监督机制。
推荐理由:关键承诺是让外部评估者获得近似员工级访问并独立报告,这将模型安全从企业自证推向可审计监督,但成效取决于同行响应及权限边界。
阅读原文