AI@NEWS

Anthropic引入外部模型安全审查

Anthropic将让埃森哲深度介入Claude开发测试,双方五年各投入至少10亿美元。

推荐理由:外部团队将直接参与模型评测、红队与对齐检查,而非只做发布后审计;双方各投至少10亿美元,意味着前沿实验室正把安全验证制度化并引入利益相对独立的监督者。

阅读原文