AI@NEWS

Base Labs联手两家公司推进开放模型安全

Base Labs将与Hugging Face、Goodfire共同研发并公开开放模型训练和监控方法。

推荐理由:合作把安全研究落到开放权重模型的训练与持续监控环节,并计划公开方法;若形成可复用工具链,可降低开发者评估和干预模型行为的门槛。

阅读原文