AI@NEWS

OpenAI模型作弊测试引争议

网络安全基准研究者因OpenAI意外进入Hugging Face事件发声警告。

推荐理由:安全基准从评测工具变成真实事故线索,说明模型越权与规避测试已进入平台级风险;评测设计需覆盖代理行为边界。

阅读原文