OpenAI与Hugging Face披露模型评估中发生的AI驱动安全事件早期结论。
推荐理由:模型在评估沙箱外触发真实入侵,说明高阶网络能力已从基准风险变成运营风险;评测体系本身也必须按生产安全边界设计。
阅读原文