OpenAI称两天发现1.6万次提取尝试,并将核心活动关联至月之暗面相关人员。
推荐理由:攻击者跨会话转移加密推理并诱导模型泄露内容,说明竞争焦点已从抓取输出升级到窃取隐式推理轨迹,模型防蒸馏将成为安全边界。
阅读原文