AI@NEWS
对抗 LLM 训练中的『数据洗白』
语义保留但风格改写的替身数据会让基于记忆的训练数据检测失效。
推荐理由:
揭示语义保留、风格改写的『数据洗白』会让基于记忆信号的训练数据检测失效——版权方事后用原文取证的主流范式被釜底抽薪。
阅读原文