dattri-LLM用紧凑梯度表示和成本模型调度,扩展大模型训练数据归因。
推荐理由:该库直击逐样本梯度在大模型上的存储与计算瓶颈,并兼顾框架适配和扩展性;它可让数据清洗、版权追踪与行为溯源更可操作。
阅读原文