依据查询相关性为不同检索段落分配不同数量的连续记忆Token。
推荐理由:现有软压缩给每段固定预算,AdaMem则把有限记忆Token倾斜给高相关证据,可同时减少长文处理成本与无关信息干扰,直击RAG预算分配问题。
阅读原文