AI@NEWS

长上下文正从记忆转向临时工作区

作者将模型状态外置到持续维护的文档,并用小模型负责压缩与长期记忆整理。

推荐理由:该实践把上下文窗口降级为单步推理的临时工作区,以外部文档保存状态、9B小模型异步压缩记忆;这比持续堆叠历史更节省显存,也更利于长期任务保持一致性。

阅读原文