AI@NEWS

如何训练长上下文视觉文档模型

首个344K上下文长文档VLM大规模训练研究,覆盖24B/32B模型的预训练到偏好优化。

推荐理由:Qwen3-VL、GLM-4.5V等强模型开权重但训练配方不公开,这篇把长文档VLM从持续预训练到偏好优化全流程做了消融,补上可复现的训练recipe,对自研多模态团队价值高。

阅读原文