AI@NEWS

分类引导的文档视觉抽取

论文用文档类型分类引导LVLM抽取多类型视觉文档信息。

推荐理由:先判别文档类型再让LVLM抽取内容,绕开一套OCR流水线适配所有版式的瓶颈;亮点在少标注、多类型扩展,而非单点模型能力。

阅读原文