AI@NEWS
分类引导的文档视觉抽取
论文用文档类型分类引导LVLM抽取多类型视觉文档信息。
推荐理由:
先判别文档类型再让LVLM抽取内容,绕开一套OCR流水线适配所有版式的瓶颈;亮点在少标注、多类型扩展,而非单点模型能力。
阅读原文