Liquid AI开源230M和350M双向编码器,主打8K上下文下CPU推理速度。
推荐理由:350M在17项理解基准中排第4,230M可在CPU约28秒完成8K前向,说明小型编码器仍能靠架构优化服务长文检索、重排等低成本场景。
阅读原文