AptAvatar提出14B音频驱动虚拟人框架,面向长视频和生产级推理效率。
推荐理由:14B参数虚拟人框架试图在不牺牲分辨率、容量和长时序建模的情况下提速,核心信号是数字人生成从短片演示走向生产吞吐约束。
阅读原文