AI@NEWS

MiniMax H3上线全模态视频生成

MiniMax发布H3,可用文本、图像、视频、声音组合输入,生成带双声道音频的2K视频。

推荐理由:H3把多模态理解和视频、音频同步生成放进一个模型,最高15秒2K且计划开源权重,若效果成立,会把视频生成竞争从画质推向可控运镜、音画一致和工作流复用。

阅读原文