MiniMax发布H3视频模型
MiniMax H3支持统一理解多模态输入并生成2K、最长15秒、带原生立体声的视频。
推荐理由:H3把文本、图像、视频、音频作为统一上下文处理,输出端直接生成带立体声的2K短片,说明视频模型竞争正从画面质量转向音画同步和多模态编排。
MiniMax H3支持统一理解多模态输入并生成2K、最长15秒、带原生立体声的视频。
推荐理由:H3把文本、图像、视频、音频作为统一上下文处理,输出端直接生成带立体声的2K短片,说明视频模型竞争正从画面质量转向音画同步和多模态编排。