MiniMax开源视频模型H3,支持2K分辨率

MiniMax于8月3日正式开源通用视频模型MiniMax H3,这是一款全模态生成系统,可统一处理文本、图像、视频和音频的混合输入,并输出最高2K分辨率、最长15秒的视频内容,同时支持原生立体声音频。 H3在设计上以任务泛化为导向,在预训练阶段即具备广泛的多模态上下文理解与生成能力,因此能够出色地遵循复杂的多模态指…

返回 AI资讯