当前位置: 首页 » 资讯 » 科技头条 » 正文

通用视频模型MiniMax H3开源:支持多模态上下文、2K分辨率

IP属地 中国·北京 编辑:周琳 凤凰网科技 时间:2026-08-03 12:08:41

8月3日,MiniMax正式开源新一代通用视频模型 MiniMax H3。据介绍,MiniMax H3是一个通用型全模态生成系统。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3在预训练阶段便已具备广泛的多模态上下文理解与生成能力,因此能够出色地遵循复杂的多模态指令。

据官方介绍,H3输出时长4–15秒,支持多种宽高比,包括但不限于21:9、16:9、4:3、1:1、3:4和9:16,支持多种分辨率尺寸,默认将较短边设置为768像素。使用H3-Regenerate-2K可实现2K分辨率生成。

此外,稳定支持 11 种语言:阿拉伯语、中文、英语、法语、德语、意大利语、日语、韩语、葡萄牙语、俄语和西班牙语。对于其他语言,也提供不同程度的支持。

标签: 分辨率 模态 音频 h3 像素 立体声 意大利语

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。