当前位置: 首页 » 资讯 » 科技头条 » 正文

MiniMax发布全模态生成模型H3:支持15秒2K视频,价格不到主流1/3

IP属地 中国·北京 编辑:赵静 凤凰网科技 时间:2026-07-31 14:07:02

7月31日,MiniMax正式发布通用全模态生成模型H3。该模型支持对文本、图像、视频、声音的统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率视频生成。

H3主打商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现突出,可应用于广告、电商、品牌、游戏等商业场景。定价方面,2K分辨率下每秒价格不到主流模型的1/3,768P分辨率下不到1/2。核心技术包括Contextual Omni Representation、H3-VAE及H3-Omni Transformer等,通过理解与生成异构训练架构提升训练吞吐近30%。

MiniMax表示,将在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。此前两代模型(Hailuo 01、02)分别在系统构建与架构效率上完成迭代,H3则进一步实现任务与模态的统一。公司称后续版本将推动与M系列模型能力的融合,并持续提升画面精细度。

标签: 模型 分辨率 模态 架构 开源社区 h3 权重 芯片

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。