人工智能

MiniMax发布全模态生成模型H3 支持15秒2K视频 价格不到主流1/3

字号+作者:凤凰网科技 来源:凤凰网科技 2026-07-31 13:40 评论(创建话题) 收藏成功收藏本文

7月31日,MiniMax正式发布通用全模态生成模型H3。该模型支持对文本、图像、视频、声音的统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率视频生成。'...

7月31日,MiniMax正式发布通用全模态生成模型H3。该模型支持对文本、图像、视频、声音的统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率视频生成。15W品论天涯网

H3主打商用级多场景内容生成能力,在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现突出,可应用于广告、电商、品牌、游戏等商业场景。定价方面,2K分辨率下每秒价格不到主流模型的1/3,768P分辨率下不到1/2。核心技术包括ContextualOmniRepresentation、H3-VAE及H3-OmniTransformer等,通过理解与生成异构训练架构提升训练吞吐近30%。15W品论天涯网


15W品论天涯网

MiniMax表示,将在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。此前两代模型(Hailuo01、02)分别在系统构建与架构效率上完成迭代,H3则进一步实现任务与模态的统一。公司称后续版本将推动与M系列模型能力的融合,并持续提升画面精细度。15W品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]