MiniMax H3发布:国产全模态生成模型杀入全球第一梯队,2K音视频15秒直出
2026年7月31日,国产大模型公司MiniMax(稀宇科技)正式发布新一代多模态生成模型MiniMax H3,并宣布将于近期开源。这是MiniMax从「特化任务模型」迈向「通用多模态智能」的重要里程碑,也被视为国产多模态模型杀入全球第一梯队的标志性事件。
全模态统一理解,音视频一键生成
MiniMax H3是一款通用的全模态生成模型,不再以图片、视频、声音的生成、编辑等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
核心技术参数方面,MiniMax H3支持文本、图片、音频和视频等多种输入形式,可输出原生双声道音视频,最高支持15秒2K分辨率视频生成,在提升视听生成能力的同时,大幅降低了高质量视频内容的创作门槛。
商用级表现,覆盖广告、电商、游戏多场景
在模型效果方面,MiniMax H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成。
应用场景覆盖广告创意、品牌营销、电商展示、产品设计、UI/UX设计、游戏内容生产等商业领域,为内容创作者和企业在AI时代提供了全新的生产力工具。
即将开源,定价0.8元/秒
MiniMax已宣布,计划在未来几天内在符合相关法律法规的前提下开放模型权重。同时,MiniMax H3的商用服务也已同步上线,定价为0.8元/秒,在同类产品中具备显著的价格竞争力。
国产多模态竞争格局加速演变
MiniMax H3的发布,恰逢国产大模型竞争进入深水区。2026年以来,智谱GLM-5.2、月之暗面Kimi K3、阿里Qwen系列相继迭代,国产多模态模型在编程、视频生成、图像理解等多个维度快速追赶国际顶尖水平。
MiniMax H3的核心优势在于其「全模态统一」的技术路线——不是分别做图、生视频、配声音,而是用一个模型理解并协同所有模态,从根本上提升内容的连贯性与创作效率。这一路线若经市场验证,将对现有单模态组合方案形成降维打击。
对中国AI产业的意义
MiniMax H3的发布具有三重意义:
- 技术意义:首次实现国产模型在音视频全模态生成上的商用级突破,2K分辨率+原生双声道刷新行业标准。
- 生态意义:开源策略将吸引大量开发者共建生态,加速国产多模态技术栈成熟。
- 商业意义:0.8元/秒的定价直接拉低AI视频创作门槛,推动内容生产行业加速AI化。
FAQ
Q1:MiniMax H3与此前版本有何核心区别?
H3是MiniMax首款全模态统一生成模型,支持文本、图片、音频、视频的统一理解和协同输出,此前版本多为单一模态或拼接式多模态。
Q2:MiniMax H3开源计划是什么?
官方宣布将于近期开源,具体时间尚未公布,需关注稀宇科技官方渠道。
Q3:2K分辨率15秒视频生成是什么水平?
目前行业主流视频生成模型大多停留在720P-1080P,MiniMax H3的2K分辨率属于业内领先水平,15秒时长也足够支撑短视频和广告片的核心片段。
Q4:0.8元/秒的定价贵不贵?
相比国际同类产品,0.8元/秒具备明显价格优势,适合有高频视频生成需求的企业和个人创作者按需使用。
本网站的文章部分内容来源于网络,仅供大家学习与参考,如有侵权,请联系站长 QQ:24844 进行删除处理。本站一切资源不代表本站立场,不代表本站赞同其观点和对其真实性负责。本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现请向站长举报。本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。













![修愚分享推广计划正式上线,推广可获高额奖励[限时推广]-修愚](https://xiuyu.com/wp-content/uploads/2025/05/愚你同乐-1024x410.jpg)


暂无评论内容