发生了什么
2026年7月31日,稀宇科技(MiniMax)正式发布新一代多模态生成模型MiniMax H3,并宣布将在符合法律法规的前提下于近期开源模型权重。H3定位为通用全模态生成模型,不再以图片、视频、声音的单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更自然、更连贯的生成与表达。
核心能力
- 全模态统一理解:同时处理文本、图像、视频与声音输入,在统一上下文中生成多模态输出
- 商用级视频生成:最高支持15秒2K分辨率视频,具备原生双声道音频输出
- 差异化视觉包装:不同于行业主流追求「逼真画面」,H3在视觉包装与后期特效方向建立优势
- 商用成本可控:定价0.8元/秒,处于行业主流水平,适合规模化商业应用
为什么重要
此前,全模态生成模型领域长期由闭源产品主导,开源社区缺乏具备商业竞争力的替代方案。MiniMax H3的开源将首次为开发者和中小企业提供一个可自主部署、可二次开发的全模态生成基座。
对企业的实际价值在于:广告营销团队可以在自有服务器上运行视频生成工作流而无需将素材上传至第三方平台;影视后期团队可以基于开源权重针对特定风格进行精调;电商平台可以实现低成本的商品视频批量生成。不过,开源后的商业授权条款和模型部署的硬件门槛仍需关注。
行业背景
同一天,字节跳动也发布了视频生成模型Seedance 2.5。中国AI企业在多模态生成领域的密集发布,正推动该赛道从「技术demo」加速进入「工业生产」阶段。MiniMax选择开源策略,也将进一步加剧与闭源厂商的竞争格局。

