IT之家 8 月 3 日消息,今日,MiniMax 正式开源多模态生成模型 MiniMax H3。同日,摩尔线程基于 AI 训推一体智算卡 MTT S5000 及 MUSA 软件栈,率先完成 H3 的极速适配与高效运行。 IT之家从官方介绍获悉,作为 MiniMax 首款开源多模态生成模型,H3 突破了传统单一任务的边界,能在多模态上下文中统一理解创作意图,支持文本、图片、音频和视频的多元输入,可直出 2K 分辨率、最长 15 秒的原生音画内容。 在生成表现与性价比上,H3 具备商用级多场景内容生成能力,不仅在 Artificial Analysis 视频模型榜单中斩获“视频编辑能力全球第一”,其 2K 分辨率视频生成价格更低至 0.8 元 / 秒,展现出极高的商业性价比。此外,H3 的开源属性显著降低了应用门槛,支持企业本地化灵活部署与自有数据定制,在满足安全合规需求的同时,加速多模态生产力的广泛普及。 MiniMax H3 开源当日,摩尔线程团队迅速完成了模型架构拆解、核心技术分析及典型算子梳理,仅用 3 小时便打通了从 SGLang-MUSA 推理框架到 MATE、muDNN 高性能算子库的完整适配路径,实现了 H3 在 MTT S5000 上的快速部署与稳定运行。 摩尔线程表示,未来将与 MiniMax 持续深化合作,在多模态领域共同探索更强的上下文理解能力与更大模型规模,加速 AGI 技术的创新与产业化落地。 相关阅读: 《通用视频模型 MiniMax H3 正式开源,支持多模态上下文、2K 分辨率》 《MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新》