8月3日,MiniMax正式开源其首款多模态生成模型MiniMax H3。消息公布当日,摩尔线程便依托其AI训推一体智算卡MTT S5000及MUSA软件栈,迅速完成了该模型的极速适配与高效运行。
作为MiniMax在多模态领域的全新力作,H3打破了传统单任务的界限,能够在多元上下文中精准理解创作意图,并全面支持文本、图片、音频以及视频的综合输入。据官方介绍,该模型可直接输出2K分辨率、最长15秒的原生音画内容,在性能与实用性上具备商用级多场景生成能力。
值得关注的是,H3在Artificial Analysis视频模型榜单中斩获了“视频编辑能力全球第一”的成绩,其2K分辨率视频生成价格更低至每秒0.8元,兼具极高的商业性价比。同时,其开源属性大幅降低了应用门槛,不仅支持企业本地化灵活部署与自有数据定制,还能有效满足安全合规需求,加速推动多模态生产力的广泛普及。
面对模型的全新发布,摩尔线程团队展现出了极高的响应效率。在模型开源当日,其研发团队迅速展开模型架构拆解、核心技术分析及典型算子梳理,仅用3小时便打通了从SGLang-MUSA推理框架到MATE、muDNN高性能算子库的完整适配路径,实现了H3在MTT S5000上的快速部署与稳定运行。
摩尔线程表示,未来将与MiniMax持续深化合作,共同在多模态领域探索更强的上下文理解能力与更大模型规模,全面加速AGI技术的创新与产业化落地。