首页 > 教程攻略 > 热点新闻 >MiniMax M3开源发布,国产GPU完成极速适配

MiniMax M3开源发布,国产GPU完成极速适配

来源:互联网 时间:2026-07-21 20:54:34

近日,MiniMax新一代原生多模态旗舰大模型M3宣布开源。与此同时,国产GPU企业摩尔线程宣布,其旗舰AI训推一体智算卡MTT S5000已完成对该模型的Day-0极速适配。这一进展被视为国产算力与国产大模型协同发展技术实力的又一次展现。

MiniMax M3开源发布,国产GPU完成极速适配

MiniMax M3是国内首款同时具备百万级超长上下文、前沿编程能力与原生多模态特性的开源大模型。它依托自研的MSA稀疏注意力架构,实现了高达1M级别的上下文窗口,并在多项国际权威评测中表现突出。该模型从训练阶段就实现了文本与视觉的深度融合,能够胜任智能体调用、代码开发、长文本处理等复杂任务,对硬件算力、显存带宽及软件适配能力提出了极高要求。

硬件与软件的全链路优化

针对M3模型的特性,摩尔线程从硬件、软件、框架三大维度完成了全链路优化。在硬件层面,MTT S5000搭载了

80GB大容量显存与1.6TB/s的超高带宽

,配合原生FP8加速能力,单卡稠密AI算力可达1000 TFLOPS。这使得它能够充分承载百万Token长序列的缓存与数据吞吐需求,适配超长上下文的运行场景。

在软件生态上,依托MUSA架构与配套工具链,摩尔线程实现了模型新算子的快速迁移,并通过定制原生算子,在不损失精度的前提下有效降低了推理延迟、提升了吞吐效率。此外,该智算卡同步兼容vLLM、SGLang两大主流推理框架,为开发者提供了灵活的部署方案。

推动国产AI生态融合

目前,开发者可以借助官方提供的镜像,基于摩尔线程MUSA软件栈快速部署并体验MiniMax M3。截至目前,摩尔线程已持续完成了多款国产主流大模型的Day-0适配,形成了从模型适配、部署到性能优化的完整体系。这一系列举措旨在持续推动国产AI软硬件生态的深度融合,加速大模型技术的落地与规模化应用。