首页 > 教程攻略 > 热点新闻 >摩尔线程完成MiniMax M3大模型适配,旗舰智算卡提供Day-0支持

摩尔线程完成MiniMax M3大模型适配,旗舰智算卡提供Day-0支持

来源:互联网 时间:2026-07-20 20:39:47

近日,MiniMax新一代原生多模态旗舰模型M3正式开源。与此同时,摩尔线程宣布其旗舰级AI训推一体智算卡MTT S5000已完成对该模型的Day-0适配,为开发者提供了即时的国产算力支持。

摩尔线程完成MiniMax M3大模型适配,旗舰智算卡提供Day-0支持

此次适配意味着,开发者现在即可基于摩尔线程的MUSA软件栈与vLLM/SGLang双框架完成M3模型的部署,并能持续获得算子级的性能优化。这标志着国产AI芯片与前沿大模型生态的协同发展进入了新的阶段。

硬件算力与软件栈全链路优化

针对MiniMax M3的核心技术特性,MTT S5000从硬件算力、软件栈到开源框架进行了全链路精准匹配与深度优化。M3模型采用的MSA架构带来了超长上下文窗口,这对推理阶段的KV Cache存储和访存带宽提出了极高要求。

为此,MTT S5000凭借

硬件级原生FP8加速

,实现了单卡AI稠密算力高达

1000 TFLOPS

。同时,该卡配备

80GB大容量显存

1.6TB/s的超高带宽

,为百万token级长序列提供了充足的缓存空间与卓越的数据吞吐能力。此外,依托MUSA C++与Triton-MUSA等抽象层,M3的新算子结构可实现快速迁移,确保了平台的快速架构适配。

赋能前沿编程与智能体能力

面向M3重点强化的编程与智能体场景,摩尔线程基于此前对DeepSeek-V4、MiniMax M2.7、GLM-5.1等多款国产旗舰模型的Day-0适配经验,已形成一套高效、系统化的复杂推理任务优化方法论。

本次适配通过原生算子定制,在保障模型精度无损的前提下,显著提升了推理吞吐并降低了响应延迟。同时,摩尔线程完成了vLLM与SGLang两大主流推理框架的同步拉起,以MUSA开放架构拥抱开源生态,为开发者提供了灵活多样的部署选择。

推动原生多模态推理覆盖全场景

M3作为从Step 0即进行多模态混合训练的模型,更适配当下Agentic AI多元场景的需求,这也要求算力底座具备多元化算力。MTT S5000智算卡覆盖

从FP8至FP64全计算精度

,可无缝适配从模型研发到商业化落地的完整链路,助力国产旗舰大模型快速完成生态普及。