首页 > 教程攻略 > 热点新闻 >阿里云真武M890超节点首发适配2.8万亿参数Kimi

阿里云真武M890超节点首发适配2.8万亿参数Kimi

来源:互联网 时间:2026-08-02 18:55:06

2026年7月28日,阿里云正式宣布,真武M890超节点实例已实现对Kimi K3模型的首日全面适配——这不仅是国内首个成功运行近三万亿参数规模模型的超节点系统,更意味着国产智算体系在极限规模场景下迈出了关键一步。

Kimi K3的参数量高达2.8万亿,要让这样一个庞然大物高效运转,核心挑战在于:如何将海量参数均匀地分布在数十甚至上百张高速互联的GPU上,同时保证通信不成为瓶颈。传统AI集群受限于带宽天花板,很难同时满足高吞吐、低延迟和高并发的三重需求。

真武超节点正是为破解这类算力困局而生的。它的计算核心——真武M890芯片,采用自研并行计算架构,单颗芯片就配备了144GB显存。而搭载它的磐久AL128超节点服务器,单机柜集成128张加速卡,通过紧密耦合的互联设计,点对点通信时延低于150纳秒,基本消除了跨卡通信的等待时间。

借助ICN Switch 1.0互联芯片,64颗真武M890可以实现800GB/s的双向互联带宽,整个超节点系统的显存总容量达到了9TB。换句话说,单个超节点实例就能支撑起万亿级参数规模的MoE模型规模化部署,不需要再像以前那样拆成多个集群。

为了把Kimi K3的潜力彻底释放出来,阿里云联合平头哥以及Kimi研发团队,在软件栈、核心算子等多个层面展开了深度协同优化。具体来说,真武M890针对K3模型特有的计算结构做了专项算子重构,显著提升了推理过程中的算力利用效率和内存带宽利用率。

实测数据也很能说明问题:完成适配后,模型生成第一个Token的响应时延下降了约35%,单卡解码吞吐量提升了1.8倍,系统可以长期稳定支持百万级长度上下文的复杂应用场景。这意味着,无论是长文档分析还是多轮对话,都能获得更流畅的体验。

此外,千问AI平台与阿里云百炼平台将同步开放Kimi K3的模型API服务,把模型能力与平台生态深度融合,降低开发者的使用门槛。

放眼全球,主流大模型正在加速迈入超两万亿参数的时代。真武超节点不仅成功部署了Kimi K3,还保障了其高效、稳定、可持续的运行表现。这背后释放的信号很明确:国产智能算力已经具备了全面支撑超大规模参数模型实际落地与规模化应用的核心能力。