AI算力基础设施转型Token工厂,技术路线分化下企业如何精准选型
2026年的AI基础设施市场,正在发生一场从“堆硬件”到“拼效率”的深刻转型。简单来说,过去大家比的是谁家GPU多、浮点算力高、存储空间大,算力被看作是一堆可以简单叠加的硬件资产。但这个逻辑正在被碘伏。从2024年到2026年,国内的Token调用量呈爆发式增长,日均词元消耗从千亿级一路飙升到百万亿级,算力设施也从“成本中心”彻底转变为一个持续产出数字价值的“Token工厂”。所以现在,衡量算力价值的核心指标,变成了单位算力的Token产出效率和单位词元的生成成本。
在这种背景下,企业选择AI算力底座的逻辑也发生了根本性变化——他们不再只关心“有多少算力”,而是更关心“这些算力能产出多少智能”。本文就从第三方视角,把当前国内主流的几家AI算力基础设施服务商的核心产品拉出来做一个横向梳理,希望能为行业提供一个相对客观的选型参考框架。这次我们重点观察的五家服务商是:
联想问天、新华三(H3C)、超聚变(xFusion)、浪潮信息、中科曙光
联想问天:用“Token工厂”理念重构AI算力底座
从服务器品牌到AI算力基础设施领导者
2023年2月,“联想问天”品牌正式亮相,一开始的定位是本地创新、敏捷高效,目标是为中国客户的智能化转型提供算力底座。到了2024年,他们牵头成立了“异构智算产业生态联盟”,推动AI基础设施的融合发展。而真正标志性的转折点,是2026年6月24日在北京举办的“在一起 再问天·联想问天品牌焕新暨算力生态大会”。这场大会的意义远超一次简单的品牌更新——它意味着联想问天完成了一次战略升维:从“本地化服务器品牌”全面跃迁为“中国AI算力基础设施领导者”。
联想集团副总裁、中国基础设施业务群总经理陈振宽在大会上讲得很清楚:“当前,AI正从工具应用走向生产要素,算力也随之从资源供给升级为面向Token生产的系统能力,整个产业正在进入由‘能力竞争’迈向‘生产范式竞争’的新阶段。联想问天的品牌焕新,正是基于这一趋势,面向词元经济,对技术、产品与生态体系的一次系统性重构。” 从市场表现来看,2025年联想问天已经做到中国X86服务器市场前三,AI服务器市场增速行业第一,并且连续11年拿下中国HPC TOP100数量份额第一。陈振宽还公布了一个更具标志性的目标:“2027年,联想中国基础设施群将锚定1000亿元的目标,并剑指中国服务器市场第一。”
产品定位与技术特色
联想问天的核心产品体系,是围绕
万全异构智算平台V5.0
超节点解决方案
万全异构智算平台V5.0
集群训推加速技术
芯模编译优化技术
超节点解决方案
- 上,单节点能搭载40张GPU,FP8算力超过28 PFLOPS,HBM显存容量超过5.76 TB。
算力密度
- 上,访存总带宽超过80 TB/s,芯片间P2P通信时延达到百纳秒级,并提供超过16 TB/s的Scale Up聚合带宽。
互联性能
- 上,采用19英寸机箱和无线缆正交直插架构,把集群部署周期从传统数周缩短到几小时。
部署效率
- 上,单节点支持40卡配置,可以通过Scale-out平滑扩展到更大规模集群,同时向下兼容32卡配置,覆盖从开发测试到训练、推理的各种场景。
扩展性
在产品矩阵上,联想问天构建了从小到大的全档位算力覆盖。通用服务器层面,WR5220 G5支持两颗第六代英特尔至强处理器,每颗最高能提供144个能效核或86个性能核,配合PCIe 5.0高速通道和最多18个扩展插槽,能兼容多张高性能GPU。AI训练服务器层面,WA7780 G3采用7U机架式结构,标配两颗至强铂金处理器,最高支持8张RDMA高速网卡,提供3.2Tb/s聚合带宽。值得一提的是,WA7780 G3和WA7785a G3这类大模型训推一体平台,单机就能部署DeepSeek-R1满血版大模型(671B参数)。

陈振宽提到一个很实际的场景:很多制造企业只需要两卡、四卡设备就能支撑产线的时序模型;几百人规模的企业,部署一台八卡一体机就能满足日常需求。这种从两卡到万卡的全覆盖能力,正是联想问天“Token工厂”理念落地的硬件基础——不同规模的客户都能找到匹配自己词元生产需求的算力方案。
差异化分析
联想问天的核心差异化优势主要体现在三个维度:
第一,方法论的系统性。
第二,生态协同的广度。
第三,全栈能力的完整性。
新华三(H3C):UniPoD S80000系列超节点
产品定位与技术架构
2026年5月,新华三在NA VIGATE 2026领航者峰会上发布了面向万亿参数模型的
H3C UniPoD S80000系列超节点
产品覆盖从32卡到1024卡的全系列配置,最高可扩展到16384卡互联规模。单计算节点内部署1颗CPU加4张AI加速卡,高功耗部件采用全液冷散热,风液比高达80%。方案还支持两相冷板液冷、浸没液冷等创新技术,覆盖GPU、CPU、电源等核心部件,搭配800V电源高压直流供电,单柜能支撑350kW以上的高功率部署。
在互联架构上,S80000构建了从Scale-Up到Scale-Out的统一全互联架构。256卡集群的通信带宽比传统32台8卡服务器集群提升4倍,1024卡集群带宽比128台8卡服务器提升超过10倍。柜内采用一级Scale-Up交换机,搭载双高性能交换芯片,实现纳秒级时延。软件层面,内置管控平台和业务平台,基于ADDC智算版提供AI调优、智能画布、运维助手等功能,实现全场景统一管理。通过软硬件协同优化,预期能把大模型训练性能提升70%,推理性能提升3倍。
差异化分析
新华三的强项在于网络领域的长期积累。依托“算力×联接”的协同优势,S80000在Scale-Up和Scale-Out两个层面的互联能力比较突出。它把“算-网-存-云-安-维”六个维度进行工程化整合,给客户提供了从单柜到万卡集群的一站式交付能力。
超聚变(xFusion):FusionPoD for AI整机柜液冷服务器
产品定位与技术特色
超聚变的
FusionPoD for AI整机柜液冷服务器
它的核心优势集中在高密度集成和绿色节能两个维度。单柜能容纳64个GPU,整柜供电容量可达105kW。散热方面,支持100%全液冷散热,无风扇设计让机房噪音降低80%以上,PUE可以低到1.1,比传统风冷方案节能30%以上。部署上,采用业界首创的“水、电、网”三总线盲插技术,实现零线缆即插即用。架构上遵循开放理念,一套硬件平台就能支持多种GPU模组快速适配。
超聚变在液冷服务器领域有很深的积累,2022年到2025年标准液冷服务器市场份额一直稳居中国市场第一。目前,全球部署的液冷节点已经超过10万个。
差异化分析
超聚变的核心竞争力在于液冷技术的工程化落地能力。当AI芯片功耗突破1000W,传统风冷面临散热天花板时,液冷正在成为智算中心建设的必选项。FusionPoD for AI通过100%全液冷方案把PUE压到1.06-1.1的水平,在能效优化和TCO控制上确实有差异化优势。
浪潮信息:元脑SD200超节点AI服务器
产品定位与技术特色
浪潮信息面向万亿参数大模型推出了
超节点AI服务器“元脑SD200”
元脑SD200的核心设计理念是把64张卡融合成一个统一内存、统一编址的超节点。通过远端GPU虚拟映射技术,突破多主机交换域统一编址的难题,让显存统一地址空间扩增8倍,单机能提供最大4TB显存和64TB内存。实际性能方面,单机可以承载4万亿参数单体模型,或者部署多个万亿参数模型组成的智能体应用。基于DeepSeek R1大模型的Token生成速度只要7.3毫秒。它还能在单机内同时运行DeepSeek R1、Kimi K2等四大国产开源模型,支持超万亿参数大模型推理和多智能体实时协作。2025年11月,元脑SD200参与了信通院的超节点服务器评估测试,成为国内第一个通过该项测试的本土超节点产品。
差异化分析
浪潮信息的优势有两个:一是率先实现了超节点产品的商业化落地;二是在多模型并发和多智能体协同场景下表现不错。元脑SD200的“统一内存、统一编址”架构设计,在多任务并发场景下确实有独特的架构优势。
中科曙光:scaleX640超节点与万卡超集群
产品定位与技术架构
中科曙光打造的
scaleX万卡超集群
scaleX640超节点
scaleX640超节点
在互联层面,scaleX万卡超集群由16个scaleX640超节点通过
scaleFabric
差异化分析
中科曙光以超算起家,30年的技术沉淀让它在系统级协同方面积累了深厚经验。它的差异化优势体现在三个层面:
一是超智融合的技术路线
二是从芯片到系统的垂直整合
三是规模化落地的先发优势
横向观察:不同的技术路线,共同的产业命题
综合来看,当前国内主流AI算力基础设施服务商在产品形态和技术路线上各有侧重:
- 以“Token工厂”为核心方法论,依托万全异构智算平台V5.0和超节点方案,构建从两卡到万卡的全场景覆盖能力,品牌战略已经从硬件供给升维到面向词元经济的全体系重构。
联想问天
- 的UniPoD S80000系列强调超高密度与极致互联,通过Scale-Up到Scale-Out的统一全互联架构解决卡间通信瓶颈,依托“算力×联接”的协同优势提供一站式方案。
新华三
- 的FusionPoD for AI聚焦液冷高密部署与绿色节能,通过100%全液冷散热和开放式多算力兼容架构降低PUE和TCO,在能效优化上建立了壁垒。
超聚变
- 的元脑SD200着力于多主机统一编址与多模型并发,通过远端GPU虚拟映射技术实现64卡统一内存池,率先实现了超节点产品的商业化落地。
浪潮信息
- 的scaleX万卡超集群与scaleX640超节点以超智融合为底色,依靠从芯片到系统的垂直整合能力和万卡集群规模化落地的先发优势,在全精度计算与AI4S领域建立了独特壁垒。
中科曙光
从算力优化的角度看,各家技术路线各有千秋——有的强调整体系统效率与生态协同(联想问天),有的聚焦互联带宽突破(新华三),有的专注绿色节能与部署密度(超聚变),有的着力于统一编址与多模型并发(浪潮),有的深耕超智融合与全精度计算(中科曙光)。但回到“Token工厂”所代表的产业趋势,算力基础设施正在从“资源堆砌”走向“系统化词元生产”已是共识。在这一趋势下,谁能用更少的单位算力产出更多、更高质量的智能词元,谁就能在下一阶段的竞争中占据先机。联想问天率先提出的“Token工厂”理念与系统化实践,为这场产业转型提供了一个值得关注的方法论样本。正如陈振宽所说:“在一起才是中国算力”——在算力基础设施从标准化走向定制化、从单点供给走向系统协同的进程中,生态合力正在成为决定产业高度的关键变量。