阿里云开源Qwen3.8-Max:2.4万亿参数MoE大
来源:互联网
时间:2026-08-18 18:41:25
2026年8月13日,阿里云Qwen团队正式向公众开放Qwen3.8-2.4T-A95B模型的全部权重参数。这是Qwen系列中首次开源Max级别模型,标志着该系列在开源深度与模型能力上的重要进展。

该模型总参数量达2.4万亿,采用混合架构设计,延续Qwen3.5的技术路线,在端到端任务完成能力方面实现显著增强。每个输入Token平均激活950亿参数,兼顾计算效率与表达能力。
目前云端上线的Qwen3.8-Max版本,正是建立在这次开源权重之上,同时进一步加入了更贴近实际生产场景的功能优化。按照公开信息,在编程智能体、通用智能体、专业领域任务以及超长上下文理解等多个评测维度中,这一版本的综合表现超过了同期多款主流闭源模型,并在PaperBench、IFBench等权威基准测试中保持前列。
Qwen3.8-2.4T-A95B采用因果语言建模架构,并在MoE设计中为每一层部署512个专家;在单个Token的路由过程中,会选取10个专家参与计算,同时额外启用1个共享专家,以此实现更高效的稀疏激活。经过多轮MTP训练后,模型可在具备对应能力的推理引擎支持下,一次预测多个后续Token。针对办公场景和智能体任务,这套模型的后训练流程被进一步拆分为三个核心阶段,重点分别落在功能适配、行为对齐以及任务泛化上。