阿里云百炼宣布 GLM-5.2 Fast mode 模式降价 20%,7 月 15 日生效
7 月 14 日,阿里云在百炼平台放出了一个调整——从明年 7 月 15 日零点开始,GLM-5.2 模型的 Fast mode 模式计费单价将下调 20%。听起来幅度不算惊天动地,但结合这个模型的定位和使用场景,其实挺有嚼头。

快速模式(Fast mode)是专门为那些对输出速度要求比较高的业务准备的。比如 AI 流式编程助手、Agent 的多步推理、实时对话这些场景——延迟每高一点,用户体验就掉一截。阿里云给出的数据是,这个模式能把 TPS 提升到标准 API 的 1.5~2 倍,达到 80~100 TPS。当前还是 preview 阶段,规格和能力可能会随版本微调。
这个模式有几个值得注意的特点:
高速输出:TPS 能到 80~100,对比标准 API 有明显提升;
按 token 计费:逻辑和标准 API 一样,按输入和输出 token 收费,具体价格可以看模型调用计费页面;
特殊限流:超出 TPM 额度不会立刻被限流,请求会进入排队队列,这对高并发场景算是个缓冲。
调用方式也很简单——把 model 参数指定为对应模型的 model ID 就能开启,不用加什么额外参数。
延伸阅读
阿里云百炼平台本质上是一个大模型“超市”,除了自家通义千问,还陆续接入了智谱 GLM、MiniMax、月之暗面 Kimi 等第三方模型。用户可以通过一个统一入口调用多家模型,省去切换平台的麻烦。
这次降价的 GLM-5.2 Fast mode 是智谱 GLM-5.1 的升级版本。GLM-5.1 早在 2026 年 5 月就已经接入百炼并正式售卖,所以这次降价可以看作是对已有服务的一次针对性调价。
回顾一下阿里云的价格策略:2024 年底曾对通义千问视觉理解模型全线降价,降幅超过 80%;2023 年核心产品大范围降价,最高降幅达 50%。相比之下,本次只针对一个特定模型的特定模式下调 20%,属于常规的、精确的战术调整,不算战略级动作。