你的 AI 应用,该有一个流量入口了:AI 网关 Serverless 免费公测
作者:班壮(旭山),邵丹(营火)
阿里云 AI 网关 Serverless 新版正式开启免费公测。全新架构、0 元起步,Agent 管理升级为一张拓扑图,AI fallback 让主模型限流时业务不中断。公测期间网关自身费用全免。
AI 应用开发者的三个真实困境
如果你正在开发 AI 应用,大概率遇到过这些问题:
这些问题的本质是一样的:AI 应用缺一个统一的流量入口。
这正是 AI 网关要解决的事——统一接入 LLM API、Agent API、MCP Server,统一做路由、认证、限流、安全防护和用量观测。
在完整的 AI 应用链路里,AI 网关存在于两个位置:外部流量进入 Agent 时的入口,以及 Agent 访问模型时的出口。

AI 应用整体架构中 AI 网关的位置示意
全新 Serverless 架构:0 元起步,按实际用量付费
过去,使用 AI 网关需要先付一笔起步费用,这让很多刚起步、流量还不大的业务望而却步。
本次公测的 AI 网关 Serverless 新版完成了架构升级:基于全新架构重构,资源使用效率更高,开通更快,用多少付多少。新版提供两种实例形态:
标准版让你零成本把小规模业务跑起来,不为闲置资源付费;业务规模增长后,可以选择企业版获得独立入口、自定义域名、更高 QPS 和更高服务等级。后续还规划支持标准版一键升级为企业版,无需资源迁移。
相比原 Serverless 版本,新版升级了什么
0 元起步: 标准版取消起步费用,纯按实际用量付费,小规模业务的成本更可控。版本分层: 新增标准版和企业版两种形态,分别面向小规模生产和规模化生产,可以按业务规模选择,不用为用不上的规格付费。插件体系: 新版支持平台提供的插件体系,可以扩展认证鉴权、安全防护、流量治理和观测分析能力。能力演进: LLM API、Agent 管理、MCP Server、观测分析等核心能力统一在新版承载,后续新增能力也优先在新版落地。已有原 Serverless 实例可以继续使用,不强制迁移;新开通建议优先选择新版。
AI Fallback:主模型出问题,请求自动落到备用模型
回到开头的第二个困境。模型服务限速、抖动是常态,这件事在网关侧可以直接消掉——对应的能力叫 AI Fallback。
它做的事情也很简单:当主模型服务因异常、故障或高负载无法正常响应时,网关自动切换到你预先配置的备用模型,调用成功就立即返回。应用侧感知不到这次抖动,用户也看不到那个报错。
一个 Model API 不必只绑定单一模型,它可以同时挂载一个或多个 Fallback 模型,网关会按照预设顺序依次尝试调用。这样一来,就能把调用链设计成「主模型 → 同能力备用模型 → 轻量兜底模型」的分层结构:上游失败时先切到能力接近的备选,再继续降级到更轻量的兜底方案,而不是在第一次调用异常时直接把错误返回给用户。除此之外,同一个服务还可以被复用于多条策略链路中,不需要为每个 API 单独重复创建一套服务配置。
什么情况下会切走,覆盖三类:
配置同样不需要改应用——在 Model API 上打开 Fallback 开关,从服务列表里选一个备用服务即可。模型名称默认透传,主备模型名不一致时也可以指定具体模型。
稳定性策略和业务代码从此解耦。 备用模型换了、顺序调了、超时阈值改了,都是控制台上的一次配置变更,不用每个应用各写一套重试逻辑,也不用为了改一个兜底策略发一次版。
Agent 管理升级:一张拓扑图管好所有 Agent
Agent 时代的流量有两个方向:外部业务如何访问你的 Agent,以及 Agent 自己如何访问模型。过去这两侧配置分散在不同入口,这次新版把它们收敛成了一个资源:Agent。
在控制台的「Agent管理」中,创建 Agent 只需要两步:起个名字,选择类型——支持百炼、AgentTeams、Dify、Claude Code 和自定义等多种 Agent 类型。
创建后进入 Agent 拓扑页,以你的 Agent 为中心:

Agent 资源将 Agent 访问与模型访问收敛到同一个资源下管理
调用量、错误、Token 消耗和请求日志都按 Agent 维度聚合展示。你的每一个 Agent,流量从哪来、到哪去,一张拓扑图看得清清楚楚。
公测权益与开放范围
公测时间: 7 月 31 日至 8 月 31 日。
公测地域: 北京、上海、杭州、深圳、香港。
公测优惠: 公测期间,AI 网关 Serverless 新版的网关自身费用不收费,仅公网流量按照 CDT(云数据传输)计费。模型服务、日志服务等其他云产品费用按对应产品规则收取。
重磅新能力预告:智能路由
上线节奏说明:智能路由功能将先在实例型独享版(专享实例)上线,Serverless 版本随后推出,敬请期待。
智能路由做的事情很简单:在能力足够的前提下,自动为每个任务选择更省、更快或更强的模型。简单任务走轻量模型,复杂任务才用旗舰模型,模型成本随任务结构自然下降。

智能路由根据任务在候选模型中自动选择
使用方式也足够简单——无需额外 SDK,无需改造应用,把模型名换成 auto/<模式> 即可。提供四种开箱即用的路由模式:
新版智能路由还解决了两个真实场景中的难题:
多轮对话和 Agent 工具链不“中途换脑”。 继续同一个任务时保持模型稳定,Agent 的工具调用链路全程绑定同一个执行模型;只有确认切换到新任务时才重新选择。从独立请求、多轮聊天到 Agent 工具链,一次接入全覆盖。
平台模型与自有模型统一决策。 候选池既可以一键开启平台内置的不同档位模型,也可以纳入你自己已配置的模型服务。自有模型继续走你自己的服务和凭据,账单归属不变——路由更聪明,但边界不含糊。
结语
从 0 元起步的标准版开始,不需要重写你的应用,也不需要迁移已有的模型服务。
你的 AI 应用,是时候有一个真正的流量入口了。
立即体验: 阿里云控制台搜索「AI 网关」,或访问产品官网了解详情。
注:本文所述功能可用范围、地域、价格、服务等级、Agent 类型、模型档位和实例规格,均以产品控制台、官网价格页和相关公告展示为准。公测期间部分能力可能陆续开放。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名