DeepSeek-V4-Flash正式版上线后,OpenAI等头部模型厂商纷纷降价
【快讯】最近,“DeepSeek 一天消耗 8 万亿”这则消息突然冲上了热搜。乍一听,很多人可能会以为这是烧掉了多少钱,其实不然——它说的是 DeepSeek-V4-Flash 模型在海外平台单日处理的 Token 量。关键是,这个数字背后藏着真正炸裂的信息:DeepSeek 仅凭单一模型、单一入口,一天消耗的量,就超过了海外几百款模型加起来的日均总和。

根据每日经济新闻的报道,OpenRouter 最新数据显示,上周(7月27日至8月2日)全球调用量排名中,DeepSeek-V4-Flash 已经升至第一。而全球 AI 大模型总调用量是 56.8 万亿 Token。在这其中,中国 AI 大模型周调用量达到 28.13 万亿 Token,美国这边是 4.38 万亿 Token。中国大模型周调用量已经连续 14 周超过美国,稳居全球首位。
榜单前五名被国产大模型悉数包揽:DeepSeek-V4-Flash 以 7.22 万亿 Token 登顶榜首;小米 MiMo-V2.5 紧随其后,调用量 6.3 万亿 Token;腾讯 HY3 排名第三,4.82 万亿 Token;DeepSeek-V4-Pro、智谱 GLM-5.2 则分列第四和第五,周调用量分别为 3.28 万亿、2.89 万亿 Token。
就在 7 月 31 日,DeepSeek 上线了 V4-Flash 正式版 API,定价相比 V4-Pro 进一步下调。具体来说,缓存命中时每百万 Token 仅需 0.02 元,缓存未命中输入 1 元/百万 Token,输出 2 元/百万 Token。对于这个价格,外网网友频频调侃其为“法拉利性能、脚踏车价格”,倒是颇为贴切。
这背后的逻辑其实很清晰。据科创板日报报道,此前海外巨头长期侧重模型性能的比拼,很少参与低价竞争。但随着 AI 编程商业化市场空间逐渐清晰,整个 AI 赛道迎来了一场大规模调价,海内外头部厂商纷纷下调 API 调用定价。OpenAI 也在 GPT-5.6 发布三周后大幅降价,入门级 Luna 降幅达到 80%,输入单价从 1 美元/百万 Token 降至 0.2 美元;Terra 同步下调 20% 调用费用。Anthropic 的 Claude Opus 5 同样降价,Google 则推出了低价 Gemini Flash 系列模型来应对冲击。
怎么看待这一轮价格战?相关专业人士给出的判断是:AI 编程工具正在从早期的试用产品,转型为普惠型生产力基础设施。调用成本的降低,能够加速中小企业和垂直行业的落地应用。与此同时,行业的评判标准也在转变——市场不再单纯看重基准测试分数或模型参数量,而是聚焦于真实任务的使用成本、运行稳定性、复杂任务完成能力。行业估值逻辑,也开始向实际营收、客户留存等经营指标倾斜。