山雨欲来。
8月6日,DeepSeek发布公告,宣布计划近期整体上调API服务定价。重要的是这不是DeepSeek近期第一次说要涨价,公告中有几个字值得注意:预计涨幅较大。

(图源:官网截图)
此前DeepSeek一直以其量大管饱的特点在AI界备受欢迎,如今骤然决定升价,引起了业界震动。
隔天,OpenAI宣布免费用户默认模型升级为GPT-5.6 Luna,并开放无限量文本聊天。
具体而言,免费用户进行普通文字聊天时,将不再受到消息数量上限限制,可以持续进行文本对话。
一面是性价比之王DeepSeek官宣提价,另一面则是早已经养出一批订阅制用户的OpenAI免费向用户开放功能。
中美AI巨头,为什么会出现看似方向相反的举动?
DeepSeek也顶不住涨价了?
官宣要涨价前,DeepSeek CEO梁文锋被奉为“梁圣”。
原因之一是,DeepSeek实在太划算了。
去年2月26日,DeepSeek在其API开放平台发布错峰优惠活动通知。北京时间每日00:30~08:30为错峰时段,API调用价格大幅下调,其中DeepSeek-V3降至原价的50%,DeepSeek-R1降至25%。
今年5月22日,DeepSeek宣布V4-Pro模型API价格在5月31日限时2.5折优惠结束后,永久降至原价的1/4(即2.5折价格永久化),降幅高达75%。
调价后,输入(缓存命中)0.025元/百万Tokens、输入(缓存未命中)3元/百万Tokens、输出6元/百万Tokens。
这创下了当时全球顶级大模型的最低价纪录,业内甚至将之称为"通用AI大模型斩杀线":比它便宜的,没它好用;比它贵的,没它量大管饱。

(图源:DeepSeek公告)
但是,6月成为DeepSeek的定价策略的分水岭。
6月底,DeepSeek预告V4正式版上线后将引入峰谷定价机制:平时价格不变,但高峰时段调用价格直接翻倍。

(图源:网络截图)
在高峰时段,DeepSeek V4 Pro百万Tokens输入(缓存命中)将从0.025元上涨到0.05元;百万Tokens输入(缓存未命中)将从3元上涨到6元;百万Tokens输出从6元上涨到12元。
DeepSeek-V4-Flash每百万Tokens输入(缓存命中)平时价格为0.02元,高峰时段将提升至0.04元;百万Tokens输入(缓存未命中)平时1元,高峰时段2元;百万Tokens输出平时2元,高峰时段4元。DeepSeek官方把调价归因于“更合理地配置资源、提升服务稳定性”。

(图源:国联民生证券研究所)
为什么DeepSeek价格会出现先降后增的情况?
人气太高带来的算力成本激增,或许是答案。
高盛在7月研报中认为,DeepSeek实施高峰时段价格调整,不意味着需求走弱,反而反映出国内AI模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战,逐步回归更理性的定价框架。
8月4日,DeepSeek V4 Flash API就曾因“前所未有的访问量”出现容量不足。
从调用数据也能看出DeepSeek人气之旺。开源AI Agent工具OpenCode披露,8月1日单日,DeepSeek V4 Flash在其平台处理8万亿Tokens,其中,5万亿来自免费额度、3万亿来自付费调用。
DeepSeek,真的有点顶不住了。
目前,DeepSeek究竟要涨价多少,暂时未知。
但开机实验室统计中外AI巨头们的单位Tokens调用价格发现,放眼全球,中国厂商的模型在价格上仍然相当具备优势。
一般来说,大模型判断问题、回答问题要花多少钱,与输入、输出的内容“长度”相关。如果输出占比高(如长文/代码生成)则输出价关键;输入占比高(如长文档分析)则输入价关键。
据开机实验室不完全统计,对于国内大模型,以输入价格来看,缓存未命中情况下,价格最贵的是阿里 Qwen3.8-Max,12元/百万 Tokens;最便宜的则是阿里 Qwen3.7-Flash,仅需要0.20 元/百万 Tokens。若缓存命中,最便宜的模型则是DeepSeek-V4-Flash-0731,只需要0.02 元/百万 Tokens。以输出价格比较,最便宜的是阿里 Qwen3.7-Flash,只要0.8元/百万 Tokens;价格最高的则是Kimi刚刚推出的大模型K3,输出价格为100元/百万 Tokens。

(中国厂商大模型API价格,图源:开机实验室)
对于海外的大模型产品,以输入价格来看,缓存未命中情况下,价格最贵的是Anthropic的旗舰模型Claude Fable 5,约需要花费67.47元/百万 Tokens;最便宜的则是OpenAI的GPT-5.6 Luna,仅需要1.35 元/百万 Tokens。以输出价格比较,最贵的依然是Anthropic的Claude Fable 5,约需要花费337.37元/百万 Tokens;最便宜的也是OpenAI的GPT-5.6 Luna,仅需要8.1 元/百万 Tokens。

(海外厂商大模型API价格,图源:开机实验室)
据Artificial Analysis测算,DeepSeek V4 Flash正式版完成单项标准化测试任务的平均成本约0.03美元,仅为Anthropic旗舰模型Claude Fable 5的1/100左右。

(图源:Artificial Analysis)
总的来说,中国AI大模型还是以便宜大碗占据优势。
根据OpenRouter最新数据测算,上周(8月3日至8月9日),平台统计的AI大模型调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Tokens,环比增长570%。
“价格调整发生在DeepSeek-V4-Flash正式版上线、模型调用量快速增长之际。”国联民生研报指出,伴随智能体应用增加,单项任务消耗的Tokens(词元)数量明显高于传统聊天场景,如何在维持价格竞争力的同时覆盖推理资源投入,正在成为大模型厂商共同面对的商业化问题。
AI价值点转变
所以,DeepSeek涨价,OpenAI聊天免费。一升一降,看似方向相反,实则是同一条逻辑的不同侧面。
DeepSeek提价,提的是API的价格。ChatGPT免费,免的是用户纯文本对话消息条数上限。二者面对的是完全不同的场景。
一方面,聊天这种简单的交互功能,正在加速"去溢价化"。当免费模型就足以覆盖多数用户的日常需求时,为"聊天"单独收费的商业基础正在消散。OpenAI此举与其说是慷慨,不如说是顺应技术进步的必然。
另一方面,AI作为"工作搭子"的价值还远未见顶。DeepSeek的峰谷定价方案透露了一个关键信号:价格峰值恰好发生在工作时间内(9:00-12:00、14:00-18:00)。这意味着API的重度用户不是闲聊者,而是将其嵌入工作流的企业开发者和Agent应用。
简单来说,基础交互功能正在贬值,而生产力工具的价值正在凸显。
那么对于AI来说,最有价值的生产力场景究竟在哪?
AI Coding是最先被验证能"卖出价格"的场景。
Anthropic的Claude Code自2025年5月上线后,创下了AI编程市场最快的收入里程碑:2025年11月ARR(年化运行收入)突破10亿美元,2026年2月超过25亿美元,企业客户贡献已超过总收入的50%。同期Anthropic总ARR约140亿美元,并于今年2月完成300亿美元G轮融资,估值达3800亿美元。
而以做“中国的Anthropic”为目标的智谱在今年也给出了类似的观点。
3月底,在业绩报告会上,智谱CEO张鹏表示,公司API调用定价在一季度提升83%,即便如此,市场依然呈现出供不应求的情况,调用量增长400%。
“长期价格的本质是由价值决定的。能有效替代人力、提高转化效率和智能水平的资源是稀缺且宝贵的。”张鹏指出。
当Coding验证了生产力场景的付费意愿,这一逻辑正在向更广泛的桌面办公Agent领域蔓延。
当下,桌面办公Agent,正在成为新的主战场。
比如今年3月上线以来,腾讯WorkBuddy快速崛起。今年第一季度财报中,腾讯称,WorkBuddy以日活跃账户数计已成为中国最受欢迎的AI效率智能体。
5月,腾讯云公告称,CodeBuddy与协同工具WorkBuddy迎来大幅调价,其中面向企业用户的旗舰版涨幅达154%,基础企业专享版涨幅也高达100%。腾讯云旗下AI编程助手CodeBuddy和办公协同产品WorkBuddy相继提高企业版订阅费用。

(图源:网络截图)
据易观分析《2026年Q2中国办公智能体平台市场洞察报告》,6月PC端月访问量达2097万次,位列国内第一。

(图源:易观分析)
字节也不遑多让。6月,豆包在正式官宣,将在免费版基础上提供增值服务。具体看,标准版、加强版、高级版分别都需要收取688元、2048元、5088元包年的价格。如果按月付费,单月价格则分别为68元、200元和500元。7月,字节变动组织架构,进行了ToB业务最大规模组织调整,飞书与豆包产品团队合并。
而近期,开机实验室注意到,字节跳动旗下的TRAE也开始有线下广告投放,据易观分析前述报告,这个AI应用的访问量仅次于Workbuddy。
8月3日,阿里发布新一代旗舰模型Qwen3.8-Max(总参数2.4万亿,激活参数约950亿,1M上下文),并同步推进企业级Agent产品"千问办公"公测。后者由QoderWork、MuleRun、悟空三款产品整合。
中信建投认为,阿里等头部厂商持续扩大模型规模、强化Agent能力,而DeepSeek逐步转向提价,反映国产大模型逐渐进入“能力提升+商业变现”阶段。
AI要成为你的赚钱搭子了,或许DeepSeek涨价只是个起点。