“计划近期整体上调DeepSeek API(应用程序编程接口)服务的定价,预计涨幅较大”,8月6日,DeepSeek官网的短短一行字让从业者疑惑起来。如同科技股在资本市场的表现一般,大模型价格涨涨跌跌的变化赶不上计划。
回到DeepSeek,这家曾以“价格屠夫”姿态搅动行业的公司,在不到三个月时间内多次调整价格机制。5月,DeepSeek宣布保留DeepSeek V4-Pro 2.5折的优惠价格,6月预告DeepSeek V4正式版上线时间,并对API执行峰谷定价机制。至此,国产AI行业已呈普涨态势,单看智谱,2026年一季度API价格上涨83%。和其他国产大模型相比,DeepSeek的API价格一直在低位,如今它举起了涨价牌是出于何种考虑?业界有诸多猜测。可以肯定的是,在Token价格会不断下降的长周期下,大模型行业和客户也会被短期波动左右。

一则通知
8月6日,北京商报记者发现,DeepSeek官网API开放平台页面上方出现一行蓝色小字,通告了DeepSeek API近期的价格上调计划。不过该通知仅表示,预计涨幅较大,请合理安排使用,具体方案以正式通知为准。
按照DeepSeek规定,公司根据模型输入和输出的总Token数进行计量计费。扣减费用= Token 消耗量×模型单价,对应的费用将直接从充值余额或赠送余额中进行扣减。
目前DeepSeek API仅支持 DeepSeek V4-flash模型,暂不支持DeepSeek V4-pro模型。这两个模型是DeepSeek V4的预览版本,于4月正式上线并同步开源,DeepSeek V4-pro的参数为1.6T,DeepSeek V4-flash的参数为284B。
DeepSeek V4拥有百万字超长上下文,在Agent(智能体)能力、世界知识和推理性能上均实现国内与开源领域的领先。
根据Agentic Coding当时的评测,DeepSeek V4-Pro已达到当时开源模型最佳水平,并在其他Agent相关评测中同样表现优异。4月时,DeepSeek V4已成为DeepSeek内部员工使用的Agentic Coding模型,根据评测反馈使用体验优于Sonnet 4.5,交付质量接近Opus 4.6 非思考模式,但仍与Opus 4.6思考模式存在一定差距。
目前,DeepSeek V4-flash模型的百万Tokens输入(缓存命中)的价格是0.02元,百万Tokens输入(缓存未命中)的价格为1元,百万Tokens输出价格为2元。DeepSeek V4-pro模型的百万Tokens输入(缓存命中)价格是0.025元,百万Tokens输入(缓存未命中)价格为3元,百万Tokens输出价格是6元。
也就是说,参数更小的DeepSeek V4-flash百万Tokens输入(缓存未命中)价格是大参数DeepSeek V4-pro的80%,百万Tokens输入(缓存未命中)和百万Tokens输出价格均是DeepSeek V4-pro的三分之一。
根据通知,DeepSeek V4-Flash正式版 API 已上线公测,Agent能力大幅增强。DeepSeek API将在8月初支持DeepSeek V4-pro模型。
涨多少
如果将这则涨价通知放在DeepSeek的定价史上则显得格外刺眼。DeepSeek出圈后,API价格降时多、涨时少。4月,DeepSeek V4预览版上线后几天,公司就对V4-Pro模型开启2.5折限时特惠,并将原本至5月5日的优惠期延至5月31日。还未到优惠截止日,DeepSeek又宣布V4-Pro模型2.5折价格永久化。
这还没有结束,6月底,DeepSeek预告V4正式版并提出峰谷定价机制,高峰时段为每日9:00-12:00和14:00-18:00,在这一时段调用价格翻番。
如今看来,这正是8月6日涨价通知的苗头。
“这是一个标志,DeepSeek之前的价格太低了”,文渊智库创始人王超向北京商报记者分享了自己的猜测,“这次价格应该会成倍以上地上涨,或者起码跟目前国产大模型价格齐平。”
按照全球AI模型聚合平台OpenRouter数据,本周调用量前十的国产大模型包括DeepSeek V4-flash、Hy3、GLM-5.2、DeepSeek V4-Pro、MiniMax M3。
以同为“大模型六小虎”的模型GLM-5.2、MiniMax M3为例,智谱官网显示,上下文1M Token的GLM-5.2百万Tokens输入单价为8元,百万Tokens输出单价为28元,缓存存储限时免费,缓存命中百万Tokens价格为2元。MiniMax M3 API的价格分多个档次,以上下文512K-1M的版本为例,标准版定价更便宜,这款模型的百万Tokens输入价格为4.2元,输出价格是16.8元,缓存读取价是0.84元。
OpenRouter统计的本周调用量前十的模型里,还有7月底刚刚宣布降价的GPT-5.6 Luna。按照OpenAI的通知,在这次GPT-5.6系列模型降价中,GPT-5.6 Luna价格降幅最大,下调80%。调整后,GPT-5.6 Luna百万Tokens输入价格为0.2美元,输出价格是1.2美元。
在王超看来,DeepSeek这次涨价的起因是之前的“价格黑洞”:“它过于特立独行,用户被高性价比吸引到DeepSeek,运行那些最耗资源的应用,导致用户过多,以至于DeepSeek的推理能力跟不上了。”
多面Token
其实,业界对于DeepSeek的低价早有体会,但这个低调的公司从未公开自己的定价逻辑。
王超站在算力和生态的角度思考这次涨价:“如果DeepSeek算力不够用,用户体验变差,会影响接入DeepSeek API的云厂商的收入,这样不利于生态扩散。要让部署该模型的云厂商获益,模型的使用体验是前提。更何况DeepSeek本身定价不高,为大模型付费的人都是拿它当作生产力工具,对价格并不敏感。”
仅这半年,因调用量影响模型体验的案例不止一起。
7月上旬,Kimi就深夜致歉,称自Kimi K3发布以来,Kimi收获了远超预期的支持,但也面临始料未及的算力挑战。为了保障已有订阅用户的体验,Kimi决定即日起,暂停C端新用户订阅,将已有算力全部投入服务已订阅用户。
长期来看,业内人士从不同角度分享了自己对Token价格走向的判断。
与北京商报记者交流GPT-5.6系列模型降价时,智源研究院院长王仲远认为,“王坚院士希望Token变得像一张纸、一支笔一样廉价,这是有可能的。Token降价基于算力提升、工程和算法优化,以及任务不断分级,简单的任务不再需要复杂的模型。再加上算力芯片的能力提升,价格自然会变得更便宜”。
涂鸦智能联合创始人杨懿从另一个维度给出了判断,他告诉北京商报记者,“Token贵不贵,关键看用得对不对”。
更宏观点看,不论涨跌,围绕Token的讨论不止一面。在Kimi创始人兼CEO杨植麟看来,“生产力会变成Agent,Agent会产生Token,Token在一定程度上等价于GDP”。站在评价体系的角度,百度创始人李彦宏则提出以“日活智能体数”(DAA)作为AI时代的核心度量衡。他认为,Token不一定代表终局,只代表成本,并不代表收益,衡量的是投入而非产出,DAA则大致对应移动互联网时代通用的度量衡日活用户数(DAU)。