• 最近访问:
发表于 2026-08-02 21:50:51 股吧网页版
DeepSeek又发重磅更新,行业梦回2025年春天
来源:21世纪经济报道

  21世纪经济报道记者赵云帆

  7月31日下午,DeepSeek在API文档更新日志里低调地挂出一则通知:V4-Flash正式版(或V4-Flash-0731)上线公测。

  随后,开发者社区出现一个反常的事实——V4-Flash正式版在总参数、激活参数上未在原先V4-Flash预览版基础上进行任何改变,但其代码和智能体能力,竟“突变式”地达到了全球顶尖模型的水平。

  2026年以来,头部开源模型竞争进入“万亿参数时代”。更大的算力集群顺理成章地再次成为模型能力突破的关键。

  但这次,DeepSeek似乎再次打破了这一逻辑惯性——就像2025年春天那样。

DeepSeek时刻又来了?

  自“GPT时刻”以来,“算力即智力”的规模法则(Scaling Law)被硅谷和全球资本市场奉为圭臬。

  直到2024年末DeepSeek V3上线、2025年1月R1发布——前者以不到600万美元训练成本比肩GPT-4o,后者以纯强化学习路径逼近OpenAI o1。“规模法则”第一次遭遇正面质疑,英伟达单日市值蒸发5000亿美元,“DeepSeek时刻”由此得名。

  然而,“DeepSeek时刻”并未终结此后各大模型企业的参数竞赛。

  进入2026年,“规模法则”卷土重来:4月,DeepSeek V4-Pro预览版以1.6万亿的总参数、490亿激活参数开局;7月阿里Qwen 3.8-Max预览版将总参数推到2.4万亿;同月,月之暗面Kimi K3以2.8万亿参数登顶全球开源模型规模之王座。

  “大力出奇迹”重回舞台中央——直到7月31日,DeepSeek V4-Flash-0731正式发布,堆参数的逻辑惯性才被踩下刹车。

  根据DeepSeek官方披露,V4-Flash正式版在九项智能体与代码基准得分上,全部超过自家1.6万亿总参数、490亿激活参数的V4-Pro预览版。

  其中,在九项基准之中的“DeepSWE”基准上,V4-Flash正式版与Pro预览版的分差达到惊人的41.6分;而在“ALE”基准上,V4-Flash正式版甚至与全球顶级的Claude Opus 4.8仅差半分。

  也就是说,V4-Flash正式版仅使用了Pro预览版六分之一的总参数,以及不到四分之一的激活参数,便大幅度完成了对Pro预览版的反超。

  如果只将视角停留在V4-Flash正式版和Pro预览版上,你似乎能轻易地得出一个结论:“规模法则”在这儿失灵了。

  当然,没人会觉得“规模法则”真的失灵。在更新说明中,DeepSeek明确表示,V4-Flash正式版基准测试采用了自研的类似“Codex”的工具——DeepSeek Harness极简模式来跑分。加上此次DeepSeek采用了重做后训练的方式,加大了智能体与工具使用方向的专家训练力度,许多AI工程创新的叠加,才在真正意义上让DeepSeek再次成为算力之外的“X因素”。

AI性价比来到“临界点”

  当然,V4-Flash正式版也并非完美。

  记者注意到,部分海外开发者社区用户指出,V4-Flash正式版的输入缓存命中率偏低、安全分类器常常超时,这在一定程度上反映出,算力和参数储备不足仍将是限制模型能力上限的瓶颈。

  全球资本市场层面,在V4-Flash正式版上线之后,英伟达、博通、AMD等公司7月31日股价也并未出现剧烈波动。市场已经习惯了DeepSeek创新带来的震撼,也并不认为AI工程技术的迭代是算力需求的利空因素。

  “规模法则远未到上限,国内模型规模受限只是算力不足,不是规律走到尽头。”梁文锋此前在一个广为流传的融资会议纪要中提到。但他同时也表示,规模不再是唯一杠杆,思维链和智能体将会是下一个杠杆。

  摩根大通此前也指出,DeepSeek强化了“算力供应扩张、定价纪律、结构性成本曲线压缩”三大支柱,对行业是顺风,而非零和。

  然而,全球追逐顶尖模型的潮流,其实已经在悄然改变。

  近日,根据全球多家媒体报道,部分欧美公司已经开始将中国的大模型嵌入工作流,并利用其完成大部分普通任务。仅在最复杂的任务中,这些公司才会调用Anthropic Claude Fable等顶尖模型。

  以上变化无疑与中国模型使用成本偏低有关。而另一方面,美国模型使用权限的不可控,也让非美地区客户不得不采用备用方案。

  部分券商的评论更值得玩味。

  天风证券计算机缪欣君团队在V4-Flash正式版发布当天,用“大超预期”为之定调,指出其综合能力已接近Opus 4.8、智能体代码能力接近GPT-5.6 Luna,重申看好下半年国产模型链,认为尤其是“成长性30%+、有基本面”的软件公司会率先受益于AI带来的增量需求。

  这一判断反常之处在于,过去市场普遍认为AI模型的持续进步将利空“软件即服务”类企业。而今天,DeepSeek的性价比已经足够令软件公司本身使用并提效,更多因Token账单太贵而不敢使用AI的软件公司能够开发更多高性价比AI互联网服务,过去无法被满足的AI智能体使用需求将变为现实。

“站在整个行业的对立面”

  就在几周前,当Kimi K3冲到2.8万亿参数时,头部玩家普遍相信,即便是中国模型也要遵循“更大=更强”的法则,走“大激活+高知识容量”路线。

  V4-Flash正式版的出现则再次证明,AI发展不只需要大力出奇迹,还得慢工出细活。

  从价格方面来看,此次V4-Flash正式版的输入(缓存未命中)、输入(缓存命中)、输出每百万Token的价格分别为0.14美元、0.0028美元和0.28美元,与“ALE”基准仅半分之差的Claude Opus 4.8相比,三者的价格分别是前者的36倍、179倍和89倍。

  “梁文锋似乎站在了市面上所有模型玩家的对立面。”一位从事AI初创公司孵化的人士告诉记者。DeepSeek系列模型长期稳居性价比之王的宝座,导致其余公司必须至少提供比DeepSeek性能更强的模型。

  类似的观点在V4-Flash正式版发布之后的AI开发者社区中屡见不鲜。

  “梁文锋的DeepSeek成为了一台永不停止的收割机。”一些略激进的观点认为,“所有的AI大模型公司都在梁文锋的前面奔跑,不管用什么方式,他们必须跑到DeepSeek的前面才能生存。”

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500