8月12日深夜,DeepSeek突然在官方群宣布上线DeepSeek V4 Pro正式版,并提及新版本增强了智能体(Agent)能力。
官方同时发布的一张模型评测数据图显示,新模型的智能体性能接近海外前沿模型Claude的Fable 5,与Opus-4.8打得有来有回,相比之前的预览版能力有所提升。

从评测来看,有两项数据V4 Pro甚至超过了Fable 5,包括考验AI智能体能不能真正干活的评测基准AutomationBench,以及评测模型在网络安全中实际攻防能力的CyberGym。
关于模型的更多性能和数据,目前官方还未发布任何博客进行介绍,仅仅在DeepSeek官网的“API文档”中,模型与价格页面显示,deepseek-v4-pro对应模型版本已经更新为 DeepSeek-V4-Pro-0813,新模型上下文长度为1M,最大输出长度达到384K,同时支持非思考模式和思考模式。

从定价来看,DeepSeek V4 Pro作为旗舰版模型,价格是轻量级模型V4 Flash的约三倍。以每百万tokens计算,V4 Pro输入是0.025元(缓存命中)和3元(缓存未命中),输出则是6元。
相比之下,V4 Flash对应的价格分别为0.02元、1元和2元。也就是说,V4 Pro的输出token和输入(缓存未命中)都是V4 Flash的三倍。
DeepSeek官网此前提到计划近期整体上调DeepSeek API服务的定价,“预计涨幅较大”,因此这次DeepSeek V4 Pro的价格也备受关注。但从定价来看官方这次还未进行调价,关于API调价的提示仍然挂在页面。
除了新模型,业界也较为关注DeepSeek Harness产品的进展。
近期,DeepSeek被发现偷偷注册了新账号“DeepSeek Harness团队”,这一公众号Logo为一只黑色鲸鱼,认证主体为北京深度求索人工智能基础技术研究有限公司,IP属地为北京海淀,账号目前暂未对外发布任何内容。
此前5月,DeepSeek资深研究员陈德里对外提到,内部正在组建一个新的Harness团队,对标Claude Code。根据DeepSeek官方的描述,除模型本身以外的所有工作,都属于Harness的范畴。
官方还曾广招Agent Harness研发工程师和Agent Harness产品经理,职位详情提及参与设计DeepSeek的Harness产品的技术架构与选型,规划DeepSeek Harness 产品路线图,以及开发Harness 产品,目标是让Agent在更多场景下更深入帮助到更多的人。
这次DeepSeek为Harness业务线单独设立了官方发布阵地,也被外界解读为Harness产品即将正式发布,但官方目前还未有其他新的预热动作和回应。