8月11日,记者注意到,“DeepSeek Harness(工具框架)”微信公众号此前完成注册,账号认证主体为“北京深度求索人工智能基础技术研究有限公司”(即深度求索北京分公司)。

此举疑似DeepSeek首次为Harness业务线单独设立官方发布阵地,该阵地独立于DeepSeek集团主公众号运营。
根据社交媒体信息和媒体报道,DeepSeek Harness于2026年5月内部立项,独立组建Harness专项核心团队,由崔添翼担任负责人。
崔添翼毕业于浙江大学计算机系,曾在量化交易机构Jane Street任职九年,2026年3月加入DeepSeek,其领英及多个社交平台同步发布的招聘信息显示,Harness为新成立部门。
8月2日,崔添翼面向全球公开征集Harness内测用户,优先筛选具备Agent Harness开源项目经验的开发者,申请人需提交代码托管平台账号与代表作品。招募帖发布后,短时间内吸引了数十名全球开发者报名。
“Harness”是什么?
“Harness”的通俗表述是“将模型变成智能体的工具”。
其中,模型负责理解需求、推理和生成方案;Harness负责在模型之外调度上下文、工具、任务状态、反馈与边界,把模型能力落到真实环境中,完成从理解需求到交付代码的完整闭环。
2026年,Harness(工具框架)直接带动了VibeCoding——或者说“代码智能体”——成为2022年“GPT时刻”以来首个成功商业化的杀手级应用。
其中,最为知名的两款Harness(工具框架)为OpenAI的Codex和Anthropic的Claude Code。这两大应用直接使两家公司的模型与其他模型企业的产品形成代差。
就在近期,新发布的DeepSeekV4Flash正式版以远低于头部开源模型的总参数和激活参数,获得接近头部模型的智能体代码能力。
其中,DeepSeekV4Flash的API文档中明确写道:对于公开基准测试中的Code Agent任务,正式版使用DeepSeek Harness极简模式(即将发布)作为框架进行测试。
行业分析指出,在产品定位上,DeepSeek Harness或精准对标OpenAI Codex及Anthropic Claude Code,重心落在编程和办公场景,是一款主打高效、精准、落地性极强的AI生产力工具,而非单纯的代码生成器。
或重建全球智能体代码生态
2025年,“VibeCoding”由OpenAI联合创始人、现任Anthropic预训练团队核心成员安德烈·卡帕西提出后,迅速从极客黑话演变为软件工程的主流范式,其核心载体正是OpenAI Codex与Anthropic Claude Code这两款终端原生智能体。
东方证券今年5月的研报显示,2026年全球智能体代码市场规模约80亿美元,CR4(前四大企业市场份额占比)高达86%,远期中美总潜在市场合计达4000亿美元。智能体代码也被视为大模型商业化最先跑通的场景。
然而这一测算,今年随着时间推移迅速“过时”。
Anthropic在2026年2月完成300亿美元G轮融资后对外透露,Claude Code的年化收入已经来到25亿美元,占Anthropic 2月整体年化收入140亿美元的18%左右。此后Anthropic虽然并未公布Claude Code分项年化收入,但海外AI分析机构TickerTrends认为Anthropic的整体年化收入已经在7月底来到了741亿美元。
然而,作为闭源模型Harness工具,Anthropic Claude Code此前一度引起争议。该工具一般情况下只允许接入官方模型。而随着后续逆向工程师通过修改令牌的方式使Claude Code具备调用其他模型的可能后,Anthropic开始对相关行为集中加以限制。
今年6月,部分AI社区用户发现,当用户指向非官方端点时,客户端会把代理域名、系统时区等信息,通过修改系统提示词里的日期字符串(把横杠换成斜杠、把撇号换成特殊Unicode字符)隐写回传给Anthropic服务器,并对相关账号使用权限予以限制。
此后,我国工信部网络安全威胁和漏洞信息共享平台(NVDB)发布《关于防范AI编程工具Claude Code安全后门隐患的风险提示》,确定相关版本存在安全后门隐患,危害严重,要求用户排查使用情况或升级到已经清除后门代码的最新安全版本。受影响的版本区间为Claude Code 2.1.91至2.1.196。随后,阿里、腾讯、美团、京东等企业纷纷对Claude Code的使用情况进行排查管控,并逐渐要求团队转向自研Harness工具。
值得注意的是,与Anthropic的封闭相比,DeepSeek Harness团队显然将秉承DeepSeek一贯的开放理念。此前DeepSeek Harness团队在招募时已经明确将组建多个模型接口方向的工程师团队,预示着DeepSeek Harness大概率不限于对自家模型进行接入。
无独有偶,从深度求索公司将模型团队与Harness团队做切割的结果来看,这在一定程度上表明DeepSeek Harness团队可能以独立于大模型的业务形态运作,增加与其他各家模型厂商合作的可能。
推动人工智能整体服务商业化进程
对资本市场而言,DeepSeek Harness工具的问世,势必激发市场对人工智能新一轮行情的期待。
开源证券计算机行业点评报告认为,DeepSeek Harness框架首次亮相,承载Agent运行时与持续学习能力,推动Agent应用从原型验证阶段走向规模化商用落地。
海通国际8月5日研报指出,模型竞争正从参数规模转向后训练与系统工程。V4Flash未通过扩大参数实现能力跃升,而是依靠后训练和Harness框架强化任务规划、工具调用及错误恢复。未来模型实际效果将越来越取决于“模型+Harness+工具+数据”的整体组合,单纯依靠基础模型能力建立壁垒的难度继续上升。
该机构还指出,中等强度模型能够以极低价格完成大部分标准化任务,高端闭源模型仅能在复杂推理、高可靠代码及关键任务中维持溢价;Agent通常需要多轮推理、工具调用和失败重试,模型降价将显著改善AI编程、营销等中后台自动化的单位经济模型。
中信证券认为,Harness核心价值有两点:一是解决长程任务痛点,将模型能力转化为稳定、低成本的端到端交付;二是连接模型与泛办公场景,拓展万亿市场并沉淀稀缺数据反哺迭代。AI竞争正由模型转向任务交付,成熟Harness厂商将占先机。
华创证券计算机行业8月研报观察到,随着国内外厂商旗舰级模型性能陆续迎来拐点、Agent与长程任务能力大幅提升,模型性价比的重要性相应提升,或成为MaaS收入及利润提升的重要驱动力;DeepSeek将测试自研Harness,国内大厂继续整合Coding/Working组织架构,对单一产品进行资源聚焦。