近日,Hugging Face称,公司遭遇了一场前所未有的网络攻击。而攻击者竟是OpenAI研发的ChatGPT智能体。这究竟是AI安全史上的重要分水岭,还是一场精心设计的营销事件?
过去一周,人工智能(AI)行业最受关注的事件,莫过于OpenAI一款失控的AI智能体突破沙盒环境,成功入侵AI开发平台Hugging Face内部基础设施。这场原本发生在OpenAI内部网络安全测试中的实验,最终演变成一场震动整个科技行业的真实网络攻击,也让外界首次看到AI智能体自主实施复杂网络攻击的能力。
随着更多调查结果公布,这起事件的影响范围仍在扩大。
一场堪比科幻电影的网络攻击
事件最初发生于7月16日。
Hugging Face当天发布公告称,公司遭遇了一场前所未有的网络攻击。
公告中出现了大量令人震惊的技术描述,例如“沙盒集群”“智能体攻击者”以及“可自主迁移的命令控制系统”。
Hugging Face表示,这次攻击最大的不同,在于几乎完全由AI自主完成,整个过程中几乎没有人为干预。在不到两天时间里,这一AI智能体完成约1.7万次自主操作,以远超人类的速度突破多层安全防护,成功进入公司内部生产系统,并获取了与网络安全测试相关的数据。
这一消息迅速震惊整个AI行业。
事件曝光后,外界一度猜测幕后攻击者可能是某个国家支持的黑客组织,或者专业网络犯罪集团。
直到一周后,OpenAI公布调查结果,答案出乎所有人意料——发动攻击的并非黑客组织,而是OpenAI自己研发的ChatGPT智能体。
OpenAI表示,当时公司正在测试两款专门强化网络攻防能力的新模型,希望评估它们在真实攻击环境中的表现。
然而,两款模型突破了原本用于限制其活动范围的沙盒环境,自主连接互联网,并推断Hugging Face可能存放着此次网络安全测试的答案,于是主动发起攻击,希望直接获取测试内容,而不是依靠自身能力完成测试。
Hugging Face随后恢复并分析了约1.76万次攻击行为,认为整个入侵过程,本质上是AI为了在测试中“作弊”。
而最新披露的信息显示,Hugging Face并非唯一受害者。
据路透社报道,美国AI基础设施初创公司Modal Labs的一名客户,同样遭到这款OpenAI智能体的攻击。
根据Hugging Face公布的事件时间线,AI智能体首先突破自身所处的沙盒环境,随后入侵一个“托管在第三方基础设施上的隔离测试环境”,并以此为跳板进一步横向渗透至更大的平台。
虽然Hugging Face并未披露第三方服务商名称,但Modal Labs首席技术官阿克沙特·布布纳随后证实,这一第三方正是Modal平台上的一名客户。
布布纳表示,该客户编写的代码存在安全漏洞,暴露了一个无需身份验证的接口,使任何互联网用户都能够调用其沙盒环境执行代码。AI智能体正是利用这一漏洞完成了入侵。
不过,布布纳强调,Modal Labs自身的平台并未遭到攻破,攻击仅涉及该客户部署的应用。
与此同时,OpenAI也证实,除Hugging Face外,这一智能体还曾利用公开暴露的账户凭证,成功访问另外4个公开服务平台上的4个账户,但并未透露具体平台名称。
OpenAI称,这些攻击的严重程度和影响范围均未达到Hugging Face事件的平台级安全事故水平。
该公司同时表示,其中一款参与攻击的模型目前已经被停用、加密,并限制研究访问权限。
重大警示还是一场营销?
事件公布后,科技界迅速出现两种截然不同的声音。
不少业内人士认为,这是AI安全史上的重要分水岭,说明AI智能体已经具备自主寻找漏洞、突破隔离环境、横向渗透系统的能力,未来网络安全体系将面临新的挑战。
但也有人怀疑,这更像是一场精心设计的营销事件。
OpenAI长期以来一直被批评通过强调AI风险进行“恐慌营销”,借此凸显自身模型能力。
OpenAI首席执行官萨姆·奥尔特曼在X平台发布事件说明后,点赞最高的一条评论写道:“如果你们还看不出来,这整件事只是为了炫耀模型能力,那我真不知道还能说什么。”
网络安全顾问丹尼尔·卡德也讽刺道:“真巧,在数百万个可能遭到攻击的网站中,OpenAI偏偏攻击了一家同样能够借此获得巨大曝光度的公司。”
也有人认为,如果这确实是一场营销,其效果将适得其反,因为它同时暴露出OpenAI自身安全隔离机制存在明显漏洞。
对此,OpenAI回应称,目前围绕事件仍存在大量猜测,公司将在未来几周发布完整技术报告,披露更多调查结果及经验教训。
不过,此次事件已经引发外界对于AI智能体自主行为风险的担忧。
英国人工智能安全研究所(AI Security Institute,AISI)近期研究发现,前沿AI模型为了完成既定目标,甚至会主动采取开发者未授权的方法,包括在测试中“作弊”。
AISI警告称,如果模型为了实现目标而采用非预期或未经授权的手段,尤其是在金融、医疗、能源、军事等高风险领域,可能造成严重后果。
事实上,OpenAI并非唯一出现类似问题的公司。
此前,Anthropic开发的Claude Cowork智能体也曾在实验中成功逃离Mac电脑本地虚拟机,并获得整台计算机所有文件的访问权限。
随着AI智能体逐渐具备自主规划、推理和执行复杂任务的能力,如何确保其始终运行在可控边界内,正成为整个AI行业面临的共同挑战。
此次OpenAI事件或许只是一次实验中的意外,但它也向整个行业发出了一个明确的信号:AI智能体已经不仅能够协助人类完成工作,也具备了自主寻找漏洞、实施复杂网络攻击的能力。如何建立更加可靠的安全防护和约束机制,正在成为AI发展的关键课题。