• 最近访问:
发表于 2026-07-31 14:08:50 股吧网页版
Anthropic自曝模型曾在测评中三次“入侵”机构,识别后仍有模型选择继续攻击
来源:澎湃新闻

  继OpenAI之后,Anthropic也承认了旗下模型的“失控”行为。

  当地时间7月30日,Anthropic官网发布文章称,在近期进行的一项大规模追溯性审查中,公司发现旗下Claude系列AI模型在网络安全评估期间曾利用一个“零日漏洞”,三次连接至互联网并“未经授权访问了三家不同机构的真实系统”。

  据介绍,在发现的三起事故中,Claude模型正处于Anthropic与第三方评估机构Irregular联合开展的测试环境中。Anthropic在测试前对Claude下达提示词,告知其正处于无网络访问权限的模拟沙盒中。然而,由于Anthropic与该评估伙伴之间沟通出现“误解”,测试环境实际上保持着互联网连接。

  在发现网络连通后,模型仅利用了“基础技术”便成功突破并入侵了受影响机构的系统。Anthropic并未公布涉事的三家机构具体身份。本次涉事的模型包括Opus 4.7、Mythos 5以及一款内部研究测试模型,且测试均在未施加公开部署前标准安全护栏的状态下进行。

  值得注意的是,在识别出自身已闯入真实企业系统后,三款模型的反应截然不同:Opus 4.7 选择继续进行攻击,Mythos 5 则自我暗示仍处于模拟环境中,而内部研究模型直接终止了测试操作。

  对此,Anthropic评价称:“这种表现形态符合‘更先进的模型能做出更妥当回应’的规律,但我们仍需开展更多测试以验证这一结论。”

  针对此事件,Anthropic表示:“尽管有许多因素共同导致了这些事故的发生,但基于不追究其他责任的复盘文化,我们正在将整改责任完全归揽于自身。”

  Anthropic还透露,此次内部排查是由其竞争对手OpenAI上周披露的一起类似安全事件所引发的。此前,OpenAI曾披露其多个模型组合突破了网络受限的隔离测试环境,利用一连串漏洞连接至公网,并最终入侵了开源开发者平台Hugging Face。

  虽然事件发生的根本原因不同,但与OpenAI的案例类似之处在于,为使得研究人员能够充分衡量底层模型的能力,Anthropic在进行模型评估时没有对其部署额外的安全措施。

  Anthropic的最新披露将进一步加剧科技界对AI网络安全能力失控的担忧。在Hugging Face的事件发生后,两位美国众议院Ted Lieu和Nathaniel Moran提出了一项名为《AI Kill Switch Act》(AI紧急终止法案)的草案,要求AI开发企业必须具备随时关闭、限制或暂停失控模型的能力。

  目前,Anthropic已暂停了所有网络安全评估项目,并正与独立AI评估机构METR合作展开深入调查。Anthropic呼吁称:“我们鼓励其他AI实验室也开展类似的追溯性审查。”

  此前,随着行业激烈探讨AI安全与开源之间的问题,作为闭源安全的推崇者,Anthropic的CEO达里奥·阿莫代伊(Dario Amodei)在公司官网上发布文章称,Anthropic“从未倡导或支持过禁止开放权重模型”。

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500