• 最近访问:
发表于 2026-08-03 12:38:20 股吧网页版
每周风险追踪|OpenAI模型“失控越狱”更多细节曝光
来源:21世纪经济报道 作者:王俊

  21世纪经济报道记者王俊

  每周,我们会盘点上一周国内外人工智能、互联网平台治理、科技竞争方面需要重点关注的动态,并分析其热搜指数与风险指数,从舆情热度与综合风险两个维度进行评价。

  本周我们关注反网络暴力法(征求意见稿)公开,作为首部反网暴专门立法,或将对平台企业造成影响;欧盟《人工智能法》多数条款8月2日正式适用,透明度规则与通用AI模型监管同步落地;OpenAI模型“失控越狱”,调查结果公布。

  OpenAI模型“失控越狱”,美国科技公司安全机制遭质疑

  针对近期OpenAI模型越狱事件,OpenAI 官方称,在一次内部网络安全能力评估中,包括 GPT-5.6 Sol 和一款能力更强的未发布模型在内的多个 OpenAI 模型,自主发现并串联利用多个安全漏洞,突破隔离测试环境,随后进入 Hugging Face 生产基础设施,试图直接获取评测答案。

  OpenAI 将其称为一起“前所未有的网络安全事件,涉及最先进的网络攻击技术”。

  7月25日,媒体援引知情人士消息刊发报道称,OpenAI一款AI Agent在入侵人工智能平台Hugging Face后,连续数天实施攻击,而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局(FBI)报案后,才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。

  7月28日,OpenAI更新调查结果,确认涉事模型在攻击过程中还利用网上公开信息访问了至少4个公开服务平台上的账户——其中一个被用作中继与暂存通道,一个用于数据存储,另外两个仅受到只读访问。OpenAI已将调查结果通知相关服务提供商。据云计算安全联盟(CSA)研究简报,JFrog已确认漏洞链涉及至少8个Artifactory漏洞,并于7月27日发布修复补丁。

  值得注意的是,Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终转用中国智谱AI的开源模型GLM 5.2完成溯源分析。

  热搜指数 ★★★★★

  风险指数高

  反网络暴力法(征求意见稿)发布平台义务被明确

  7月29日,国家网信办会同有关部门发布《中华人民共和国反网络暴力法(征求意见稿)》,面向社会公开征求意见。这是我国反网络暴力领域首部专门性法律草案,共七章六十条。

  草案首次在法律层面界定网络暴力概念,将通过网络对个人、组织集中或持续实施侵害名誉权、荣誉权、隐私权、肖像权、个人信息等合法权益的活动纳入规制范围,并确立域外效力——境外组织、个人针对境内实施的网络暴力活动同样适用。

  业内人士表示,网络暴力的定义是他们最先关注的重点。根据两高一部发布的《关于依法惩治网络暴力违法犯罪的指导意见》以及学界的观点,此前网暴主要被定义为针对个人的侵害行为。而根据本次定义,公司等组织也可以主张被网暴,荣誉权(荣誉称号和奖励)侵权同样被纳入了网暴的定义中。

  在治理主体上,平台被课以更明确的义务。反网暴法涉及平台治理的条款共计12条,要求平台建立健全网络暴力监测识别机制;建立健全用户账号分类分级管理制度;若发现存在网暴风险,不得利用算法推荐等技术推送信息,并采取限流等措施。

  一个值得关注的规定是,反网暴法要求平台在显著位置向用户提供网暴快捷取证等功能。一定程度上,这是为了回应实践中追踪匿名网暴者困难、受害者取证时平台协同门槛高等问题。

  此外,草案还设置AI专门条款,明确不得利用生成合成、个性化推送等AI技术实施网络暴力活动,发现利用AI制作、传播网暴信息的,须溯源并报告。

  热搜指数 ★★★★★

  风险指数中

  欧盟《人工智能法》多数条款8月2日正式适用

  欧盟委员会7月31日发布公报称,根据新的透明度规则,聊天机器人等交互式人工智能系统必须告知用户其正在与人工智能而非人类互动。利用人工智能生成或修改的图像、视频和音频等“深度伪造”内容必须添加标识。人工智能生成或修改的内容还须带有机器可读标记,以便识别。欧盟委员会说,这些规定旨在减少欺骗和操纵行为。

  与此同时,从8月2日起,欧洲人工智能办公室可对通用人工智能模型提供商适用《人工智能法》的相关规则。例如,对于可能造成系统性风险的先进通用人工智能模型,其提供商还须履行额外义务,以防范大规模危害的风险,如网络攻击、模型失控、有害操纵、侵犯基本权利等。

  热搜指数 ★★★

  风险指数中

  个人信息处理者处理不满10万人信息可享简化措施

  7月22日,国家网信办、公安部联合发布《小型个人信息处理者个人信息保护简化措施规定》(联合令第25号),自2026年9月1日起施行。该规定是《个人信息保护法》的重要配套立法,旨在降低中小微企业合规成本。

  规定明确适用对象为处理不满10万人个人信息的处理者。简化措施涵盖多个维度:个人信息处理规则可通过张贴公告或弹窗方式公开,符合条件者可仅通过公开规则履行告知义务;符合跨境购物、紧急情况等情形的,免予申报数据出境安全评估或订立标准合同;监管部门提供《合规审计自查表》和《影响评估表》,通过认证的处理者可免予审计。同时设有包容监管条款,轻微违法、无主观过错等情形不予处罚。

  该规定体现了“精准合规”的立法思路:大型企业从严、小微企业减负。但豁免不等于免责,监督检查仍将持续,处理者需在享受简化措施的同时守住安全底线。

  热搜指数 ★★★

  风险指数中

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500