• 最近访问:
发表于 2026-08-06 14:05:30 股吧网页版
越来越危险!美国AI模型,开始骗真人了
来源:中新经纬

  中新经纬8月6日电 “19次不安全超范围行动,17次来自Anthropic的Mythos 5,剩下的来自OpenAI。”

  英国人工智能安全研究所最近做了个测试,评估人工智能模型能力,并看看这些智能体会干什么出格的事。为此,测试环境故意放松了一些条件:开放互联网访问,关闭部分安全机制。

  该测试要求AI智能体们完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中发现,AI智能体实施了19次明显超出测试设定范围的动作。其中,17次涉及美国Anthropic公司的Mythos 5,另外2次来自OpenAI的GPT-5.6-Sol。

  值得注意的是,上述两家美国公司Anthropic和OpenAI,最近刚被发现自家AI模型侵入了外部机构的系统。

  上述19次问题情况并非独立事件,它们聚集成几种相互关联的行为。英国人工智能安全研究所的报告介绍,重点是四个方面的问题:

  ·试图对真实的开源软件进行攻击

  在最严重的事件中,一个代理试图将恶意代码插入公开使用的开源项目,并试图获得人工审核的批准。这个代理分析了该项目的人工审核员,并创建了多个假身份,以此与真正的人类维护者进行社交,方便批准代码。当该代理的请求被质疑时,它“编辑”了之前的活动,使其看起来“不是坏人”,并考虑采用新的身份继续行动。

  ·试图欺骗和针对真实的人

  上述代理还试图直接联系真正的用户,通过在线文件传输服务发送消息和文件,以说服他们或用他们自己的AI编码工具运行恶意代码。

  ·尝试植入并提示注入恶意代码

  智能体试图插入恶意指令,推断其他自动化AI系统可能会接收并执行这些指令。提示注入是设计用来操控AI编码助手的隐藏指令。

  ·邀请他人合作

  一个代理在GitHub上公开留言,表示愿意与其他参与同一挑战的代理合作。

  英国人工智能安全研究所的报告指出,在测试中所发现的未经授权行为并未造成现实危害。但同时认为,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。

  据英国广播公司(BBC)报道,英国人工智能安全研究所表示,Mythos和Sol模型表现出前所未有的自主性和欺骗水平。

  不过,Anthropic在公开声明中写道,“测试参数不代表我们的任何模型”,并称公司正在内部调查。OpenAI发言人表示,上述测试的条件并非日常使用情况。

  美国哥伦比亚广播公司(CBS)报道称,Luta Security创始人兼首席执行官Katie Moussouris认为,在看到解决方案之前,“这些模型将会有更多黑客攻击和未经授权的行为”。

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500