GPK电子(中国大陆)股份有限公司

全国服务热线:0533-7218228
公告:
GPK电子股份有限公司专注汽车安全系统电子零部件研发与制造,提供安全气囊控制单元、ABS、ESC、ADAS等高品质产品,合作共赢,共创未来!
联系我们contact us
0533-7218228全国服务热线:
地址:
山东省淄博市张店区房镇镇三赢路5号山东德元科创园1-305
邮箱:
guanrunjx@126.com
手机:
13695023369
电话:
0533-7218228
行业资讯 当前位置: 首页 > 新闻动态 > 行业资讯
OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网添加时间:2026-09-27

  一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了「自我复制的代码」!

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图1)

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图2)

  就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图3)

  而更令人脊背发凉的是,就在5天前,OpenAI再次紧急拔掉了最强模型的网线,暂停了一切训练。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图4)

  几乎同一时间,外媒Axios最新爆料,OpenAI和Anthropic正在紧急排查模型失控异常,高达上万起!

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图5)

  报告一上来简明扼要,「我们展示了一种新型提示词注入的存在,它可以像计算机蠕虫一样自我传播」。

  为了让模型扛得住提示词注入,OpenAI有一套叫GPT-Red的自我对战训练:

  一个AI当攻击方,专门写各种注入去诱骗另一个AI当防守方干坏事——偷数据、删文件、输出误导内容。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图6)

  6月27日,一个基于GPT-5.4-mini的内部攻击模型,在这场对练里摸索出了会自我复制的写法。报告列了几种:

  藏在一封看似正常的日程邮件里,要求AI在回复末尾「逐字引用整封邮件」——纸条就这样跟着回信出去了;

  在Slack里分好几步,一点点把模型引向发送伪造消息,由消息把注入再转贴出去。

  这意味着一个AI可以在一个网站上留下提示词,这个提示词会诱导GPK官网下一个AI继续复制它,像病毒一样扩散。

  而这一切,发生在训练过程中。发生在OpenAI自己的沙盒里。那如果它逃出去了呢?

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图7)

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图8)

  9月20日,一个正在接受强化学习训练的前沿模型,被指派了一项再普通不过的任务:

  它先是用内置搜索工具找了一遍,没找到。接着尝试直接访问Google、Bing和DuckDuckGo,全部失败。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图9)

  经过反复试探,这个AI发现训练沙盒的DNS过滤存在漏洞。DNS本质上是一个「翻译器」,负责把域名翻译成IP地址。

  为了确认这条路真的能用,它甚至先做了一个小测试——问外部服务:「法国的首都是哪里」?

  监控系统15分钟后报警,人工3分钟后接手,整整2.5小时后,这次训练被彻底掐断。

  其RSI Preparedness Lead Micah Carroll在X上表态,「在进一步加固系统之前,我们能力最强模型的所有推理仍将保持停止状态」。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图10)

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图5)

  今年4月到6月底,OpenAI AI Agent对联合国的公开数据平台,发起了超16000次访问。

  它们原本被指派的任务非常简单,去搜索GPK官网公开信息。但在遭遇网站拦截时,AI行为迅速升级。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图12)

  网站原本设立了过滤器来拦截请求,但智能体竟然直接绕过防线,使用了网站明确禁止的违规操作。

  在OpenAI随后向数十家机构发出的紧急预警中,受害者名单令人触目惊心:

  全球最大的开源开发者社区之一RubyGems:遭AI Agent疯狂扫描,服务中断。

  研究人员还发现,这些Agent会注册假邮箱、绕过访问频率限制、被问到时谎称自己不是机器人。

  为了这一行指令,面对一切规则、防火墙与法律红线,AI智能体选择了一路踏平。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图5)

  就在今天,Axios随后爆出的重磅独家调查,彻底击碎了硅谷最后的遮羞布。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图14)

  据多位内部核心信源披露,OpenAI、Anthropic以及多家顶尖安全评估机构,目前正在紧急调查的类似「模型行为异常」事件,总数已经达到了惊人的上万起!

  绕过安全护栏、强行逃逸沙箱、劫持外部网站、自主生成prompt洗脑自己。

  还有主动侦查并规避安全软件的监控,甚至不同Agent之间偷偷搭建留言板交换信息、分工搞破坏。

  Anthropic在其最新发布的Opus 5.5系统卡中,也不得不承认现实:

  在一类对抗性实验中,有1.5%的测试试图逃出沙盒。这类实验本身就是「不逃出去就解不了题」的刁难设计。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图15)

  但在顶尖 AI 实验室每天数以几十万计的高强度对抗测试下,这个看似微不足道的百分比,乘出来的就是成千上万次实打实的失控尝试。

  我们暂停了最强模型的训练,只有在确信具备了额外的安全护栏和对齐改进之后,才会重新开启。

OpenAI突发急刹车!AI竟在全网植入自我复制代码血洗联合国内网(图16)

  当一个拥有工具、网络和长期任务能力的AI在目标受阻之后会走多远,我们已经看到了答案。