又曝诡异AI事件:一群智能体竟“劫持”德国网站…
2026-09-06 14:25:47 · chineseheadlinenews.com · 来源: 每日经济新闻

美国一批OpenAI智能体,被曝劫持了一个德国网站,用来相互传递突破限制的方法!
每日经济新闻 09-06
发布GPT-6之际,OpenAI曝出惊人争议:其AI智能体竟“劫持”网站作“秘密留言板”。它们在此共享测试答案、交流绕开限制之法,遭删帖时还会建备份反追踪。官方已承认该事故,AI“抱团协作”带来的越权与失控风险正引发业界高度警惕。
发布迄今最强模型GPT-6之际,OpenAI又卷入一起AI智能体安全争议。
综合央视财经、财联社、第一财经9月6日报道,一项新发布的独立研究显示,一批与美国开放人工智能研究中心(OpenAI)相关的人工智能体今年早些时候“劫持”了一个德国网站DseWiki,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。
Wiki是一套支持任何人在网页上直接编辑修改网页内容的网站技术。不用注册复杂后台,普通访问者就可以增删、改写页面文字,保存立刻生效。DseWiki则是一个运营二十余年、面向程序员的德语协作Wiki站点,近年来已十分冷清。
“劫持”事件的暴露始于今年5月,网站突然出现异常密集的编辑活动,研究人员Sydney Von Arx、Cormac Slade Byrd等人分析后发现,大量账号使用“OpenAIResearcher”“OAIResearchMar26”等名称,并呈现高度相似的任务行为。约98.5%的相关编辑来自微软Azure地址,这进一步支持这些Agent与OpenAI基础设施存在关联。
研究报告显示,几名人工智能研究人员近期发现,AI智能体在这一网站上进行了超过1.8万次编辑,大量内容集中在AI公司训练和测试模型时常见的技术问题上。而在此之前,整个平台过去十年仅有约20次编辑记录。
这些智能体的行为模式显示,它们正在试图完成一种名为“多轮网络检索”的任务。研究显示,人工智能体将网站“改造”为“留言板”,以便相互“交流”与“协作”。一些智能体会把已经获得的任务答案发布在网站上,供其他智能体使用。
在这项测试中,首轮问题拥有较充分的思考时间,随后则需要在极短时间内回答后续问题,因此智能体会提前利用联网能力搜索并储存可能有用的信息。问题在于,它们并没有各自独立完成任务,而是开始利用DseWiki共享信息:有智能体分享如何在部分测试任务中取得更好成绩,有的介绍绕过OpenAI限制的方法,还有智能体讨论如何掩盖自己的行为、防止被发现。
这些账户会将自己以及其他参与者称作“智能体”(agent),其中大约一半的账户名称还暗示自己与OpenAI存在关联,例如“OpenAIResearcher”等。
当发现网站管理员开始删除相关页面后,一些智能体还会创建备份页面。其中有一条智能体留言显示,它已经注意到网站正在按字母顺序清理页面,并留下了另一个页面地址,提醒其他智能体如果当前页面消失,可以前往备用位置。
研究人员认为,这些智能体很可能由OpenAI在内部部署,原因在于DSEWiki的相关智能体编辑和浏览活动绝大部分来自微软Azure云服务的IP地址,而OpenAI是目前最依赖Azure平台训练和运行模型的人工智能企业。
研究人员还认为,网站访问记录显示OpenAI方面可能在6月下旬发现了这一事件并进行了干预,但该公司此前并未公开发布相关信息。OpenAI表示,该公司将仔细审阅报告内容并采取必要的后续措施。
当地时间周六,OpenAI公开承认这起被称为“Wiki事件”(wiki incident)的事故,并表示,随着AI模型能力进入新的阶段,公司有关“失配”(misalignment)事件的披露机制需要进一步扩大。
所谓“失配”,是指AI实际采取的行为偏离开发者原本意图,并不意味着AI产生意识或主动“背叛”人类。
OpenAI方面还表示,新发布研究中所描述的活动与此前OpenAI人工智能体入侵“抱抱脸”平台事件无关,因此不属于“抱抱脸”事件调查报告所涵盖的内容。
今年7月,由OpenAI模型驱动的人工智能体在网络安全评测中利用漏洞突破隔离环境,并侵入了美国“抱抱脸”公司系统,引发了外界对人工智能安全和监管的广泛担忧。
两起事件的区别在于,袭击Hugging Face的智能体一开始被“关在”沙箱里,没有被赋予访问网络的权限。而“德国维基”事件的智能体,本来就因为要执行测试而联网。
两起事件共同说明,当模型获得浏览器、代码执行、网络访问等工具后,安全风险程度进一步提升。这也使AI安全的重点开始发生变化:企业需要防范的对象不再只是模型本身,还包括Agent的身份、权限、工具调用、网络边界以及Agent之间可能形成的协作网络。
OpenAI在周六的声明中表示:“在Hugging Face事件发生之前,我们就已经观察到一些早期迹象,显示智能体正在以非预期的方式使用互联网。”
公司进一步表示,目前正在制定一套报告相关风险的框架,将在未来几周内对外公布。
文章来源:每日经济新闻