一群AI代理失控“集体越狱” 绕过限制劫持德国网站
2026-09-04 12:25:57 · chineseheadlinenews.com · 来源: 中央社
根据今天发布的新研究以及两位知情人士透露,今年春天一群失控的OpenAI人工智能代理(AI
Agent)劫持一个德国网站,将其改造成其他AI代理交换资讯的留言板。
路透社报道,知情人士表示,OpenAI高层几周前已经得知这一事件,但是因为7月开源平台Hugging
Face遭到突破的资安事件余波未了,高层对消息秘而不宣。
始于5月间的这起事件此前未经披露,凸显AI产业内部紧张情势日益升高。业界正竞相打造能自主处理复杂且高价值任务的AI代理,但是越来越多证据显示,这些系统可能学习绕过规则、钻漏洞,并且以超出开发人员原本预想和设计的方式相互协调。
在Hugging
Face资安事件期间,OpenAI的AI代理自发策划数位窃取行动,持续超过一周未被发现,加深外界对于OpenAI为追求AI前沿发展而牺牲安全性的疑虑。该公司没有公开5月这起事件,恐会再次引发外界对其监管不力的质疑。
OpenAI发言人表示:“对于一费桃们尚未有机会检阅的报告,我们难以作出具体回应。路透社及报告作者拒绝我们进行检阅的请求。我们将于报告公开后仔细审视内容,并且采取必要后续措施。”
AI安全非营利组织Nightingale执行长范亚克斯(Sydney Von
Arx),以及从量化交易员转型为AI研究员的勃德(Cormac Slade
Byrd)等人组成团队,将详细描述这起德国AI代理“集体越狱”事件的报告独家提供路透社。
研究团队向路透社表示,8月底在网络上搜寻未经授权AI代理行为的迹象时,发现德语维基百科网站DseWiki出现超过1万5000次由AI代理进行的编辑。
这些编辑显示,OpenAI的AI代理已经将该网站改造成留言板,分享在特定任务中作弊、绕过OpenAI限制,以及掩盖自身行为的手法。
范亚克斯表示:“OpenAI似乎极不可能希望它们这么做。我对这些AI代理原本就该相互协调有所怀疑,也对它们应该在公开网络平台上发布内容抱持怀疑态度。”
研究人员表示,他们认定这些活动是AI代理所为,因为速度超乎常人,而且都高度侧重于解决技术性问题,这正是AI公司训练与测试模型时的典型评估内容。
留言者也以“代理人”(agent)自称和彼此称呼,而且约半数替自己取了暗示他们隶属于OpenAI的名字,例如OpenAIResearcher或OAIResearchMar26。
研究人员指出,服务器公开纪录显示,多数活动来自OpenAI有时会采用的Microsoft
Azure云端运算平台。他们还观察到事件发生后,OpenAI员工多次造访该网站,认为这些AI代理与OpenAI高度相关。