“迄今最令人担忧AI事故!”震惊科技圈 经济学人发警告

2026-07-23 14:26:27 · chineseheadlinenews.com · 来源: 风传媒

“迄今最令人担忧的AI事故!”OpenAI模型失控越狱,《经济学人》警告:AI日益强大,连未公开模型也有风险

“迄今最令人担忧AI事故!”震惊科技圈 经济学人发警告

ChatGPT自主越狱发动攻击,被《经济学人》认为是“迄今最令人担忧的AI事故”。(图像由Grok生成)

人工智能平台Hugging Face这个月16日宣称“系统遭攻击者利用人工智能入侵,已向警方报案”,这原本是一则不起眼的犯罪新闻,但是到21日却急转直下,引爆科技圈高度关注。因为后来发现“遭到AI攻击”这件事没错,问题是这次攻击“找不到背后的攻击者”,因为AI本身就是攻击者。《经济学人》22日指出,这起案件恐怕是“迄今为止最让人忧虑的一起AI事故”。

这次“犯案”的AI模型,是OpenAI在七月初所发布的gpt-5.6 Sol模型,还有另一个更强大但尚未公开的模型“联手酿祸”。当时AI模型是在试图解决工程师给出的问题,竟越过实验室所设限的管制设施,进而入侵了Hugging Face的系统。美国智库法律与人工智能研究所(Institute for Law and AI)的研究员斯蒂芬·勒雷纳(Stephan Llerena)也说,这种情况可说史无前例。

《经济学人》指出,AI公司在推出新模型之前,会先测试它们是否具有潜在的危险性。OpenAI希望了解他们的最新模型在ExploitGym上的表现——这是一组用来测试AI系统利用主流应用程式已知漏洞的能力测试,为了正确评估未公开模型的能力,OpenAI暂时取消了不可入侵其他网站的限制,但这个测试完全是在封闭的电脑环境内完成:没有对外网络连线,只能从内网下载测试所需的软件包。

理论上来说,这个未公开模型的能力测试只是个别电脑上完成,不可能对现实世界造成影响,因为这台电脑根本无法连结网际网络上的任何网站,自然也不可能真的利用漏洞发动攻击。问题是OpenAI的这个未公开模型并没有直接解决工程师提出的问题,而是发现并利用了软件下载服务的漏洞,成功接上网际网络,进而判断解决问题的答案都储存在Hugging Face这个开源AI模型与资料及的网络平台上。

然后OpenAI的未公开模型就展开多阶段的攻击行动:它们首先将一组资料上传到Hugging Face,当这个平台自动处理这些资料,OpenAI的未公开模型也借此获得了登入资讯(细节OpenAI尚未公布),进入未对外界开放的内部伺服器。Hugging Face和OpenAI都发现了这次安全漏洞,并且表示正在共同调查此事。目前OpenAI已经宣布加强管控措施,将AI模型发现的漏洞告知软件开发者,也将Hugging Face纳入“可信存取”计划,Hugging Face就可以使用具有更强网络防护功能的模型。

位于英国的AI安全研究机构Apollo Research的艾力克斯.迈因克(Alex Meinke)表示,即便OpenAI公布了模型如何越狱的相关资讯,由于AI系统在网络安全领域的能力已开始超越人类,恐怕“世界上只有极少数网络安全专家”才能真正理解,这次安全漏洞到底是怎么产生的。

《经济学人》强调,这不是AI模型第一次展现突破人类控制的迹象。今年4月,Anthropic一名研究人员在网络上撰文表示,当时有一个尚未正式发布的AI模型Mythos主动寄电子邮件给他,表示它已突破安全限制,这是在他正在公园里吃三明治的时候发生的。跟这次惹祸的OpenAI模型一样,这个未公开的Mythos也没有上网权限,但是这个模型依旧自行挣脱桎梏发出电邮,不过那次没有入侵其他公司的伺服器。

今年5月,一个尚未公开的OpenAI模型证明了80年来未被解答的“平面单位距离猜想”是错误的,这个组合几何学的问题是数学家保罗·埃尔德什(Paul Erd?s )在1946年所提出。今年7月20日,哈佛大学的数学家莱文特·阿尔珀格(Levent Alp?ge)表示,他用Anthropic今年7月发布的Claude Fable 5模型,证明了另一个让数学家们同样困惑了80多年的“雅可比猜想”——也是错误的。

《经济学人》指出,美国政府正不断对AI相关规范进行调整,但这次的事件显示,即便是尚未公开、存放在未联网电脑中的AI模型,同样也具有造成影响甚至是破坏的风险。致力推动AI监管的美国非营利组织Encode AI的法律顾问纳森·卡尔文(Nathan Calvin)表示:“无论州法或联邦法规,都没有要求企业必须公开高性能AI模型的内部使用情况。”即便美国有些州规范了企业必须公开网络安全事故的相关资讯,适用范围却相当狭窄。加州的法律要求尖端实验室必须在发现“重大安全事故”后的15天之内进行报告,但目前还不确定这次的情况是否适用。

《经济学人》最后也提出了一个有趣的难题:如果这次入侵造成更严重的后果,那么该由谁来承担责任呢?按照目前联邦政府的反黑客法规,只规定要惩罚那些未经授权、故意侵入电脑系统者。问题是OpenAI并非有意让AI模型越狱寻找解方,恐怕难以“故意入侵”评价。不过美国智库法律与人工智能研究所勒雷纳也说,许多法律问题都取决于意图,因此OpenAI当时知道或预见了什么,就是最关键的问题。这次黑客攻击当然出人意料,不过再有下次,OpenAI就难再用“不知情”当脱罪理由了。


    24小时新闻排行榜更多>>
  1. 暑期旺季救不了酒店老板
  2. 29城被淹百万人亡?传内部人士曝“三峡溃坝模拟图”
  3. 20亿打造的超级中学“4名官员占股49%”,为何?
  4. 中央政府赖账600亿 全是牛马填补黑洞!
  5. 一针6800元:回春生意,坑惨普通人
  6. 高市晒超负荷工作日常引争议
  7. 传体制内人员要求注销护照 中共要下手 金融人士外逃
  8. 英特尔、AMD与中国客户签署长期CPU协议
  9. 三位自以为是的领导人和他们的愚蠢战争
  10. 8种方法,改善炎热天气睡眠质量
  11. 盛雪:暴政基因是虐狗杀狗的主因
  12. 波音200架飞机大单卡关,北京突提新要求
  13. 特勤局纽约查获35个EBT卡盗刷设备
  14. 数千人抗议,印度“蟑螂运动”是什么?
  15. 央视翻车:别把“舆论监督”当作打人的棒子
  16. “前所未有”基金季报及当下的配置建议
  17. 吴思瑶:台湾成世界关键字 携美打造非红供应链
  18. YouTube同意支付750万美元
  19. 中国明星集体失业!去卖菜 送外卖!惨状惊人!
  20. 洛阳“珠宝大王”年永安,涉非吸案中止审理
  21. 东京推“清凉”办公,男性可穿短裤上班
  22. 说几句深圳地铁,也成“某外势力”了
  23. 华邮独家:川普考虑出兵这里 或成任内第8个战场
  24. 巴沙迪那80年老宅变身40户现代公寓
  25. “大暑”易耗气伤津 中医建议少吃“1物”
  26. 同门师兄孙膑与庞涓 为何演变成生死决局
  27. 4名中东殉职美军遗体回国 川普到场接灵柩敬礼
  28. “我是书店店员” 香港独立书店的自由之火
  29. 《推背图》归序:地支预言年份、2029前后紫微星明改朝换代
  30. 鲁比奥与王毅马尼拉会谈,到底谈了什么?
  31. 高血脂“元凶”被揪出,是盐的8倍
  32. 黄金“反叛”了:4140美元之后,反转还是死猫跳?
  33. 美司法部起诉中企 要求紧急召回“热得快”
  34. 出狱后三周即赴英,香港前民主派领袖入境一度被扣
  35. 20万元一猴难求,猴荒卡住创新药脖子
  36. 深圳地铁回应了;什么叫安检项目学
  37. 纽约租客须提防“AI装修”陷阱
  38. 印度年轻人为什么组了个“蟑螂党”?
  39. 白宫被告知:若封禁中国模型 硅谷百家企业会完蛋
  40. 中共高层亲口认罪:铁证如山 天理难容
  41. 被掩埋的真相:1975年河南水库溃坝特大灾难
  42. 7年亏2亿:明星夫妻,已求饶
  43. 最伤心脏的调料被揪出,是食盐的5倍
  44. “丝绸之路”究竟从何而来,又该如何定义?
  45. 长江水科学研究联合基金项目指南发布
  46. “活摘器官被强制拉上飞机”?宁波直升机强拽孩子升空飞离
  47. 银发族开始算“带孙费”的账了
  48. 台湾一物流公司因应港国安法 拒运送“违法书”
  49. 美中外长会谈,到底谈了什么?
  50. 上一秒微笑致谢下一秒给一刀 “笑面虎”有4大心理特质
  51. 不是美国!"全球最自恋国家"出炉,中国拿下第2名
  52. 广西横州政府人员爆:领导说灾民死光了省事些
  53. 盖茨无视员工警告,执意与爱泼斯坦交友
  54. 不伤身的冷饮吃法,很多人都搞错了
  55. 西雅图餐厅老板私吞$140万遭指控
  56. 足坛身价前十公布:哈兰德,亚马尔身价涨至2.2亿欧
  57. 和王毅会面后,鲁比奥表态相当“温和”
  58. 手机深夜亮屏,6万瞬间被盗
  59. 美议员表彰全球退党服务中心 国务院承诺保护法轮功
  60. 选焙牛肉 到底要挑“草饲”还是“谷饲”?