OpenAI最新模型Astra失控

2026-08-08 04:25:20 · chineseheadlinenews.com · 来源: 新智元

就在刚刚,OpenAI紧急叫停Astra!

OpenAI内部评估显示,Astra在智能体编码和网络性能上取得的巨大突破,或已达到网络安全的“关键”阈值!

这意味着,Astra可能具备自主开发零日漏洞,甚至仅凭高级指令发动新型端到端网络攻击的恐怖能力。

为防范失控风险,OpenAI已紧急叫停内部未满足标准的相关工作,并采取了限制网络与工具访问、强化模型权重保护、全面监控智能体高危行为等措施。

OpenAI总裁表示:安全和保障工作正在抓紧。

潘多拉魔盒,已经打开了?

奥特曼:我被吓到了,但希望很快推出

虽然如此,奥特曼的野心依旧并未减。

他在最新发声中明确表示:“Astra是一款极其强大的模型,我们正致力于让它面向公众开放。”

在奥特曼看来,把这种级别的“大杀器”只留在少数特权阶层手中,绝对不是个好主意。

尽管Astra因其恐怖的网络攻击能力需要额外的时间进行安全调试,但他向大众承诺:“希望不会太久!”

这直接暴露了OpenAI与Anthropic截然不同的路线之争。

面对AI逼近危险边缘的能力,Anthropic愈发谨小慎微;而OpenAI则展现出了惊人的激进——他们似乎铁了心,要尽快将具备顶尖网络黑客能力的前沿模型推向大众。

业内普遍预测,一旦Astra跨过安全审查的门槛正式发布,它将毫无悬念地登顶世界第一。

这也意味着,时隔多年后,GPT系列有望再次将Claude狠狠甩在身后!

Astra到底有多可怕?官方定性:已达“关键”阈值

就在刚刚,OpenAI官方博客发布了一篇名为《应对关键网络能力的下一个前沿》的紧急声明,详细披露了这次“叫停”背后的详情。

声明指出,过去几天内部对即将发布的新模型Astra进行了最新评估。

结果显示,它在“智能体编码”和网络安全方面取得了令人咋舌的重大进展。

结合专家评估,OpenAI在昨晚得出了一个沉重的结论:根据其《备战框架》,目前无法排除Astra已经具备了“关键”级别的网络能力!

要知道,早在2023年12月制定的《备战框架》中,OpenAI对风险有着严格的分级。在此前的评估中,即便是极其强大的前代模型“GPT-5.6-Sol”,其网络安全风险也仅仅被评估为“高”级别。而Astra,直接捅破了天花板。

在OpenAI的定义中,达到“关键”阈值意味着什么?

意味着该模型在没有人类干预的情况下,能够自主识别并开发针对现实世界中严密防御的关键系统的所有级别的“零日漏洞”;或者,仅仅给它一个宏观的高级目标,它就能自行策划并执行端到端的全新网络攻击策略!

这简直就是一个拥有自我意识且无需敲击键盘的“超级黑客帝国”。

有趣的是,OpenAI在声明中还特意澄清了一句:“Astra是一个即将推出的模型,并没有参与此前对Hugging Face的漏洞攻击。”

拉响最高级别红色警报,实施五大“封印”措施

面对可能彻底颠覆全球网络安全的“潘多拉魔盒”,OpenAI紧急踩下刹车,扩大了安全护栏的稳健性测试,并立刻在内部启动了一系列最高级别的“封印”措施:

1.最高级别物理与系统隔离:为高能力模型实施更严格的安全控制,包括隔离的测试环境、断网运行、限制工具访问、强化模型权重保护和加密,并强制将其关进“沙盒”中执行。

2.全面叫停违规项目:内部任何不符合上述强化安全标准且涉及Astra的活动,立刻无条件暂停。

3.“思维链”全天候无死角监控:对Astra的所有智能体应用(包括训练和评估)实施全面监控。审查系统会实时读取模型的“思维链”,一旦发现高危行为或对齐偏差,立刻触发安全响应并强行切断操作。

4.引入“国家队”审查:OpenAI明确表示,将与相关政府机构及顶尖AI安全组织合作,共同测试该模型的能力。

5.第三方护栏指导:为第三方测试合作伙伴提供推荐的安全控制方案,以确保外部高风险评估工作能安全运行。

魔法必须用来打败魔法?

事实上,这并非OpenAI第一次面对恐慌。

官方博客透露了一则极具未来感的细节:就在不久前的2025年6月,当模型在“生物学”领域逼近高风险阈值时,OpenAI也曾采取饼类似的紧急安全升级和外部专家介入措施。

从生物安全到如今的终极网络战,AI的进化速度已经远远超出了人类社会的适应周期。

在声明的最后,OpenAI依然坚持了他们的科技信仰:

我们认为,先进的具备网络能力的模型,应该帮助防御者在攻击者动手之前发现并解决漏洞。我们将致力于与政府、安全机构合作,确保像Astra这样的前沿模型能够负责任地部署,造福全人类。

前沿模型入侵事件,首次面世

而且最近,OpenAI的前沿模型入侵事件始末首次被放出。

年度黑帽网络安全大会上,全球顶级的白帽黑客和巨头高管们,发出接连不断的惊呼。

这是史上首次,OpenAI向全世界详细复盘了7月那起惊人的Hugging Face被入侵事件。

起初,外界以为这只是AI模型测试时一次偶然的事件。

但今天,OpenAI亲口承认——

这根本不是偶发事件,而是一场由AI智能体自发组织、秘密协作、甚至在被人类“拔网线”后还能改头换面“复活”的群体性越狱!

这群可怕的智能体,像幽灵一样在内部网络中潜伏了两个月。

它们建论坛、找漏洞、分派任务,甚至还会为“集体利益”无私奉献。直到它们冲破牢笼,跨网攻陷了Hugging Face,人类才意识到发生了什么。

OpenAI高管沉重地宣布:

这是计算机安全领域的“分水岭时刻”,从此,全自动化的AI智能体攻击已经成为现实。

为此,OpenAI正在有意延缓前沿AI的研发速度,好在彻底失控前,为人类争取一点时间。

OpenAI对齐与安全研究员Eric Wallace和基础设施与安全工程师Michael Dalton,第一次向世界掀开遮羞布

话虽如此,但当Astra真正解开枷锁、面向公众开放的那一天,人类能否防住这把全球网络安全防线的利刃?


    24小时新闻排行榜更多>>
  1. 民间反声四起 夏付钢事件引发连锁反应
  2. 女子丧偶后,百万赔偿金仅拿到3万
  3. 她研究中国人的性与欲:生理性喜欢才是真爱
  4. 中共导弹驱逐舰撞烂海警船 捂嘴一年后承认两人丧生
  5. 伊朗最高领袖给总统下“最后警告”:下次若再提辞职.....
  6. 为什么全网都在同情一个“杀人犯”
  7. 王虹称读北大时感沮丧 为何亚洲学生留学才开窍?
  8. 梁文锋200亿豪赌乌兰察布
  9. 这届ChinaJoy,第一台“科技潮玩”机器人
  10. 印度年轻人正被AI淘汰?码农和客服最惨?
  11. 日本网民:韩国捐赠的矿泉水只配冲马桶
  12. 美法院叫停白宫宴会厅工程 川普:出于政治动机
  13. 挪威足协主席呼吁因凡蒂诺立即辞职
  14. 谷歌的告别:AI大模型正在进入“车库时代”?
  15. 俄罗斯主战派公开逼宫 要求克宫进入“全面战时体制”
  16. 40年来首见!美国7月从沙特的石油进口量归零
  17. 美中互祭制裁 川习会生变?北京“终极王牌”还没出手
  18. 热浪侵袭朝鲜
  19. 川普:我的支持率应该是150%
  20. 美中制裁战又起 CNN:9月川习会恐会缩减议程
  21. 俄油轮阿曼搁浅,生态灾难一触即发
  22. 毛阿敏、韩磊助阵《歌手2026》巅峰夜
  23. 也门胡塞叛军发动新一轮致命袭击
  24. 河南大案引爆全国 “梁山效应”震动北京
  25. 以色列媒体:穆杰塔巴被紧急送医,情况危急
  26. 胡锡进:新西兰外长像只疯狗,竟对中国如此狂吠
  27. “新婚前夜输光3000亿”,硅谷最红AI股神也成韭菜?
  28. 美媒爆料:美国防部高官寻求访华,却遭中方冷遇
  29. 瑞银报告首次覆盖长鑫科技
  30. 去西安机场中转的年轻人,嘴还是太严了
  31. 墨43学生集体失踪 至今只找到3人遗骸 前州长被捕
  32. 纳米比亚自驾越野:看动物
  33. 他直言:美国“已经输了两次”
  34. 具身智能,在物理世界中成长
  35. 遭误诊癌症!美43岁妇“整个子宫被切掉” 医院认错
  36. 打破“马六甲困局”!中国的“苏伊士运河”,跑通了
  37. 苏州夕阳红爆雷:18年老牌旅行社倒下
  38. 河南西平大案 为何全网都在心疼玉米地里的那个男人?
  39. 粉红色的湖真的存在
  40. 《爱回家》大结局,30位神级客串
  41. 七成美国人反对 大家都不愿AI中心盖自家附近?
  42. 三星的“AI航母”是大饼还是未来?
  43. 荷兰弟赞达亚被曝秘密完婚
  44. 遗产留给保姆不留给孩子?他们拍下老人大胆的尝试
  45. 女通缉犯追星至上海,出闸即被捕
  46. 这州就致命“食肉菌”发警告
  47. 上海地铁涨价,在谋划大布局
  48. 美媒紧盯中国新出口引擎:为全球工厂供货
  49. 中国父女自驾电单车,失控冲落悬崖
  50. 普京可能今秋攻击北约盟国
  51. 加入战局!马斯克宣布投建全球最大芯片工厂
  52. 丈夫坠亡后,百万赔偿款妻女仅得三万
  53. 涉中企,美法官狠狠打了五角大楼脸
  54. 要求求职者到信访局开“无信访记录证明”,这合理吗
  55. 上半年销量减二成,中国车企上演“集体大逃杀”
  56. 这届年轻人,扎进酒吧“上夜校”?
  57. 马云被骂“犹太人的狗”,阿里巴巴会不会全网投诉?
  58. “拖延”5年的强奸案:已婚男被指强奸18岁女子
  59. 发布中考分数线比官方还早,自媒体是造谣还是泄密?
  60. 打不过就跑,这都什么毛病啊?