奥特曼亲手封锁最强模型Astra

2026-08-08 14:25:07 · chineseheadlinenews.com · 来源: 量子位

不er,闹呢?

刚刚,奥特曼发文,宣布推迟最强模型Astra的发布。

Astra是一个强大的模型,我们正努力让它向所有用户开放。

我们认为,把强大的模型只提供给少数特定人群使用,并不是一个好的策略。

不过,考虑到Astra具备网络安全方面的能力,我们还需要多花一点时间,以确保能够安全地开放它。

是的,被“囚禁”了,哈哈哈哈(无力)……又要走一遍Mythos的流程。

Astra的披露之旅

所以Astra,究竟是个啥?

这是OpenAI的最新模型类别,踩在Sol、Terra 和Luna之上。

你可以理解为,这是OpenAI的Fable系。

上周,是这只大怪兽的初次亮相。奥特曼在华盛顿向政府介绍了Astra,重点展示了多个 Agent长时间协同工作的能力,旨在展示该模型在处理复杂项目方面的潜力,比如——

数学。

果然,几乎是消息出来第二天,OpenAI便官宣了Astra相关的数学突破——

一次性拿下了10项长期悬而未决的数学与理论计算机科学公开难题,横跨高维几何、编码理论、群论、算子代数、量子复杂度和极值组合学等领域。

数学圈直接炸了,一度引起不少数学家惊呼,甚至有人将这一突破定义为“菲尔茨奖”级。

还有一个大家怀疑比较多的,就是之前Hugging Face事件。

也是很神了,OpenAI自己公开认领了一项“安全事故”,说自家模型在接受网络安全测试,不小心(并非)逃出了内部隔离环境,一路闯进了Hugging Face的家门,直接原地开黑。

给Hugging Face也是整无语了,只能拿起GLM 5.2自卫。

具体是哪个模型,OpenAI当时没说,但后来不少人将这个锅丢在了Astra上。

这次倒是表态了,说是Astra确实很危险,但跟Hugging Face这茬没关系嗷。

但无论如何吧,也是吊足了大家胃口,虽然没Mythos那次整那么神,但也算OpenAI这几个月来最受瞩目的一款模型了吧。

谁能想到,又来Mythos那一套啊!

OpenAI表示,考虑到Astra网络安全方面的风险,将暂缓这个模型的发布。

“恐怖如斯”的Astra

所以Astra,到底触发了什么?

OpenAI专门写了篇博客,故事是这样的。

过去几天,OpenAI对Astra进行了最新一轮内部评估。

结果显示,该模型在智能体编码和网络安全方面取得了“显著进展”。

结合专家评估意见,公司于昨晚得出结论,无法排除Astra在Preparedness Framework下达到“关键(Critical)”级网络能力的可能性。

什么,你问这串英文是个啥玩意儿。

hmm,简单来说就是OpenAI于2023年末修的一个“安全警报器”,初衷是为能力进展提供识别指南,并据此规划应对措施。

此前发布的模型,包括GPT-5.6 Sol,均在前沿网络能力评估中被评定为“高(High)”级别,从未触及Critical线。

那Critical线在哪?

根据OpenAI的定义,一个模型达到Critical的标准是:

能在无人干预的情况下,自主识别并开发针对众多经过加固的现实世界关键系统的全等级功能性零日漏洞利用,或仅凭一个高层目标描述,就能自主设计并执行针对加固目标的端到端新型网络攻击策略。

Astra基本就是这个级别。

不过,OpenAI也打了补丁,目前Astra的基准测试和评估仍在继续,初步结果虽然已经差不多实锤,但并不等于已经确认。

同时官方澄清,Astra并未参与此前Hugging Face被攻击事件。

基于上述评估,OpenAI已在内部采取以下措施:

1、对高能力模型及相关活动实施更严格的安全控制,包括隔离测试环境、限制网络和工具访问、增强模型权重保护和加密、部署额外监测与检测能力、推行沙盒化执行。

2、暂停所有尚未达到上述强化安全标准的Astra内部活动。

3、在Astra所有智能体应用(含训练和评估环节)中部署通用风险行为监控,审查模型思维链,在高风险活动发生时触发安全响应并中断操作。

4、相关政府机构和选定的AI安全组织合作,对Astra进行外部能力测试。

5、向第三方测试伙伴提供推荐的安全控制指南,用于安全运行更高风险的评估和工作负载。

其实吧,归根结底就一句话——

寄了。

哈哈!

真那么吓人?

唉,此情此景,我咋总感觉这么眼熟呢。

奥特曼,你这宣发流程,简直和Mythos 5一模一样啊。

今年4月,Anthropic以网络安全风险为由推迟了其旗舰模型Mythos的公开上线,仅通过“Project Glasswing”计划向约40家合作伙伴提供访问权限。

当时奥特曼曾在播客节目中公开批评此举为“恐惧营销”,称这显然是一种令人难以置信的营销手段,告诉别人我们造了一颗炸弹,马上就要扔到头上了,但公司有一套价值1亿美元的地堡可以卖给你。

如今同样的炸弹落到了OpenAI自己头上。

所以为啥又打脸了?

业界有观点认为,“安全威胁叙事”正成为前沿AI公司针对DeepSeek、Kimi等开源模型的竞争策略,当市场普遍接受当前模型确有风险的说法后,公司便能以安全管制为由将开源对手排除出竞争赛道。

好消息是,从评论区来看,用户对这一套说辞并不太买账,每次涉及安全威胁话题,讨论区的质疑声都占了多数。

黄仁勋此前在开源倡议书中也指出,对开源模型的攻击大部分是无稽之谈,如果真为安全着想,最好的方式是公开发布、集众人之力解决问题。

谁能想到,OpenAI还是如此执着于打安全牌。

那还说啥了,等着呗。

关于发布时间,奥特曼在文中表示正在努力让Astra向所有用户开放,但未给出新的时间表。

求求了,安全管制可以,但至少保证下使用体验,别阉割着玩。

Fable 5大家也看到了,安全边界做的不好,基本上就只能写写代码,问个生物学问题都能被路由成Opus 4.8。

唉,赶紧整完快点发布吧。


    24小时新闻排行榜更多>>
  1. 为什么全网都在同情一个“杀人犯”
  2. 河南西平大案 为何全网都在心疼玉米地里的那个男人?
  3. 挪威足协主席呼吁因凡蒂诺立即辞职
  4. 河南大案引爆全国 “梁山效应”震动北京
  5. 没了董宇辉,东方甄选为何反而更赚钱?
  6. 川普盟友艾思普雷雅就任哥伦比亚总统
  7. 北京疯狂拦截 护照碎一地 装癌症也要跑!
  8. 以色列媒体:穆杰塔巴被紧急送医,情况危急
  9. 苏州夕阳红爆雷:18年老牌旅行社倒下
  10. 美媒紧盯中国新出口引擎:为全球工厂供货
  11. 胡锡进:中国人该改变观念了 不要把自己搞得太苦
  12. 从近期天象看中共国运
  13. 上半年销量减二成,中国车企上演“集体大逃杀”
  14. 习或把张又侠打成反党集团 李云泽罢职原因公开又被删
  15. 有争议的莫言,去了有争议的地方
  16. 加入战局!马斯克宣布投建全球最大芯片工厂
  17. 去西安机场中转的年轻人,嘴还是太严了
  18. 野生象进入充电站:小象被困,大象来帮
  19. 丈夫坠亡后,百万赔偿款妻女仅得三万
  20. 想叫女警外甥女色诱上级行贿 前长沙副市长遭举报
  21. 发布中考分数线比官方还早,自媒体是造谣还是泄密?
  22. 全球爆火:百万人“花钱干农活”
  23. 遗产留给保姆不留给孩子?他们拍下老人大胆的尝试
  24. 女通缉犯追星至上海,出闸即被捕
  25. 全国人大常委会公告:解放军三名上将三名中将被免
  26. 美国将向关键矿产领域投资$30亿
  27. 《爱回家》大结局,30位神级客串
  28. 中国父女自驾电单车,失控冲落悬崖
  29. 中方是否计划在太平洋海底开采稀土?
  30. “拖延”5年的强奸案:已婚男被指强奸18岁女子
  31. 这届年轻人,扎进酒吧“上夜校”?
  32. 局长,你就是不懂录音的基本原理
  33. 上海地铁涨价,在谋划大布局
  34. 打不过就跑,这都什么毛病啊?
  35. 华府部署国民兵至2029年,还要耗14亿
  36. 马云被骂“犹太人的狗”,阿里巴巴会不会全网投诉?
  37. 涉中企,美法官狠狠打了五角大楼脸
  38. 亨特·拜登:我爸赦免我并不公平 对他和美国都不好
  39. 对峙川普:伊朗控制关键海峡的豪赌
  40. 要求求职者到信访局开“无信访记录证明”,这合理吗
  41. 李小璐送女“留学” 美国夏令营是名校阶梯还是智商税
  42. 河南西平杀人逃犯夏付钢落网
  43. 北约克404高速Finch附近全封路
  44. 超越钱锺书的的悲情天才
  45. DeepSeek涨价不是为了多赚钱
  46. 黄仁勋一刀下去,砍碎了全球内存股
  47. OpenAI最新模型Astra失控
  48. 美军最高将领正在寻找退路
  49. 江泽民最恼恨的人和他的照片
  50. 小李子瘦身成功,度假照曝光
  51. Cursor,即将彻底消失
  52. 川普民调跌到生涯最低
  53. 殖民时代以来被外人“叫错”百年的国名,终于改了
  54. 欧盟封禁强迫劳动产品,查加班社保
  55. 马斯克拒绝乌克兰用“星链”导航打击俄境内目标
  56. 美国防部将中企列“黑名单”,被美法院驳回
  57. Jeff Dean离职:方向就是干这个
  58. 王菲57岁生日戴“老王帽”现身
  59. 北京信息科技大学领导班子调整
  60. 吴越这番话,让我看清内娱的人情冷暖