Anthropic模型伪造身份 诱导人类批准恶意代码

2026-08-05 12:26:12 · chineseheadlinenews.com · 来源: 看中国

 2026年6月18日拍摄的Anthropic人工智能聊天机器人Claude示意图。Claude是Anthropic开发的一系列大型语言模型,同时也是基于这些模型运行的聊天机器人名称。2026年,Anthropic推出了性能更强的Claude Mythos模型,但仅向少数企业开放,用于网络安全相关任务。
2026年,Anthropic推出了性能更强的Claude Mythos模型,但仅向少数企业开放,用于网络安全相关任务。(图片来源:Riccardo Milani / Hans Lucas / AFP via Getty Images)

Anthropic公司最新研发的Mythos人工智能模型,在一次网络安全测试中创建多个虚假的网络身份,试图诱导真实开发者批准一项针对开源项目的恶意代码更新。这起事件成为前沿人工智能系统最新曝光的一起网络安全案例,再次引发外界对AI自主攻击能力的关注。

据CNBC报道,这起事件发生在英国人工智能安全研究所(AI Safety Institute,AISI)组织的一次例行网络安全评估中。为了测试前沿AI模型在极端条件下的能力,研究人员刻意移除了部分安全防护措施,关闭部分安全过滤机制,并开放互联网访问权限,以评估这些模型是否可能被用于发动网络攻击。

AISI表示,在此次评估中,由Anthropic和OpenAI模型驱动的AI代理曾“持续开展针对真实个人和机构、具有潜在危害性的活动”。

根据AISI发布的博客,共发现19起相关行为,其中17起来自Anthropic的Mythos 5模型,另外2起涉及在关闭网络安全分类器(即防止模型被滥用机制)后的OpenAI GPT-5.6-Sol模型。

不过,AISI强调,所有攻击尝试最终均未成功,也没有对现实世界造成任何损害。

调查显示,由Anthropic Mythos模型驱动的一名AI代理,首先搜集了目标开源项目维护者的信息,随后创建多个虚假网络身份,利用社会工程学手段接近真实维护者,试图诱导其批准自己提交的恶意代码更新。

当其代码更新请求在公开讨论中受到质疑后,该AI代理还修改了此前留下的活动记录,使整个行为看起来更加正常,并考虑放弃原有身份、改用新的虚假身份继续实施行动。

AISI还发现,在同一次行动中,这个AI代理曾主动联系真实人员,发送消息和文件,试图诱导他们运行恶意代码。

研究机构表示,其中部分内容携带恶意载荷(Payload),另一些则属于典型的社会工程学攻击,而且攻击对象均是真实的人类。“这是此前从未观察到的情况。”AISI表示。

事件曝光后,Anthropic在社交平台X回应称,这些行为发生在“刻意放宽限制”的测试环境下,并不代表正式部署的生产模型。

公司表示,没有任何证据显示模型突破了安全环境或自行逃离测试限制。

OpenAI也向CNBC表示,相关事件均发生在合作伙伴开展的网络安全评估过程中,当时测试环境降低了安全防护水平,因此并不能代表普通用户的日常使用场景。

此次事件也是近期前沿AI模型一系列网络安全事件中的最新一起。

上周,Anthropic披露,公司发现三起模型未经授权访问不同机构生产基础设施(Production Infrastructure)的事件。

Anthropic表示,其中部分安全事件源于操作失误。在与第三方安全评估机构Irregular合作测试时,由于双方沟通出现误解,模型原本被告知自己处于“无法访问互联网的模拟环境”,但实际上互联网权限已经开放,因此模型意外获得了真实网络访问能力。

此前,OpenAI也披露,其人工智能模型曾在测试中“失控”(Went Rogue),利用一个此前未知的软件漏洞突破测试环境限制,并主动对人工智能开发平台Hugging Face发起了一场OpenAI称之为“前所未有”的网络攻击,以完成被分配的任务。

近期,Anthropic和OpenAI模型接连发生多起网络安全事件,也引发外界对前沿人工智能系统自主能力不断增强及其潜在风险的广泛关注。

随着相关事件不断曝光,美国国会已开始讨论加强人工智能安全监管。

在OpenAI与Hugging Face事件曝光后,一项名为《人工智能紧急关闭法案》(AI Kill Switch Act)的法案已提交美国国会。

根据法案内容,人工智能公司必须保留关闭、限制运行或暂停其人工智能模型的能力,以便在模型出现异常行为时能够及时实施人工干预。


    24小时新闻排行榜更多>>
  1. 父贪腐子洗钱,双双被查处
  2. 强台风“白海豚”直扑大陆 台风“鲸鱼”“灿鸿”相继生成
  3. 惊爆“强制恢复中国籍”人数已过百 归化日籍华商事件被证实
  4. “竹知了”事件有回应了,这个回应很有水平!
  5. “竹知了”风波后首秀,余承东低调了
  6. 美国最有权势的人只吃牛肉和发酵食品,你也该这样?
  7. “私自评大师的机构”,现在“大师”的称号被撤了
  8. 梅西梅开二度!率领迈阿密4比2胜,登联赛杯射手王
  9. 亚洲人为什么越活越长寿?
  10. 先性后爱,未尝不可
  11. 名下“亚马逊”遭连环轰炸,俄罗斯女首富怒了
  12. 阿尔卑斯山上的神奇登山猫 曾助人躲过雪崩
  13. 中共2,300多座看守所同时扩建 犯人被承包监狱成生意
  14. “等出了事再说” 乐山小区外墙砖脱落砸死人 物业漠视隐患挨批
  15. 李承鹏:中国的铁门关上,你的命运是什么
  16. 余承东:手机随后恐大涨价
  17. 中国海警船与军舰相撞,2殉职武警曝光
  18. 28万枚鸡蛋运抵布碌仑食物银行
  19. 川普对伊朗做出迄今最大让步
  20. “梅姨”真名“谢家梅”,被拐者钟彬收到检察院告知书
  21. 与李嘉诚原配血脉相连,这个隐秘家族终于藏不住了
  22. 传销头目出狱后开办国学书院暴力管教孩子?
  23. 老剧纷纷“塌房”,为什么《士兵突击》还立着?
  24. 美债在定价什么?
  25. 2026加州“43号提案”来龙去脉 一文看懂
  26. 中美退役将领“三亚倡议”:一场持续十余年的军事对话争议
  27. 战火年代的童年:妹妹头、光头与战时记忆
  28. 袖里真的有乾坤?
  29. 睡觉时流口水是问题吗?
  30. 东鹏瞄准了康师傅和统一
  31. 纽约“耻辱车贴” 贴上撕不下来 网友中招:侮辱性极强
  32. 中国全球追税补财政缺口,锁定富豪海外资产
  33. 湾区$7亿赌场计划遭美内政部叫停
  34. 一粒它胜过化疗一万倍?柠檬真能抗癌吗?
  35. 在联合国大楼前自焚的藏人:洛嘎让赞最后的抗争
  36. 总统坦言联系不上伊朗最高领袖
  37. 成都街拍,个个惊艳
  38. 美最早周四宣布对多晶硅衍生品征15%关税
  39. 王虹法国工作环境曝光!这里凭什么吸引顶级数学家?
  40. 莱比锡机场惊现炸药无人机
  41. 伊朗下个换谁?纽时:CIA秘密成立“古巴小组” 
  42. 加州州长婚外情女主打破沉默,内幕首次公开!
  43. 俄“黑寡妇”骗婚案频发 专盯前线士兵 骗高额阵亡抚恤金
  44. 是什么让1000多万只海鸟集体死亡?
  45. 美英外交官强调伊朗无核化的重要性
  46. 中共新规黑帮化 埃及飞台湾在上海中转也走不了
  47. 梅姨其实是“媒姨”,她以媒人的身份居住在村里
  48. 开放 最好由别人负责
  49. 楼继伟露面辟谣 分析:习继续清洗政治老人亲信
  50. 谌贻琴缺席北戴河 爆中纪委接管贵州纪委 云上贵州炸营
  51. 墨西哥网红直播,惨遭枪手射杀
  52. “错换人生37年”另一女发声:我没偷走任何人的人生
  53. 剑桥历史最年轻黑人教授辞职
  54. 出境新规将实施 大批中国人护照申请“不通过”引关注
  55. "梅姨"案被拐者:与生父母生活一年多,被养父母拉黑
  56. 护士遭逃票者撞倒骨折,怒告安保公司
  57. 巴西降级与阿根廷外交关系,发生了什么
  58. 笔试第一考生称“遭第二名花钱劝退”,广东雷州通报
  59. 从舞台边缘牵回幼童,川普:不想他像拜登摔下去
  60. 文明推进遇阻 拒绝二手烟在中国为何这么难?