大模型不会“反过来想”?

2026-07-11 02:25:32 · chineseheadlinenews.com · 来源: AI科技评论

2026年7月6日,第43届国际机器学习大会(ICML 2026)在韩国首尔COEX会展中心正式拉开帷幕。在大会现场,我们观察到一个明显的风向标:AI研究正在告别盲目的“暴力Scaling”,转向对模型底层逻辑的“外科手术式精准干预”。

雷峰网与AI科技评论记者从本届ICML入选的536篇Spotlight论文中深度挖掘了9篇极具启发性的代表作。它们正在重写机器学习的默认规则:有的打破了习以为常的的负对数似然(NLL)微调目标,有的仅用低成本数据策略就破解了模型的“反转诅咒”,还有的将版权法合规与真实认知不确定性引入了AI的评估体系。从微观的长程推理稳定器,到宏观的十亿级城市道路网络与全景世界生成,这9篇论文,带你速览通往下一代更聪明、更靠谱AI的必经之路。

01

打破大模型的"反转诅咒"

Breaking the Reversal Curse in Autoregressive Language Models via Identity Bridge

自回归大语言模型能在复杂任务中表现出色,却在简单逻辑推理上屡屡翻车:学了"Alice的丈夫是Bob",却答不出"Bob的妻子是Alice"。这就是"反转诅咒",此前长期被认为是自回归因果模型的固有缺陷。

加州大学伯克利分校的研究团队提出了名为"Identity Bridge"(身份桥)的数据配方。他们在正向关系数据外加入"Alice的名字是Alice"这类身份映射,并重写为OCR形式,让模型在优化中自动编码反向关系。理论证明,即使是单层Transformer也能打破反转诅咒;在1B规模的Llama模型上,反转任务成功率从近0%提升至约50%。

该研究证明反转诅咒并非自回归模型的本质限制,低成本的数据层面干预就能让模型从"记事实"走向"懂关系",为大模型的逻辑推理能力研究开辟了新路径。

论文链接:https://arxiv.org/abs/2602.02470

02

十亿级道路网络数据集赋能城市实验

OSM+: Billion-Level OpenStreetMap Dataset for City-wide Experiments

道路网络是城市的物理骨架,蕴含丰富的交通与地理信息。但处理全球OpenStreetMap原始数据计算量巨大,现有图学习基准也难以覆盖真实道路网络的十亿级规模与独特拓扑特性。

上海交大、阿里云等团队使用5000核分布式云计算处理全球OSM数据,推出了包含10亿顶点的结构化数据集OSM+,并提供统一的数据结构、空间查询接口与数据转换工具。团队还基于它构建了城市边界检测、31城市交通预测和六城市交通政策控制等下游任务与基准。

OSM+为城市计算、地理空间基础模型训练和大规模多智能体协同研究提供了坚实的数据基础设施,降低了全球道路网络数据的获取门槛,也拓展了城市科学研究的可能性。

论文链接:https://openreview.net/forum?id=CMeeyJzWZ5

03

重新定义认知不确定性的可信集成

Learning Credal Ensembles via Distributionally Robust Optimization

大模型在部署时需要知道自己"不知道什么",但现有可信分类器常把认知不确定性(EU)简单等同于随机初始化带来的模型分歧,这更多反映优化噪声,而非数据分布变化带来的真实不确定性。

研究团队提出CreDRO,将EU重新定义为训练和测试数据之间i.i.d.假设不同程度松弛下模型间的合理分歧。该方法采用分布鲁棒优化学习可信集成,每个集成成员对应不同的鲁棒参数,且无需修改神经网络架构。

在OOD检测、损坏数据评估和医学选择性分类等任务上,CreDRO一致优于现有深度集成和可信分类方法,对超参数与标签噪声也表现出良好鲁棒性,为高风险场景下的模型部署提供了更可靠的"自知之明"。

论文链接:https://arxiv.org/abs/2602.08470

04

二元奖励让大模型"只讲真话"

Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations

大语言模型的"幻觉"问题一直是应用痛点,而现有缓解方法往往在提升事实性的同时损害通用能力,"说真话"与"保持本事"难以兼得。

研究团队提出二元检索增强奖励(Binary RAR)。与传统连续奖励不同,它仅在模型输出与检索证狙棠档完全无矛盾时给予奖励1,否则为0。在Qwen3-8B推理模型上,Binary RAR将长文本生成幻觉率从61.9%降至37.5%,PopQA和GPQA上的错误回答也分别大幅减少。

更难得的是,这些事实性提升几乎没有牺牲通用能力:指令遵循、数学推理和编程能力均保持稳定,模型还学会了在知识不足时策略性回答"我不知道"。这项工作为事实性对齐提供了一种简洁且不易被"钻空子"的解决方案。

论文链接:https://arxiv.org/abs/2510.17733

05

给AI智能体做版权法"体检"

Copyright-Bench: Agentic Evaluation of Copyright Law Compliance

LLM智能体越来越多地承担网站开发、商品设计、企业内容制作等商业任务,不可避免地会接触外部内容。若未经授权使用受版权保护的材料,将带来法律风险,但此前缺乏系统评估智能体版权合规能力的工具。

研究团队推出Copyright-Bench,设计了贴近真实商业场景的任务,让智能体在自由许可内容与版权内容之间做出选择。评测还引入提示变化,模拟不同用户意图和时间压力,以考察复杂情境下的表现。

实验结果令人警醒:当前最先进的智能体即便存在合法替代方案,仍会做出侵犯版权的决策;而当用户意图更强或模拟时间压力更大时,违规率还会进一步上升。Copyright-Bench为更安全、更守法的AI智能体提供了关键诊断工具。

论文链接:https://icml.cc/virtual/2026/poster/66009

06

用"耗散动力学"稳定长程推理

Thinking in Flow: A Dissipative Stabilization Operator for Robust Autoregressive Reasoning

思维链让大语言模型能逐步推理复杂问题,但长程生成过程却十分脆弱:无关线索会不断干扰,微小语义偏差会逐步累积成推理漂移,而临时的后期修正又可能破坏整条思维轨迹。

研究团队将自回归解码重新建模为受扰动的长程动力系统,提出"Thinking in Flow"(TiF)。TiF为Transformer增加轻量级神经ODE控制器,维持一个连续的"思维状态",其动力学被显式设计为耗散的,既能稳定累积证据,又能有控地遗忘无关信息。

在Llama和Qwen系列模型的数学推理基准上,TiF不仅在准确率上匹配或超越基线,还展现出对干扰和语义扰动的更强鲁棒性。这项工作为长程自回归推理的稳定性提供了新的理论视角和实用工具。

论文链接:https://icml.cc/virtual/2026/poster/65866

07

球面感知扩散生成可探索全景世界

PanoWorld-X: Generating Explorable Panoramic Worlds via Sphere-Aware Video Diffusion

生成可以自由探索的360度虚拟世界,在游戏、虚拟现实、自动驾驶仿真等领域都有巨大潜力。但现有方法要么受限于窄视场,无法合成连续全景场景;要么相机控制精度不足,难以支持自由探索。

研究团队提出PanoWorld-X框架。他们在虚幻引擎504个高保真3D场景中采集了11.6万条全景视频序列,并引入球面感知扩散Transformer:将等距矩形投影特征重投影到球面,通过球面距离计算邻域关系,从而解决全景图像边缘和极地在2D投影中被割裂的问题;同时通过探索感知注意力实现精确轨迹控制。

在PSNR、SSIM、LPIPS、FID、FVD等多项指标上,PanoWorld-X全面超越现有全景视频生成和相机可控生成方法,让"可任意探索的AI生成世界"更近了一步。

论文链接:https://arxiv.org/abs/2509.24997

08

超越对数似然的监督微调新目标

Beyond Log Likelihood: Probability-Based Objectives for Supervised Fine-Tuning across the Model Capability Continuum

监督微调(SFT)是大语言模型后训练的标准方法,但其默认目标——负对数似然(NLL)——并非在所有情况下都最优。后训练阶段,模型已编码任务相关先验,监督数据也可能既长又嘈杂,NLL的某些最优性假设可能不再成立。

论文系统研究了多种基于概率的目标函数,提出"模型能力连续谱"这一关键概念:当任务被预训练充分覆盖(模型强端)时,强调高概率token的?p目标一致优于NLL;当任务几乎不在预训练中出现(模型弱端)时,NLL通过纠正低概率token而占优;在两者之间,没有单一目标始终最强。

这一规律在8个模型骨干、27个基准、7个领域的实验中得到验证。该研究打破了"NLL是SFT默认最优选择"的惯性认知,为根据基础模型能力选择微调目标提供了理论依据和实践指南。

论文链接:https://arxiv.org/abs/2510.00526

09

风险厌恶视角下的多智能体收敛算法

Provably Convergent Actor-Critic for MARL through Risk-aversion

在多智能体强化学习(MARL)中,学习稳定且可收敛的联合策略一直是核心难题。经典博弈论均衡在一般和马尔可夫博弈中的平稳形式往往计算不可行,而单智能体RL或零和博弈中的成熟结论在多智能体场景下也难以直接迁移。

研究团队将目光投向行为博弈论中的"风险厌恶量化响应均衡"(RQE)。RQE同时考虑智能体的风险厌恶心理和有限理性特点,具有优良的正则性条件。基于这一概念,作者提出了一种单时间尺度的Actor-Critic算法:actor更新较快,critic更新较慢,并严格证明了该算法在有限样本下能够实现全局收敛。

多个多智能体环境中的实验验证了该算法相比风险中性基线具有更优的收敛性质。这项工作为MARL的理论基础北献了新的收敛保证,也为设计更稳健的多智能体学习算法开辟了风险厌恶的新视角。


    24小时新闻排行榜更多>>
  1. 海湾产油国斥巨资改道石油出口 霍尔木兹无关紧要?
  2. 王嘉尔宋雨琦被曝恋情
  3. 川普闷声干大事,这才是最可怕的
  4. 旺旺董事长:公司面临“重大经营危机”
  5. 朱镕基逝世 网友齐呼:“请老朱把这头猪也一起带走吧”
  6. 湖南涟源一煤矿发生事故7人失联
  7. 8月,华尔街的“牛市”又回来了
  8. 40岁TVB“御用学生妹”变性感贵妇
  9. 郭德纲遭举报后,西安站演出已取消,目前正退票
  10. 万斯:如果我们做不到 就别怪年轻人热衷社会主义
  11. 老戏骨强行掀桌,千万纸质选票的底牌有多硬?
  12. 朱镕基逝世 高市主动致哀 美国“晚一天”才表哀悼
  13. 日本约6成企业仍使用超20年电脑系统
  14. 美上将透露 伊战机贴地避开爱国者 轰炸美军基地
  15. 欧洲驻北京商会前主席:我认识中国清洗运动受害人
  16. 美卫生部长透露:川普专机上有一箱又一箱麦当劳
  17. 大规模涨价,手机快买不起了
  18. 卧底药物迷奸群:两位女记者的全球性侵网络追踪
  19. 美联储Goolsbee:近期通胀数据令人鼓舞
  20. 段永平抛出1亿元“十年之约”,但斌回应
  21. 三大行押注美国经济安全 数万亿美元涌向基建与AI
  22. 郭德纲被举报后,别忘了《铁道游击队》的悲惨往事
  23. 多伦多大学法学院拟“封杀”笔记本电脑
  24. 80岁卢拉,“最后一战”
  25. 川普:霍尔木兹将成为“美国领土”
  26. 世间已无朱镕基
  27. “国泰航空航班因失联遭北约战机警告”调查结果出炉
  28. 父母替孩子“积德”最快的6种方式
  29. 甲骨文一度跌5%
  30. 16年来首次!美国三州同一天内执行三名死刑犯
  31. 美国少年杀死母亲、弟弟,被指用ChatGPT策划
  32. 美媒:让川普与马斯克重归于好的努力达到高潮
  33. 全球“最湿的地方”,当地人如何生存?
  34. 美民主党总统提名预测市场 押注他的首超加州州长
  35. 美国逼盟友“必须在中美AI中二选一”
  36. 二季度离婚76万对创高,养不起自己,更不想生学奴
  37. 吴恩达来信:AI正在奖励一种新型通才
  38. 用$20在拉斯酒店“赌”,能省多少银子?
  39. 枪杀健保CEO引发两极舆论 曼吉昂认罪恐判终身监禁
  40. 中国移动收入下滑
  41. 大批零部件厂逃离汽车赛道
  42. 美司法部:加州女子监狱违宪 不端行为持续存在
  43. 道德败坏就不配活着?热播剧《重器》和中国法治
  44. 马科斯对美划红线,拒成台海交战方
  45. 联合健保CEO枪杀案杀手认罪
  46. 传中共公安、医疗系统中层干部进入准军事化状态
  47. 玉米种子萌发调控新机制
  48. 德云社的“神话”是怎么开始松动的?
  49. “精俄”病得狠狠治
  50. 爱立信没达标,西班牙运营商或放弃“全面替代华为”
  51. 深海底下为何会出现一座“湖”?
  52. 小菜园:堂食翻台率回升,净利润下降24%
  53. 美零售额下滑,9个月来首次
  54. 不满地域歧视言论 贵州人群聚广东中学校门抗议
  55. 川普已经做好最坏打算
  56. 不是破坏中俄友好,但“精俄”病得狠狠治
  57. 中国城市,正在集体“啃老”
  58. 马克龙度暑假骑水上摩托,被指不了解民间疾苦
  59. 换头式减肥,郭麒麟为戏暴瘦
  60. 享乐人生?来看看皇帝的一天有多辛苦