奥特曼首次确认:自研人形机器人
2026-09-03 13:25:07 · chineseheadlinenews.com · 来源: 芯智能头条
OpenAI不准备只做机器人的“大脑”了。
当地时间9月2日,OpenAI首席执行官山姆·奥特曼在《Sources》播客中首次明确表示,OpenAI将亲自下场研发人形机器人。

当主持人问及OpenAI会不会做人形机器人时,奥特曼给出了相当直接的回答:“我们肯定会做人形机器人,也会做其他形态的机器人。”
这句话基本终结了外界持续已久的猜测。过去几年,OpenAI更多以模型提供者和投资人的身份出现在机器人行业;现在,它决定把手伸向机器人本体。
奥特曼解释,OpenAI选择人形,并不是为了让机器人看起来更像人,而是因为现实世界本身就是围绕人类身体建造的。
门把手、楼梯、键盘、厨房、汽车以及工厂里的大量机械设备,尺寸和操作方式都以人类为中心。与其重新改造整个物理环境,不如让机器人拥有接近人的身体结构。
“这个世界在很大程度上是为人设计的。”奥特曼说,无论是开门、使用电脑、驾驶设备,还是清洁厨房,人形结构都更容易适应人类已经建成的世界。
不过,这并不意味着OpenAI的第一台机器人会直接走进普通家庭。
奥特曼明确表示,家庭陪伴机器人并不是现阶段最重要的事情。OpenAI短期内更关注工业基础设施,特别是能够协助熟练工人建设、运营数据中心的机器人。在这类场景中,机器人也不一定非要长成人形。奥特曼透露,OpenAI还会研发适用于数据中心的特种机器人,根据具体任务采用不同的身体结构。
至于机器人最终长什么样,他认为并不是最关键的问题。“真正重要的,是弄清楚如何造出让机器人工作的‘大脑’。”
这也是OpenAI最熟悉的部分。
01 六年前离场,如今重新回来
OpenAI并不是第一次研究机器人。
早在2017年,OpenAI就开始探索如何让机器人将在虚拟环境中学到的能力迁移到现实世界。2018年,其机器人手Dactyl已经能够自主转动方块;2019年,OpenAI又训练机械手单手还原魔方,一度成为当时机器人强化学习领域最受关注的项目之一。
但在2020年前后,OpenAI停止了原有机器人团队的研究。
原因并不复杂:数据太少。
语言模型可以从互联网获得海量文本,视觉模型也能从图片和视频中学习,但机器人需要的动作数据既昂贵又稀缺。每一次抓取、行走和操作都涉及真实物理世界中的摩擦、重量、碰撞与误差,训练速度远远赶不上纯数字模型。
OpenAI随后把资源集中到大语言模型上,并在2022年底推出ChatGPT。
六年后,情况发生了变化。
多模态模型已经能够同时理解文字、图片、视频和声音;视频生成模型开始学习物体运动及现实世界的基本规律;仿真、合成数据和远程操作等训练方式也在快速成熟。此前限制机器人发展的数狙淌题,虽然远未解决,但已经出现新的突破路径。
OpenAI也开始重新搭建完整的机器人能力。
目前,OpenAI官网正在招聘机器人软件、电气、固件和产品安全等多个方向的工程师。工作内容已经覆盖电路设计、PCB、传感器、嵌入式系统、机器人控制、数据采集、故障处理和量产准备等环节。
其中,部分机器人岗位的年薪最高达到44.5万美元,此外还包括股权。这些招聘信息意味着,OpenAI想做的已经不只是一个可以接入不同机器人的通用模型,而是一套由模型、软件和硬件共同组成的机器人系统。
02 从投资机器人,到亲自造机器人
在决定自研之前,OpenAI曾试图通过投资和合作进入物理世界。
2023年,OpenAI领投人形机器人公司1X的2350万美元融资。1X此后推出面向家庭场景的人形机器人NEO,希望让机器人进入普通人的客厅和厨房。
2024年,OpenAI又参与Figure的6.75亿美元融资,并与其签署合作协议,计划把OpenAI的多模态模型装进Figure人形机器人。双方随后展示了一段机器人识别桌面物品、与人交谈并递出的视频。
但这段合作只维持了大约一年。
2025年2月,Figure创始人布雷特·阿德科克宣布终止与OpenAI的合作,转而开发完全自研的端到端机器人模型。此后,Figure推出Helix模型,进一步强调机器人硬件和人工智能必须联合训练。
到了2026年,阿德科克更直言,Figure和OpenAI将成为竞争对手。
如今,随着奥特曼首次确认自研人形机器人,OpenAI的身份已经发生变化:它不再只是站在机器人公司背后提供模型,而是准备直接进入赛场。
这也意味着,OpenAI未来面对的不只是Anthropic、、幻方量化等大模型公司,还包括Optimus、Figure、1X,以及宇树科技、优必选、智元机器人等已经进入整机研发和交付阶段的机器人企业。
03 OpenAI真正想要的是“物理世界入口”
人形机器人正在成为大型人工智能公司的下一块必争之地。
原因并不难理解。大模型目前主要存在于手机和电脑里,能写文章、生成代码、处理文件,却很难直接改变物理世界。一旦模型拥有可以行走、抓取和操作的身体,人工智能才能真正进入工厂、仓库、数据中心和家庭。
对于OpenAI而言,机器人也可能成为ChatGPT之后更大的入口。
它的优势非常明显:拥有全球领先的多模态模型、充足的算力、资本以及庞大的用户基础,也具备通过仿真和生成式模型制造训练数据的能力。
但短板同样明显。
人形机器人不是放大版的ChatGPT。关节、电机、减速器、传感器、整机散热、实时控制和安全冗余,每一项都需要长期积累。让机器人在演示视频里完成一次任务并不难,难的是连续工作数小时,面对陌生环境仍然稳定,而且成本足够低。
特斯拉、Figure、宇树、智元等企业,已经在硬件、供应链和真实场景中跑了数年。OpenAI拥有一颗强大的“大脑”,但能不能造出一副可靠、灵活并且能够量产的“身体”,目前仍是未知数。
截至目前,OpenAI还没有公布人形机器人的名称、外观、技术参数、原型机以及量产时间表。奥特曼的表态代表的是战略方向,并不意味着产品已经接近发布。
但这次表态依然重要。
奥特曼曾说,希望未来每个人都拥有一台个人机器人,替人们完成那些不愿意做的工作。现在,OpenAI已经为这个目标迈出更明确的一步。
ChatGPT让OpenAI进入了数亿人的电脑和手机。下一次,它想走进工厂、数据中心,最终走进每个人的家里。