OpenAI的担心反而是具身的正路?这家具身大脑公司已经先往前走了一步
发布时间:2026-09-11 19:52 浏览量:2
8月26日,一个机器人 Demo 视频在业内热传。彼时外界还不知道背后的公司是谁,只知道模型代号是 MVP,Make Veritable People,中文名“做个人吧”。
9月6日,OpenAI 发布GPT-6 Astra 的第二天,OpenAI 首席科学家 Jakub Pachocki 发表了一篇名为《An Alien Mind》的长文。他在文章里提到,我们正在创造一种我们不完全理解的智能,且它在以惊人的速度实现自我改进,呼吁大家应当主动踩下刹车,放缓节奏。
9月10日,乐享科技 CEO 郭人杰公开发文对OpenAI 提出清晰三问。与此同时,公司正式认领此前曝光的“MVP”模型,并发布模型Aether,以太。
短短半个月,到底发生了什么,能让一家此前低调行事的中国具身智能公司,选择把全球最顶尖的 AI 巨头推上舆论审判席?
让我们将时间先回溯到 8 月底,那个引发火热讨论的视频。
视频里能看见宇树 G1 和智元远征 A3 正在一个真实的居家环境里连续完成擦玻璃、整理物品、打开冰箱、处理临时任务等工作。很难相信,两个大小不一、硬件结构、自由度和传感系统完全不同的机器人,居然在用同一个脑子。不仅不排异,机器人还在没有人工指令的情况下,发挥了“主观能动性”完美完成任务。
是的,它们学会了自己想办法。擦玻璃时,它发现任务还没完成,会调整身体把手伸到窗外继续擦;东西放得太高,它会搬来旁边的箱子,把自己垫高;如果还是够不到,另一台更高的机器人会接着完成任务。任务中途被打断后,它们还能记住之前做到哪里,处理完新的事情再回来继续。
这些“自己想办法”的瞬间,来自一套和主流 VLA 不太一样的设计。
简单来说,VLA 更像是根据过去见过的数据判断“这种情况下一般该怎么做”,以太则想让机器人自己判断“为了完成目标,现在应该怎么办”。
它把任务完成度、物理约束、记忆和动作可行性等信息放进一个统一的 Energy 系统里,让机器人不断寻找更合适的行动方向。
于是,够不到就搬箱子、自己不行就换另一台机器人,不再需要人提前把每一种解法都写进去。
向前一步,它还给机器人加了一个Self Model。世界模型负责理解外面的环境,自我模型负责理解“我”:我的身体有多高、能做到什么、刚才做到哪里、这件事我到底能不能完成。也正因为如此,同一个“大脑”换到宇树和智元两个完全不同的身体上,仍然可以清晰判断自己当前的能力边界。
更激进的是自进化。以太提出通过 Evolution Manager,让自我模型和世界模型随着真实交互继续变化,从知识、技能、策略一路更新到所谓的“认知结构”。模型不只是在训练结束后出来干活,它在干活的过程中持续“成长”。
到这里,再回头看 OpenAI 十天后发布的那篇《An Alien Mind》,事情就开始变得有意思了。
Pachocki 同样把未来 AI 的重要方向指向 Recursive Self-Improvement,让机器越来越多地主导自身发展;他把越来越难完全理解的 AI 比作一个需要用类似神经科学方法研究的系统,还反复讨论模型进入陌生环境后的泛化、目标对齐和价值对齐。
当然,RSI、自进化、神经科学方法、对齐都不是什么乐享独占的新词,单拎一个出来都说明不了什么。让乐享觉得“不太对劲”的,是所有的概念全部撞在了一起,包括“脸”。
于是,9月10日,模型不再继续保持“神秘”。乐享正式认领 MVP,并公布学名 Aether 以太大模型,同时把双方材料摆到了一起,向 OpenAI 发出三问。
从里到外的复刻,OpenAI 竟成黏合怪
如日中天的 OpenAI,又一次被卷进原创性争议。过去围绕它的争议多发生在训练数据、产品功能和人才竞争上,这一次则更加直接。乐享科技把技术理念、“Alien Mind”概念和官网设计三件事一起摆上桌,公开问 OpenAI ——怎么哪哪都这么像?
先看最核心的,技术理念。
以太大模型提出通过 Evolution Manager,让“自我模型”和“世界模型”持续更新,从知识、技能、策略一路进化到“认知结构”,甚至能够“自我驱动产生学习目标”。到了 OpenAI 的《An Alien Mind》里,对应的关键词变成了 Recursive Self-Improvement,也就是递归式自我提升,让模型越来越多地主导自身的发展。一个叫 Self-evolution,一个叫 RSI,说法不一样,方向都指向同一件事,那就是 AI 不只等着人类训练,还要开始参与自己的成长。
神经科学概念也撞上了。乐享照着人脑搭 Aether,从前额叶、记忆系统、小脑一路做到“脊髓”,郭人杰称这是“用神经科学的方式,模拟人脑结构和意识的每一个部分”。OpenAI 则在文中写道,AI 更像是“生长”出来的复杂系统,人类可以“通过类似神经科学的研究”,去理解其中涌现出的微观机制。严格来说,一个拿神经科学造模型,一个拿神经科学研究模型,并不是一回事,但关键词又碰到了一起。
再往下看,对齐也有相同的既视感。乐享 7 月已经在官网里区分“目标对齐”和“价值对齐”,OpenAI 的文章随后同样提出:“将目标对齐与价值对齐加以区分是很有必要的。”
自进化、神经科学、Alignment 都是今天 AI 圈的热门议题。乐享觉得微妙的地方在于怎么自己刚把这几个词放进同一套下一代智能框架里,OpenAI 转头也端上来一套相似的菜单。
技术可以英雄所见略同,接下来连故事也撞上了。
乐享称,郭人杰早在 8 月中旬就已经用“星外来客”解释以太大模型,并在硅谷交流中把它描述成一种不同于人类、甚至可能超越人类认知方式的高维智能。9 月 6 日,OpenAI 首席科学家发出万字长文,标题干脆就叫《An Alien Mind》,正文还出现了“an alien intellect exceeding our own”—— 一种超过人类的异类智能。
一个叫“星外来客”,一个叫“Alien Mind”,发布时间还一前一后。乐享看完,大概只想问一句:“这么巧,连故事主角都撞上了?”
如果说技术概念容易撞,叙事也可以英雄所见略同,第三问就更加直观了,怎么连脸都有点像?
乐享称,以太官网比 GPT-6 Astra 官网早两个多月上线,整套视觉围绕宇宙、粒子和神经网络展开,粒子效果是核心设计语言。9 月 3 日 GPT-6 Astra 官网上线后,乐享干脆把双方页面截图摆在了一起,质疑从粒子视觉、页面结构到核心交互方式,都出现了不同程度的相似。
技术可以说是行业共识,“Alien Mind”可以说是不谋而合,但官网也长得像,事情就开始有点喜剧效果了。
为什么刚好是乐享
“机器人的 ChatGPT 时刻,就是要放弃 ChatGPT”。这是官网主页上的醒目宣言。
OpenAI 从语言往外走。ChatGPT 学会推理、写代码、操作电脑,再变成 Agent,模型越来越能独立完成任务,问题也随之变成 当 AI 开始参与 AI 研发、和其他 AI 协作,甚至递归式地改进自己,它最后还会只是一个工具吗?于是 Pachocki 开始谈 RSI、泛化、对齐,以及一种可能超越人类认知方式的 Alien Mind。
乐享从相反的方向走过来。
郭人杰此前长期在追觅做消费机器人和产品,创业之后想解决的问题也很具体,就是怎么让机器人真正进家。早期团队擅长的同样是机器人本体、运动控制和产品工程化,后来开始往“大脑”上补人,并持续完善六大技术板块的人才搭建。
公司陆续引入来自 Figure、Skild AI 等前沿具身团队的模型人才。今年 3 月,乐享又组建了一支约 20 人的模型团队,Aether正是在这之后开始成型。
在这个过程中,他们发现和训练大语言模型不同的是,真实世界没有标准答案,桌椅会移动,任务会被打断,同一句“把房间收拾干净”,每天面对的环境都不一样。
据公司披露,Aether 目前只有 4B,训练只用了约 200 小时人类视频,真机数据为 0。
训练核心也从“下一个动作是什么”变成了 Energy,旨在把任务目标、物理规律、记忆、风险和动作可行性放进同一个能量函数,让机器人自己寻找更合适的行动路径。
此外,乐享还加了 Evolution Manager。机器人每次和真实世界交互产生的新经验,都可以继续更新知识、技能和策略。主动感知、流式记忆、动力学控制和 Self-iteration 被塞进同一套闭环里。这个做法让机器人进入现实世界后还能自主进行“职业”学习。
关于刹车,乐享给出了答案
2026 年,跑在最前面的两家 AI 公司,Anthropic 和 OpenAI 先后发文公开讨论同一个问题—— AI 会不会很快开始自己造自己,以及到了那个时候,人类还有没有能力踩住刹车。Anthropic 的《When AI builds itself》甚至揭露了截至今年 5 月,Anthropic 合并进代码库的代码里超过 80% 由 Claude 自己编写。
技术史上有一个反复出现且有点吊诡的规律。最知道一项技术有多危险的人,往往也是最知道它有多厉害、因此最不可能彻底放弃它的人。
但到了乐享这里,同一种能力却被翻译成了完全相反的问题。
OpenAI 担心的自我改进、泛化和非人智能,恰恰是 Aether 主动追求,且目前已经初步实现的目标。乐享把自我模型、自我进化、跨本体和终身学习直接写进模型,再装进机器人里,让它在真实世界里不断碰壁、修正、继续学习。
所以一个有意思的错位出现了。当 OpenAI 在问这种智能真正出现,而人类该怎么办时,乐享已经选择先往前走一步,用行动试着回答这种智能到底该怎么长出来。