合肥发布了一款叫"凌枢"的人形机器人,主打一个词——"一脑多态":一个AI大脑,能驱动不同形态的机器人在多种场景里干活(新华网、科技日报均有报道)。这个词听着玄,但它背后牵出一个普通人也越来越常听到的问题:现在的机器人到底是怎么"想"的?它和我们聊天的AI是同一种东西吗?这篇就把"一脑多态"和"具身智能"拆开讲清楚。我们此前聊过宇树那家做机器人的公司,从它的招股书里看出过一些反常识的事(我翻了一下午宇树科技的招股书,发现了一个反常识的事),也复盘过它上市申购背后的真相(中一签能赚20万?宇树申购背后的3个真相),这篇接着说机器人"大脑"这件事。
一、什么是"一脑多态":一个大脑怎么管多个身体
要理解"一脑多态",先看传统机器人怎么干。传统工业机器人是"一个身体一个程序":机械臂焊汽车,程序写死,换个活儿得重新编程,换个身体就歇菜。"一脑多态"反着来:把"大脑"(AI决策中枢)和"身体"(机械结构)拆开,大脑是通用的一套,身体可以是机械臂、人形、轮式、四足里任意一种,大脑根据当前身体的能耐去规划动作。
打个比方:同一个人,开叉车、骑自行车、走路,用的是同一个脑子,但脑子会根据"现在身体是叉车还是自行车"调整动作策略。"一脑多态"就是让AI做这个"脑子",一套算法适配多形态身体。它的好处是边际成本低——给机器人换身体不用重写大脑,新场景能快速复用已有智能。凌枢强调"跨场景集群作业",逻辑就是这套大脑能调度多种形态的机器人一起干活。
二、具身智能和聊天AI什么关系
很多人把"机器人AI"和我们聊天的AI(大语言模型)当成一回事。有联系,但不完全一样。
- 聊天AI:只动嘴。输入文字,输出文字,它不接物理世界,说错了顶多回一句笑话。
- 具身智能:要动手。大脑不光要"懂"任务,还得把任务拆成物理动作——伸手多远、用多大力、碰到障碍怎么绕——身体执行后还要把结果反馈给大脑再调整。
所以具身智能=大模型(负责理解和规划)+感知(视觉、力觉、位置)+运动控制(让身体真动起来)+反馈闭环(动了之后看结果)。大模型是它"大脑"的一部分,但不是全部。这也解释了为什么机器人比聊天AI难做得多:聊天AI说错话改一句就行,具身智能判断错一个动作,可能撞了人或摔了东西。这也是"一脑多态"的难点所在——大脑要能在多种身体、多种场景间迁移,不能只会一招。
三、边界:机器人大脑离"通用"还远
三件事得说清楚,别被演示视频带跑:
- 演示场景≠日常场景:发布会上机器人行云流水,往往是在预先调好的环境里。换到真实家庭、工地、仓库的非结构化环境,表现会打折。看机器人大脑水平,要看它在"没见过"的场景里怎样,不只是看它演得多顺。
- "一脑多态"还做不到任意迁移:现在能做到的,多是同大类身体之间(比如不同尺寸机械臂)的复用;让人形、四足、机械臂共用一套大脑还很难——身体差异太大,迁移要重新训练适配。"一脑多态"是方向,不是已经到顶。
- 它不替代人的判断:机器人能干的是"结构化、重复、危险"的活,碰到要临场判断、伦理、复杂决策的,仍要人介入。把具身智能当"替人干危险重复活"的工具,不当"通用替身"。
具身智能确实是这两年最值得跟的方向之一,但跟的姿势是看技术落地到哪个真实场景、解决了什么重复活,而不是看哪家演示更炫。"一脑多态"这套思路——大脑和身体解耦、一套智能多身体复用——是个清楚的技术方向,至于是不是"颠覆",要看它在真实场景里跑得稳不稳,这个只有时间能给答案。
(本文为技术科普,不构成对任何企业或产品的投资建议;文中凌枢机器人及"一脑多态"表述依据公开新闻报道,技术细节以企业公布为准;机器人能力边界描述为行业普遍共识,具体产品表现以实际为准。)
Q: "一脑多态"是不是说一个AI能控制所有机器人?
不是所有,是"多"种。现在的"一脑多态"多指一套AI大脑能在同大类的多种身体之间复用(比如不同规格的机械臂、或同系列的人形机器人),通过大脑与身体解耦,换身体时不用从零重写智能。但让人形、四足、机械臂这类差异很大的身体共用一套大脑,迁移难度很大,目前还做不到"任意身体通吃"。"一脑多态"是降低边际成本的技术方向,不是已经能覆盖所有形态。
Q: 具身智能的机器人和聊天AI用的是同一个模型吗?
不完全是同一个,但有关联。具身智能的"大脑"通常以大模型为基础(负责理解任务、规划步骤),但要加上感知模块(视觉、力觉等让它能感知环境)和运动控制模块(把规划变成具体动作并执行),还要有反馈闭环——身体动了之后把结果反馈给大脑再调整。聊天AI只处理文字输入输出,不接物理世界。所以大模型是具身智能大脑的一部分,但具身智能还多出"感知—运动—反馈"这一层,比纯聊天难得多。
Q: 普通人需要懂具身智能吗?
看你怎么用。如果你只是用AI聊天、写东西,不太用专门懂具身智能。但机器人正从工厂走进家庭、办公、公共服务,未来你大概率会碰到"机器人帮你干事"的场景——服务机器人、配送、清洁、陪护。懂一点"具身智能=大脑+感知+运动+反馈"的基本框架,能帮你判断那些机器人宣传视频里哪些是真本事、哪些是演的:重点看它在"没预先排练"的场景里表现,而不是只看演示多流畅。这和挑任何AI产品一个逻辑:看真实场景,不看舞台效果。
💬 评论