一周时间,北京接连举办了两场机器人大会:2026世界机器人大会(8月19日至23日)和第二届世界人形机器人运动会(8月22日至26日)。相较这两年在京举行的人形机器人半程马拉松比赛,这两场大会让人更加关注:具身智能究竟能不能从实验室走出来,当个“可靠打工人”?我们请科普作者王青岷来聊聊这个话题。

“秀技术”“验场景”的接力
这两场大会可以通俗理解为:世界机器人大会负责“仰望星空”,展示技术可能性;世界人形机器人运动会负责“脚踏实地”,验证场景实用性。
世界机器人大会是机器人“能做什么”的技术“阅兵场”,既有机器人大模型、多款人形机器人集中首秀,也在释放产业方向信号。
再来看世界人形机器人运动会,共吸引666支赛队参与,设置51个赛项,推动机器人从“能表演”走向“能实用”,场景赛重点攻坚人类生产生活中的“乏(枯燥)、脏、险、难”场景。运动会还专门设置了“灵巧手”专项赛,检验机器人的“手”是否灵巧。机器人能完成粉末称量、镊子夹豆、开瓶撬盖、整理图书等任务,证明国产人形机器人已从粗放的摆臂行走跨越到“看得清、拿得稳、做得准”的微米级手眼协同阶段。
总的来看,这两场大会构成了中国机器人产业从“技术驱动”向“场景驱动”转型的关键闭环。无论展示的是机器人的“决策智商”,还是复杂环境生存能力,本质都是“大脑”(决策)与“小脑”(执行)的协同进化。
“大脑”解语义 “小脑”控毫厘
机器人“大脑”是指具身智能大模型和中央处理系统,负责解决“想干什么”的问题,让机器人从按固定程序动作进化到听懂人话、看懂环境并自主决策。“大脑”依靠四层能力来工作。
一是语义理解与任务拆分
比如,当人说“我有点饿了,拿点吃的”时,“大脑”先用大语言模型把指令拆解为逻辑链:找冰箱、开门、辨熟食、取馒头、关门、交给人,再转化为分布动作指令。
二是多模态空间感知与对齐
“大脑”集成多模态大模型,把视觉、文字、空间几何信息融合:机器人“看”到冰箱时,于毫秒级完成三维语义建模,不仅能认出冰箱是装食品的器具,还能计算自身到冰箱的三维坐标,规划行走路径。
下一篇:工业型光排管暖气片