
去年看机器人视频,还是实验室里摇摇晃晃地走路。今年再看,机器人已经能叠衣服、搬箱子、在工厂里自己找活干。变化这么大,背后是一个叫具身智能的方向,我试着用大白话讲讲。
具身智能,说白了就是让AI不只在电脑里回答问题,而是有个身体,能看、能听、能动手。以前机器人靠程序员把每一步动作写死,换个环境就废。现在靠大模型,机器人看到什么、听到什么,自己决定下一步干什么,不用人教每个细节。
关键变化是2025到2026年出来的VLA模型,也就是视觉-语言-动作模型。它把摄像头画面和人类指令直接变成机器人的动作指令,相当于给机器人装了个会干活的大脑。特斯拉的Optimus、宇树的G1、智元的远征A2,用的都是这个思路。
价格也在往下掉。宇树G1的量产价已经到十几万人民币一台,比两年前同类产品便宜了一个数量级。国内一些工厂开始小批量试用,主要干搬运、分拣这种重复活。杭州一家物流仓的负责人跟我说,两台机器人顶三个夜班工人,一年回本。
现在最大的瓶颈是数据。机器人不像大模型可以拿互联网文本训练,动作数据要靠真机采集,慢而且贵。行业里都在搞遥操作采集:人戴着设备操作一遍,机器人把动作记下来当训练数据。这个环节谁效率高,谁就能跑在前面。
我的判断是,2027年具身智能会从能演示走到能干活,但离进普通家庭还早。想跟的可以从开源项目入手,宇树和智元都开放了开发套件,自己动手跑一遍,比看一百篇科普都明白。
还木有评论哦,快来抢沙发吧~