112: 与千寻高阳聊具身:一个像机器人的人,怎么做像人的机器人
2025年4月29日 · 1:22:09
高阳(千寻智能联合创始人、清华叉院助理教授)直言具身智能必走端到端 VLA,并给出时间表:明年6月达L2,再一年半到两年达L3。他认为行业已从500个研究话题收敛到100个,这正是他选择创业的时刻——科学家能做的探索变少,工程化落地成为重心;千寻的配置是产业老炮韩峰涛加年轻科学家。他定义的L2是单场景多任务,为此机器人未必人形,但需双臂加轮式底盘,双足并不难;叠衣服是当前“智商测试”,难在理解乱态与泛化,而Figure 02展示了快慢系统的工程优势。数据方面,他提出具身Scaling Law,称做到GPT-3.5级需约100亿条有效互联网视频、1亿条遥操数据和数千万强化学习数据,而仿真数据因多样性有限不适用。他还解释为何要同时做大模型和本体——只做大脑缺乏跨具身肌肉记忆,只做本体则价值集中在大脑端;中国优势在于“修机器人快”,行业将在跑出L2/L3后收敛,当前瓶颈在AI而非硬件;商业化上现在应把技术做到GPT-4程度,L1场景已有人愿付十几万,L2会带来几何级数增长。个人层面,他回顾2016年与许华哲做端到端自动驾驶、伯克利归国经历,称自己从不熬夜、每天骑车31-33分钟,以COT式链条思考应对科研与创业。