在 晚点聊 LateTalk 中提及的公司。

172: Momenta IPO后再访曹旭东:就是想做没有尽头的AI
2026年7月15日 · 2:03:20
在Momenta上市后,创始人曹旭东接受《晚点聊》专访时表示,高阶智驾竞争已趋终结:Momenta与华为两家合计占据第三方城区NOA约90%市场份额,拥有明显定价权,改变格局的窗口正在关闭,中国最终只有两三家、全球三四家供应商。曹旭东断言智驾已从“好玩的玩具”变成“好用的产品”,在购车决策中的权重升至第四位,仅次于价格、外形和空间,并认为未来每年十倍的技术进步会在2028年使智驾达到人类水平,成为must have;公司据此规划2027年打平、2028年盈利,研发投入将从今年的2亿美元增至明年4亿、后年6亿美元,上市的核心目标是建立品牌和信任。面向下个十年,他推演家庭机器人在2030年前后进入规模化拐点,认为量产智驾、RoboVan/RoboTruck/RoboTaxi与机器人共享“世界模型”底座,因此将于2027年正式投入具身智能,并选择自己做本体设计而非纯平台模式,还以“RoboVan>RoboTruck>RoboTaxi”排序了无人驾驶各场景的商业前景。他还回顾了自己从学物理到微软亚洲研究院师从孙剑、再到商汤和创立Momenta的经历,强调“数据驱动”的信念来自他见过真正work的产品都依赖海量数据,以及孙剑教会他重视实验中的异常现象,即“聪明人下苦功夫”。他解释了Momenta“一个飞轮两条腿”战略的由来和“主线积累、主线合力”等研发原则,并称自己判断力来自长期思考、反复讨论和到一线获取一手信息,最后以“狐狸知道很多事,刺猬知道一件大事”概括其长期主义。

165: GEAR 高深远:世界模型、自进化循环、DreamDojo
2026年5月18日 · 1:49:03
本期嘉宾是即将加入英伟达具身智能实验室 GEAR 的研究者高深远,他与主播程曼祺系统梳理了世界模型的分类、瓶颈与未来,并详解了他参与研发的世界模型 DreamDojo 和世界动作模型 DreamZero。节目按世界状态表征将世界模型分为几何、显式3D、隐空间和视频四类,高深远最看好视频世界模型,因为数据丰富、可端到端训练、能继承互联网视频的泛化能力;世界模型的核心价值是服务策略——用于测评、生成数据和突破物理时间限制的强化学习,但当前难以横评,因为各家机器人本体和动作空间不同。DreamDojo 从4.4万小时人类第一人称视频中迁移泛化能力,用隐式动作(Latent action)免去动作标注,把视频预测做到实时,并自建6个 benchmark 评测物理模拟和动作控制能力;DreamZero 则是以视频为骨干的策略模型,被视作可能取代 VLA 的世界动作模型(WAM)。高深远描绘了由世界模型、策略模型和连接二者的 Agent 组成的自进化循环,认为今年可能初步跑通,未来5年或成爆点;他还对比了 DeepMind 的 Genie-SIMA 与 Nvidia 的 DreamDojo-DreamZero 等竞争格局,指出当前最大瓶颈是物理模拟和动作控制的泛化,以及长程稳定性和效率。此外他提到 OpenAI 的 Sora 团队已重组到 robotics lab,并认为通用基模路线(如 Anthropic、AMI)最终也可能解决具身问题。

159: 马斯克Terafab太空算力、英伟达重拾CPU|与Fusion Fund张璐聊AI算力新趋势
2026年4月7日 · 1:05:04
本期《晚点聊》邀请Fusion Fund创始合伙人张璐,解读马斯克Terafab超级算力计划与AI基础设施新趋势。张璐认为,马斯克联合特斯拉、SpaceX和xAI自建1TW年产芯片厂,核心动机是摆脱监管、掌握算力自主权,但太空数据中心面临辐射、发射与维护成本高昂,短期不可行,更现实的机会是做AI基础设施与太空基础设施。节目还分析了英伟达GTC发布:黄仁勋正把公司从GPU厂商转向全栈AI工厂,重拾CPU以应对Agent和推理需求,并快速整合收购的Groq LPU;Google TPU虽强,但第三方难以复制其系统优化优势。张璐观察企业级AI市场,看好医疗、金融行业应用,并提及收购退出与连续创业者生态。

157: 与陈哲的「具身季报 26Q1」:宇树招股书、人形再思考、英伟达世界模型、高自由度灵巧手
2026年4月2日 · 2:06:07
陈哲(Alphaist Partners创始合伙人)与程曼祺在本期《晚点聊》盘点2026年Q1具身进展——宇树春晚表演、Sharpa灵巧手、英伟达DreamZero/DreamDojo、银河通用人形打网球、波士顿动力电动Atlas——并断言前沿正从VLA转向世界模型和触觉操作。陈哲认为,世界模型以视频生成为底层、取代以文本为核心的VLA,理论天花板更高,但算力消耗极大,注定大厂主导;英伟达EgoScale数据框架用2万小时自中心数据补全金字塔中段。灵巧手则是创业公司机会:Sharpa的System2/System1/System0架构把触觉引入高频控制,有望成为类似G1的全球科研默认选择。他评价宇树G1以63%毛利和5,500台出货定义科研市场,人形占收入过半,但研发投入仅9,000多万元,智能大概率长期跟随;Optimus Gen3延期,绳驱灵巧手量产和1万台年目标仍激进;波士顿动力Atlas用模块化电机和左右腿互换突破人体限制。对双足价值,他用Stretch对比说明人形在动态重心和占地上反而更优,银河通用网球则拓宽了实时交互的想象。他还判断,从云端到车载再到机器人,英伟达统治力递减,地平线、地瓜已主导量产机器人芯片;中国估值超100亿元的具身公司超20家,宇树上市是高质量公司而非泡沫,但市场仍需吸收。

155: 至简动力贾鹏:从英伟达到理想,具身智能的六边形战士
2026年3月22日 · 2:47:50
本期访谈至简动力创始人兼CEO贾鹏,他此前是英伟达中国智驾团队第一位员工、理想汽车自动驾驶技术研发负责人。节目完整回顾了他从英伟达服务L4客户到转向量产,再于2020年加入理想、带领团队从有图切无图并完成端到端双系统交付的十年经历。2025年年中他创立具身智能公司至简动力,与理想前CTO王凯、前智驾量产负责人王佳佳搭档,成立半年融资20亿元人民币。他认为具身智能竞争本质是体系竞争,公司要做技术、战略、产品、品牌、组织、商业都强的“六边形战士”。他提出硬件远未成熟、合成数据有用但非主力、模型应走向生成理解一体化、组织要简单且以项目驱动等判断,并分享了对行业从To A转向To B阶段、具身终局是分散垄断等观察。

148: 它石智航陈亦伦:具身的三道曙光和第一道关卡
2026年1月16日 · 1:25:02
本期嘉宾是它石智航创始人、华为前自动驾驶首席科学家陈亦伦,他向晚点主持人程曼祺提出,具身智能已有三道曙光——强化学习解决运控、大模型做任务规划、端到端解决极端案例,但行业仍卡在第一道关卡:数据。他以当年华为用3万行代码替代200万行代码、2021年做出国内最早端到端自驾的经历说明,算法结构最终会归于简单,GPT最伟大的是“预测下一个token”的训练任务而非架构;三道关卡依次是数据、算法和后训练。具身数据应来自真实场景和真实动作,数据只有世界与人两个源头,他不看好仿真和视频数据,手套加第一视角摄像头比遥操更高效、成本更低,它石已采集约10万小时数据并预言2026年数据大爆发。他还区分了VLA与世界模型的不同用途——前者应对开放世界任务,后者应对与车辆行人交互——认为具身应有自己的基础模型而不是在LLM上长出头;他说端到端虽是行业人人都在说的主流方法,但关键是做出惊艳效果,并判断具身已到Scaling临界点,2027年会出现类似自驾2021年的时刻。落地方面,它石瞄准工业制造中的柔性线束装配;陈亦伦认为具身领域充满硬件、场景、本体、数据与算法的交替组合与协同优化,中国供应链和场景优势会让美国创业者不构成竞争对手。

145: 极壳孙宽:首个「消费级外骨骼」的诞生
2025年12月17日 · 2:08:29
本期《晚点聊》对话极壳(Hipershell)创始人孙宽,讲述这家起步时没有风口的公司如何做成全球首个消费级外骨骼:从一人公司手搓原型、账上只剩20万元人民币,到今年融资7000万美元、出货数万台。孙宽回顾了童年DIY、大学做光固化3D打印机、参与水滴字幕商业化和内部创业模块化PC,后因误诊陷入死亡焦虑,决定回初心攻读外骨骼研究生,2021年创立极壳;创业初期见大量投资人被质疑,只有奇迹创投给了第一笔钱,最艰难时联创抵押房产,靠众筹获得数千台订单才撑过难关。产品策略上,他坚持只用一个开关按键倒逼AI足够好用,为此推倒第一代单电机方案改做双电机,正式交付的Hypershell X重约2千克、续航17.5公里,让沃尔玛推车小哥日行7万步,也帮人重返户外;用户反馈推动软件每两到三周迭代一次。团队从1人扩展到200多人和4位联创,成立到第一款产品交付花了40个月,而第二代Ultra从立项到上线仅4个半月,续航提升至30公里、重量降至1.8千克;但供应链曾因贴错CE标签损失一笔巨款,倒逼团队引入流程和数字化管理。关于跨越鸿沟,孙宽认为要从户外人群切入以营造“酷”的品类心智,通过自研降本把价格降到现价的1/2至1/3,并拓展到更多形态(如上肢外骨骼),同时以更快迭代应对涌入的竞争者。最后他分享创业治好了自己的死亡恐惧,并展望广义外骨骼最终是让身体可编程、增强人的自由意志,让人与真实世界的连接更大。

128: 小众AI场景拿到10亿级收入:测测任永亮首次讲述14年创业史
2025年7月30日 · 1:17:27
本期《晚点聊》对话测测创始人兼CEO任永亮,讲述他从北大医学部预防医学专业转做程序员、因个人情感问题在2011年创立测测的14年创业历程,并首次详细拆解测测从工具型社区、双边服务平台到AI对话机器人的四个发展阶段。任永亮透露,测测现有5000万注册用户,80%为女性、80%来自一二线城市,公司长期自给自足,他拒绝了外界的高价收购要约,为的是用现金流支持现在投入巨大的陪伴机器人业务;这款机器人预计明年面世,成本不低,核心是主动交互和情感陪伴,对标日本LOVOT,试图通过产品形态激发催产素而非多巴胺,打破短视频式的沉迷循环。他还分享了对泛心理赛道的独特理解:MBTI是自我认知工具,星座、生辰本质是太阳历周期假说,人是一个对初值敏感的混沌系统,这些体系只解释了一小部分规律,之所以人们总想'测测'自己,源于智人寻找确定性的本能。对AI趋势,任永亮明确表示悲观,认为大模型不会像前几次工业革命那样创造新的分工和分配体系,反而会替代工具化岗位,让多数人失去价值感,因此测测想成为'精神避难所'。他同时透露,自己因错过GPT-2而极其后悔,如今把机器人项目视为'有科学家执念的不理性选择',并借用李想的经历表达80后创业者在大风口到来时想做更大事情的心态。节目最后,他留下一个开放式问题:这个世界到底是否可被计算,能否在爱因斯坦的质能方程中加入信息维度——这也是他高中以来一直思考的困惑。

124: 理想前总裁的没苦硬吃,沈亚楠怎么花5亿给中国中产造家
2025年7月9日 · 1:54:14
本期《晚点聊》对话理想汽车前联合创始人、总裁,现栖息地创始人兼CEO沈亚楠,讲述他离开理想后把“一号位创业”作为唯一选择,自掏5亿元用造车式产品化打法做一体化智能住宅,而非传统装修。他复盘了今年2月发布的39.98万元L32旗舰三居产品:业内曝光破纪录,但C端到店只到千级、比预期低一个数量级,最大瓶颈是品牌沟通;他正重新梳理“幸福的家”的三层定义——美好关系、自然优雅美学、健康舒适,承认之前一直“直男式”地只讲空气、光、水等第三层。交付上,他对比“攒机”装修的过程失控与结果不确定,解释栖息地如何用模块化研发定制化交付、人料协同物流和施工班组激励做到省心,目前已有1000个用户、600个在施、100多户入住。他还把Home Depot(4000亿美元市值、占美国居住改善市场20%)当作终局参照,称中国5万亿家装市场应能长出万亿收入的公司,理想情况下再跑10年,并谈到未来通过减少中间环节把价格从40万做到25万。最后他承认自己付出过“天真”的代价:低估行业基础素质、迷信产品主义而忽视品牌空气,导致状态晚了三个季度;现在他把策略从“干掉所有人”转向无限游戏,与装企、工作室生态合作,并希望捕捉文化自信、审美升级这些时代情绪。

117: 印奇的AI创业14年:所有不能闭环的辉煌都是暂时的
2025年5月20日 · 2:06:50
本期嘉宾是千里科技董事长、旷视创始人印奇,他在37岁、AI创业14年之际总结从旷视到千里的转变,核心判断是“所有不能闭环的辉煌都是暂时的”,商业闭环和ROI优先于单纯技术信仰。他解释了为何在继续推动旷视上市、大模型创业和入股力帆(后更名千里)三者中选了最后一项:力帆经历破产重组和吉利三年清理后没有历史包袱,吉利能成为AI+车的场景提供者与数据闭环支点,这不是绑定而是开放起点。技术路线上,印奇主张智驾走特斯拉式模型驱动路线而非华为式闭环供应链,认为中国智驾要回归基本功、提升模型化比例;VLA更属于具身智能,车的行为空间有限,概念被超卖。他回顾了旷视在科创板等待三年多、两次上市受阻的近5年低谷,称这是组织成长最快的“蹲苗”期,自己将理念改为价值务实在前、技术信仰在后,并把研发与营销投入比从3:1、4:1调到1:1。他也判断智驾已到冲刺期,赢下需要数据体系、纵向整合和客户联盟三个体系,最后最多4家、可能3家留在牌桌,明年见分晓。5月补充访谈中,印奇把大模型周期视为深度学习的决赛环节,认为Super App需兼具上限与短期爆发力,将Agent分为工作、创作、生活、情感四类,判断未来18到24个月会出现引爆点。

112: 与千寻高阳聊具身:一个像机器人的人,怎么做像人的机器人
2025年4月29日 · 1:22:09
高阳(千寻智能联合创始人、清华叉院助理教授)直言具身智能必走端到端 VLA,并给出时间表:明年6月达L2,再一年半到两年达L3。他认为行业已从500个研究话题收敛到100个,这正是他选择创业的时刻——科学家能做的探索变少,工程化落地成为重心;千寻的配置是产业老炮韩峰涛加年轻科学家。他定义的L2是单场景多任务,为此机器人未必人形,但需双臂加轮式底盘,双足并不难;叠衣服是当前“智商测试”,难在理解乱态与泛化,而Figure 02展示了快慢系统的工程优势。数据方面,他提出具身Scaling Law,称做到GPT-3.5级需约100亿条有效互联网视频、1亿条遥操数据和数千万强化学习数据,而仿真数据因多样性有限不适用。他还解释为何要同时做大模型和本体——只做大脑缺乏跨具身肌肉记忆,只做本体则价值集中在大脑端;中国优势在于“修机器人快”,行业将在跑出L2/L3后收敛,当前瓶颈在AI而非硬件;商业化上现在应把技术做到GPT-4程度,L1场景已有人愿付十几万,L2会带来几何级数增长。个人层面,他回顾2016年与许华哲做端到端自动驾驶、伯克利归国经历,称自己从不熬夜、每天骑车31-33分钟,以COT式链条思考应对科研与创业。

96: 和楼天城聊 Robotaxi:学习人类优秀司机,让我绝望
2024年12月25日 · 1:27:58
楼天城在小马智行这次访谈中系统阐述了Robotaxi过去5年的技术变革:L4必须从“Learning by Watching”(模仿学习)转向“Learning by Practicing”(实践学习),以世界模型作为车端模型的训练环境。他提出多个反直觉判断:模仿学习最多只能“像人”,但人类对AI司机的双标要求使像人永远达不到L4;越是优秀的人类司机,越依赖超越传感器数据的经验与直觉,模仿其行为反而是“反向优化”;世界上不存在MPI(接管里程)为1000公里的L2产品,因为那要求人一个月接管一次且始终保持专注,违背人性。小马5年前因此彻底放弃模仿学习,转向生成式数据和闭环训练,从零追赶,前两年“没有任何进展”,承受了巨大压力;他强调决定自动驾驶能力上限的不是车载模型,而是世界模型这一“工厂”的精度。世界模型包括数据生成器、驾驶行为评估体系、高真实性仿真和数据挖掘引擎,其中交互模拟和细粒度指标是核心竞争力。楼天城还明确L2+与L4是两件事:L2以低成本辅助人为目标,用模仿学习没有问题,但无法跨越安全与人性的门槛,做得越好,距离L4反而越远。商业化上,他预计1-2年内可实现成本更优的千台级无人车队运营并转正毛利,净利则要到5万台;而特斯拉如果继续坚持Learning by Watching,转向实践学习仍需时间。

95: 工业设计师到底在干啥?
2024年12月19日 · 1:33:25
晚点LatePost旗下《晚点聊》主持人汉洋与工业设计师、产品经理志斌(播客《荒野楼阁》)在本期回答“工业设计到底在干啥”:它不是画外观,而是贯穿流水线量产产品全周期的思考方式,从产品定义、结构拆解、注塑水口、包装运输到回收都要参与。具体例子包括宜家平板式包装、塑料外壳的注塑“水口”隐藏、用超声焊接替代螺丝等;志斌指出工业设计本科分艺术类、产品设计类和重机械类三派,学校只打基础,真正能力要在工作中建立。他还区分了工业设计与产品经理:链路上工业设计夹在调研和结构生产之间,但越来越多公司让设计师转岗产品经理以衔接前后环节。谈收入时,挣得最少的工业设计师是没话语权、只当老板“转换头”的美工,挣得最多的是升入管理层做评审和决策的人;他评价红点奖因标准公开、可砸钱对标,只有Best of Best含金量可信,IF和日本Good Design更偏人文。聊手机时,他认为产品形态是逻辑的结果:iPhone 16没大变是受当下技术阶段限制,曲面屏是弯路;聊理想Mega时,他说它像电子产品设计师做的车,半包结构与汽车尺度脱节、差一口气未完成,而Cybertruck因用厚不锈钢和焊火箭工艺重构制造而激进。最后他解释新势力家族化设计语言并非先定死,而是随市场反馈和迭代周期快速筛选的流动过程。

86: We, Robot-2,清华叉院/星海图许华哲看“Optimus”的门道
2024年10月27日 · 1:05:06
许华哲(清华大学交叉信息研究院助理教授、具身智能公司星海图联合创始人)在《晚点聊》中从特斯拉We, Robot发布会的人形机器人Optimus谈起,阐释遥操作为何重要,并拆解通用具身智能当前的算法进展与创业选择。他认为这次丝滑的遥操作既是远程运力转移的实用价值,也为机器人提供高质量训练数据;从遥操到自主仍需海量数据和模型迭代。节目中他梳理了伯克利AI Research的强化学习传统、2019年ETH让机器狗爬山的标志性工作,以及自己用改进的PPO算法(BPPO)让机器狗在软垫上真实环境学习;他还区分了强化学习、模仿学习与多模态大模型的不同作用。关于形态,星海图选择轮式人形而非双足,是为了聚焦操作能力,因为操作才能改变物理世界、产生经济价值;灵巧手难度不亚于做好整个人形机器人,所以公司现阶段“力出一孔”做移动操作的本体、遥操作和智能。他也讨论了世界模型的定义争议(Sora为何不是、具备动作输入的视频预测才是)、触觉这一被忽视的模态,以及通用机器人面对的数据、模型两大瓶颈;他给出5年工厂大量部署、10年进入家庭的预期,并提醒机器人普及可能让人丧失部分决策权利。

84: 与侯晓迪聊特斯拉 We,Robot:烟雾与现实
2024年10月16日 · 1:08:36
Bot Auto 创始人兼 CEO、图森未来联合创始人侯晓迪与主持人程曼祺复盘特斯拉 We,Robot 发布会,认为马斯克的说法多为 hype:他称 Cybercab 每英里运营成本低于 0.2 美元,但仅电池折旧约 0.15 美元、电力和轮胎各约 0.05 美元,合计已超 0.2 美元,违背物理定律;没有方向盘和踏板更多是操控公众意志,而非技术进展。侯晓迪提出 L4 自动驾驶应统一以 CPM(每英里综合运营成本)为指引,并批评端到端被“意识形态化”:它在最优/平均场景表现尚可,但在最差场景不可解释、难以合规,无法用于 L4;他更认同“世界模型”是 David Marr 提出的中层视觉表征的延续。他还引用 Cruise CEO Kyle Vogt 在发布会前列出的 15 个运营要点,认为这些实打实的细节才是行业下一步需要解决的问题。他还认为特斯拉用 Model 3/Y“Airbnb”式接单短期不可行,责任归属无解;远程操控人车比从 1:3 走向 1:10 可能比外界预期更慢;L5 是永远达不到的地平线,L4 是要挣钱的产品。谈及再创业,侯晓迪表示已融资 2000 万美元,选择休斯敦是为贴近物流运营,并总结图森教训:不要过早扩张,重要的是利润而非收入,计划一年内让全 L4 功能车辆在休斯敦路测。

77: 不仅是车企的战争,与 Momenta 创始人曹旭东聊智驾供应商生存法
2024年8月11日 · 1:21:31
本期《晚点聊》访谈Momenta创始人曹旭东,他认为智能驾驶供应商的终局是721格局——第一名占70%,中国只剩两三家,胜者需垂直整合软硬件。曹旭东称,高阶智驾体验两年提升十倍,特斯拉FSD半年进化几十倍,最新V12已接近Waymo;Momenta与华为是客户主要对标对象,双方在上海、深圳各有千秋,北京、保定等城市Momenta泛化更好。目前Momenta拥有最多智驾车型定点,包括上汽智己、比亚迪、广汽,数量超过华为,与地平线、大疆、华为并称“地大华魔”。他认为特斯拉FSD入华是好事,会把竞争从卷价格拉回卷价值。他解释为何选择做Tier 1而非Tier 2,并与英伟达、高通同时合作覆盖纯电和混动;关于端到端,他提出“低成本短周期试错”的方法:先攻克深度学习规划,再合并感知,真正的难点是提升下限,并举了端到端模型从未定义过的清明烧纸火堆会主动绕行的例子。交付上,从智己400人一年半磨一个车型,到现在几个人半年交付。他还认为国际车企的合作窗口期已过,一个平台通常只选一家供应商,全球扩张必须解决地缘政治风险;他预判低水平竞争两年内结束,15万以上车型将在26-28年标配高阶智驾,未来头部公司每年云计算投入将达10亿美元。

67: 与《刚性泡沫》作者朱宁聊普通人保住财富:为什么多元化投资更好?
2024年4月25日 · 1:05:17
经济学家朱宁(上海交通大学上海高级金融学院副院长、清华大学国家金融研究院副院长)在《晚点聊》中提醒,不确定性时代普通投资者应把风险而非收益放在首位,通过全球多元化资产配置保住财富,并直言中国房地产的黄金时代已过。他结合自己2008年误入雷曼兄弟的经历解释,多元化不是为了更高收益,而是减少回撤、保护长期复利;他批驳“购房是刚需”十年,指出一线城市租金回报率仅1%-1.5%、香港约3%,建议多套房家庭多元化配置,并主张开征房地产税、实现租户同权以发展租赁市场。他对黄金和降息周期中的美债持正面看法,却持续质疑比特币,认为它没有基本面支撑,主要用途是洗钱和非法交易。他还判断美股已有泡沫迹象、欧洲经济难有希望,A股则受制于落后的发行交易机制和信息披露、公司治理问题。朱宁强调散户最伤钱的错误是不愿止损,需要用算法或同伴制约克服人性;面对未来,政府应建好教育、医疗、养老安全垫,个人应努力提升自身人力资本。

65: 信仰充值的威力:与逐际动力谌骅聊聊 GTC 和人形机器人新进展 | AI 大爆炸
2024年4月2日 · 1:03:20
本期《晚点聊》邀请逐际动力联合创始人谌骅,他坚定断言人形机器人的“小脑”(运动执行)能力如今已落后于“大脑”和硬件,是AI大爆炸中最值得突破的环节。节目从近期热点切入:Figure AI获得OpenAI、微软、英伟达、贝佐斯6.75亿美元投资,Diffusion Policy等生成式模型提升了机械臂操作的泛化性,让机器人能像人一样洗盘子而不需精确摆放。谌骅回顾自己从博士研究混杂系统最优控制到2022年联合创业的历程,对比波士顿动力自1992年成立以来坚持液压路线,认为起步太早反而受老技术栈拖累,几乎不可能产品化。他也分析中美人形机器人创业差异:中国因供应链优势先火且倾向软硬一体,美国更允许长周期探索,因而有Physical Intelligence这类只做大脑的公司;逐际动力因此同时做人形CL-1、四轮足W1和点式双足P1,以平衡商业化与前沿探索。他还谈到强化学习在机器人运动控制中的爆发发生在最近一年,与Transformer没有直接关系,但大模型带来的“信仰充值”让大家相信数据驱动方法可行;硬件瓶颈和灵巧手是下一步关键,英伟达Jetson在端侧算力领先,而他对机器人“叛变”持谨慎乐观。

64: 让奶牛猫跳洗澡舞,与阿里通义薄列峰聊多模态共识中的变量是什么?| AI 大爆炸
2024年3月27日 · 51:20
本期《晚点聊》邀请阿里通义实验室XR实验室负责人薄列峰,聊其以“数字人”为主线的多模态研究——包括让奶牛猫跳洗澡舞的Animate Anyone、一键换装的Outfit Anyone,以及用一段语音驱动蒙娜丽莎开口说话/唱歌的EMO;他的核心判断是多模态是大模型发展的必然方向,但“世界模型”如何实现仍是最大变量。面对Sora,薄列峰认为其60秒高质视频确实震撼,但视频生成和世界模型远未解决,业界对世界模型的定义也无共识;相比谷歌、字节的视频平台积累,他提示OpenAI可能还用仿真数据,数据问题仍有挖掘空间。他解释EMO与旧Talking head方法的区别:它不只对口型,语音会同时控制表情、眼睛、头颈和上半身,且是zero shot,任意照片加音频即可生成,这得益于大模型的容量。节目还复盘了他的跨领域经历:07年博士毕业时深度学习尚非主流,在Amazon Go用深度学习解决实际视觉问题后确认其效果最好,并由此理解AI与硬件结合;他认为机器人等物理世界AI进化慢,硬件自由度与能耗是长期瓶颈。他也讲了Animate Anyone接入通义千问后的用户启发:宠物跳舞比真人跳舞更受欢迎,上传狗的人比猫更多,团队为此优化了骨骼检测;现阶段免费开放更重视用户反馈与模型能力迭代,而非成本。最后他提出世界模型的未来变量:应能模拟因果而非统计关系,是否必须3D化、是否需要能主动与物理世界交互的实体智能体,都还是开放问题。

55: 从 0 到 470 万,与车云程里聊中国汽车出海大爆发
2023年12月27日 · 48:39
本期晚点聊由程曼祺主持,程里(车云网和电动邦创始人)作为嘉宾,核心论断是中国汽车出海已进入新能源车主导、敢闯欧洲日本且开始海外建厂的爆发期,今年出口预计470万辆、11月单月48万辆。节目从慕尼黑和东京车展见闻切入:比亚迪是东京车展唯一参展中国车企,王传福与丰田章男会晤——这家曾模仿丰田花冠的车企如今反向输出电动化技术,丰田章男路过比亚迪展台的照片也被热议;慕尼黑车展则有近60家中国企业参展。程里将出海分为三阶段:2005-2016年从法兰克福车展碰撞测试零分的“羞辱式”亮相到销量百万台以下徘徊;2017-2021年燃油车起势升至100-200万台;2022年后新能源车成为龙头,价格远高于国内并开始海外建厂。他分析了不同选择:新势力重欧洲电动化窗口——不过蔚来、小鹏三年前布局北欧后一度收缩,传统车企优先东南亚等基础市场,建厂通常需片区销量10-20万台才具经济性;理想明年去中东瞄准高客单价。程里认为窗口期长达十年,因产品远未稳态,智能化是最大变数;但软实力是短板,慕尼黑车展中国CEO普遍缺品牌表达,品牌文化需要时间积累,长城比亚迪油箱之争若在海外发生会更致命。他还提到上汽、奇瑞出口居前二,比亚迪布局最广但今年约20万辆排六至十名,大众、斯特兰蒂斯投资小鹏、零跑补短板。最终呈现的是车企CEO们的自信与焦虑:想抓住全球化机遇,又担心无法控制的地缘政治与竞争压力。

48: 与《马斯克传》总策划人聊新书:幕后故事和新英雄的诞生 ×【串台知本论】
2023年10月17日 · 56:44
本期《晚点聊》与《知本论》串台,程曼祺和孙冰洁对话中信出版社副总编辑、《埃隆·马斯克传》中文版总策划李穆,以艾萨克森这部新传记为线索,揭示了一个被英雄模式与恶魔模式共同驱动的马斯克,以及中英文版同步出版背后的国际版权博弈。李穆透露,2021年8月5日马斯克发推宣布与艾萨克森见面后,中信当天便出手锁定中文版权,首次实现中英文版同步于9月12日首发;作者直到8月15日仍在修订,最终交稿比预期多出8万字,出版过程惊心动魄。节目对比了《马斯克传》与2015年中信引进的《硅谷钢铁侠》:前者是典型人物传记写法,95章中有大量童年成长与原生家庭的细节,首次披露马斯克十几岁在父亲办公室读到火箭推进器书籍从而萌生火星梦想,并采访了200多人。书中还重点写到了安东尼奥·格拉西亚斯,这位投资人在特斯拉和SpaceX濒临绝境时多次出手,并告诉马斯克“让公司成功的不是产品本身,而是高效制造产品的能力”。曼琪分享了2013年伪装特斯拉车主与马斯克见面的“维权”经历,称马斯克用个人魅力让车主们忘了诉求;她也提出书中一个悖论:马斯克对坏消息的暴躁态度会让下属不敢汇报,但他同时经营SpaceX、特斯拉等多家公司仍决策成功。李穆还谈及马斯克收购推特后误关萨克拉门托数据中心的失误,以及20年来商业畅销书从早期经管方法到如今更契合宏观不确定性时代的趋势类书籍的变迁,并讨论了谁可能成为下一个乔布斯式时代偶像。

40: 通用机器人,AI 的下一个浪潮?
2023年7月27日 · 1:09:48
本期《晚点聊》邀请梅卡曼德创始人兼CEO邵天兰,讨论通用机器人(人形机器人、具身智能)热潮:大模型让这个目标从“登月”变成“攀登喜马拉雅山”,首次呈现可行路线,但机器人四肢的进化远慢于“大脑”,大概率出现“聪明的脑子、笨拙的四肢”。邵天兰描述,世界人工智能大会上特斯拉人形机器人仅是模型也被围观,英伟达、微软、谷歌、字节跳动、腾讯等都在布局;通用机器人必须能在物理世界操作交互,智能客服不算。他解释,今天机器人完成简单任务仍靠大量人工编程,深度学习只占小比例,比如制衣厂自动化缝纫机切换新品要编程两天,而订单一两天就生产完了,因此设备闲置;农夫山泉生产线几乎无人,因为产品常年不变,而咖啡店店员一小时可能干几十种杂事,机器人做不到;全球工业机器人年销量约50万台,仅在汽车焊接、物流搬运等稳定场景普及。大模型能带来常识和推理(如“热饭”与微波炉的关联),但手、腿、驱动器等机械部件十年进化可能不到一倍,而算力讨论单位十年进化100万倍、训练数据从1万张图片变成全网文本,所以机械是更大瓶颈;他寄望用AI在仿真中加速机械工程设计,让人一年两次的迭代变成一天千次。对人形机器人,他认为世界为人设计,人形因此是最佳形态;特斯拉Optimus若真做出能干活的第一台,是从0到1,比造电动车难得多。他还谈到酒店电梯已为送货机器人做无障碍改造,ChatGPT反而训练人更清晰地沟通,就业担忧可参考洗衣机、织布机的历史,通用机器人技术不会被一两家垄断,而会像电脑一样进入并重塑每个行业。

32: 最怕客户来参观的行业:和谈三圈仔细谈谈芯片
2023年3月16日 · 1:09:31
谈三圈(刚从德国一家汽车芯片大厂回国、B站科普UP主)与主播曼祺、汉洋在《晚点聊》中讨论中国车企自研芯片现象,核心论断是:汽车芯片技术门槛相比消费电子更低,真正的难点在车规认证与重资本投入,因此蔚来、小鹏直接冲击自动驾驶芯片,比亚迪、理想从功率半导体切入。三圈认为车企造芯的动因既有市场也有安全——中国新能源车体量全球最大,而2021年缺芯潮中几十元的汽车芯片曾被炒到几千元,供应链风险促使车企自研。他详解了一颗芯片从需求定义、设计验证、流片到封测的流程,并描述晶圆厂洁净室极端的洁净要求:一粒灰尘可能毁掉数百个晶体管,客户来参观一次可能让良率从98%掉到75%、损失数百万元。对比车规与消费级芯片,前者粗糙但鲁棒,需耐受-70℃到140℃和十年以上寿命,后者精密但脆弱;国内车企抢速度,有人6个月要求出SOP,而欧洲车企常需三年,车规认证流程因此成为短板,相关工程师需求极大。成本上,Fabless团队数百人一年人力成本大几亿元,建先进制程晶圆厂需数百亿美元,代工比自有工厂贵30%-40%,掩模版、硅片、封测都是额外开销。面对职业选择,三圈宁愿去芯片公司而非车企,因为芯片是AI、机器人等一切风口的共同基础设施。

14: 如果不要激光雷达车价打九折,你接受吗?与激光雷达资深从业者的对谈
2022年4月17日 · 1:12:04
本期《晚点聊》请到探维科技的激光雷达从业者Frank、主播汉洋与《晚点》编辑曼祺,核心判断是:车载激光雷达对把车当纯工具的消费者并不值,但它是自动驾驶不可或缺的硬件,而中国车企正因为本土产业链领先而成为全球最激进的搭载者。Frank认为,现在多数车型的激光雷达只用于自动泊车等低阶场景,比如小鹏P5选配的大疆旗下低线束雷达,要等OTA升级、辅助驾驶支持夜间和无图道路后才真正物有所值,所以他自己短期内不会购买。他详解了激光雷达贵的根源:早期Velodyne 64线原价7-8万美元,因手工组装校准、产能极低,二手曾被炒到100多万元;如今国内车企采购价已降至2000-5000元,但这是负利润抢市场。技术路线上,1550nm探测距离可达300-500米,却易被水吸收、稳定性不如905nm,蔚来ET7选1550nm更多是性能和宣传考量;他还指出人眼安全标准尚按激光测距仪设定,车载雷达扫射的长期影响没有定论。中国车企激进的原因包括本土公司在半固态雷达上领先全球、特斯拉视觉方案带来危机感,以及国内车规标准灵活;欧洲日本车企保守,法利奥过车规花了7年,而中国企业已推出百线以上产品。节目还复盘了Velodyne在2018年将尚处B样的128线雷达交付百度、最终大面积退货的故事,并展望激光雷达价格未来可能降至几百元、接近摄像头价格。

11: 封装、赛博神学与蒸汽波音乐:共识消逝年代的技术 × 孔德罡
2022年3月24日 · 1:25:12
孔德罡与汉洋在《晚点聊》中从汉洋的文章《一个被封装的未来》和苹果的闭源体验出发,将封装定义为一种现代性:技术被黑箱化、各专业壁垒不断加深,普遍共识在无人察觉中静默消融,连交燃气费的应用都只能签署协议或退出。他们以个人史对照了56kbps拨号上网、下载囤积症、排队买CD的Web 1.0时代与3G/4G智能机时代——汉洋曾在红灯的70秒内下载完导航软件;网络从需要精心准备的“第二人生”变为生活本身,数字移民与赛博原住民的体验彻底断裂。德罡解析蒸汽波音乐时指出,这类歌曲往往只是把经典采样拉长成氛围音乐,没人会从第一秒听到最后一秒;其采样、拼贴与字间空格的衍生文化挑战了当代版权体系,齐泽克在南京买盗版碟、国际歌下载付费等轶事,折射出平台以版权之名封装了自由获取资源的原始网络共产主义。经由艺术家孙小新提出的“赛博神学”,他将其比作但丁的贝尔特丽齐仰望上帝——现代人仰望互联网;赛博空间是待立法的新大陆,大公司已用用户协议充当神谕,用户没有解释空间只能同意或退出,因此需要争取自我立法、自述神谕的权利,这是悲观前提下的一种乐观。最终他给出存在主义的技术乐观:在被异化和悲剧性包裹的时代里,人仍能通过选择去掌握技术,如唐纳·哈拉维的赛博格女性主义以机械改造消除性别差异;他主张怀念过去的同时继续前进,因为前面也有美好,并透露自己在澎湃设有专栏、创作话剧。
由 PodHood 提供支持