晚点聊 LateTalk 的嘉宾。

127: 与真格戴雨森 25 AI 中场复盘:OpenAI的IMO金牌、Kimi K2翻盘、Agent普及和抢人大战
2025年7月21日 · 1:54:55
本期《晚点聊》中,主播程曼祺与真格基金管理合伙人戴雨森复盘2025年年中AI进展:OpenAI用未公开的通用大语言模型首次达到IMO国际奥赛金牌水准(6题做对5题),戴雨森认为这验证了推理时扩展定律、说明强化学习也能攻克难以验证的证明题,被OpenAI研究员Sébastien Bubeck称为'登月时刻';而OpenAI的ChatGPT Agent虽不惊艳,却标志Agent形态成为共识,也证明'壳'(应用)的价值被低估——模型进步与应用进化可能都在加速。他提出应用价值三层论:模型只提供底层智能,Context(组织与个人上下文)和环境工具须由应用提供,这正是Manus、Genspark等创业公司的机会。 他盘点各家公司走向:K2(月之暗面)已是目前最好的开源模型,OpenRouter编程类目调用量几天内从第10升至第5;DeepSeek R2要等新基模V4;字节Seed分设Edge、Focus、Base;Google回归第一梯队,Anthropic自造Claude Code加入应用层。被高估的是机器人进厂速度——特斯拉已下调Optimus产量预期;被低估的是模型能力进化速度、应用价值与优秀团队韧性。他还谈到硅谷抢人大战由Meta主导、腾讯成国内挖人最猛者,并预计Agent应用需要新的L3原生模型,以自己每月近1000美元的AI订阅费说明生产力场景token消耗将远超娱乐类。 面对未来,他持续好奇如何衡量智能边界——当模型已能解决IMO证明题、HLE得分从年初个位数涨到20多分,人类的评估体系正在失效;他也担心效率与公平的张力:当个人拥有巨大生产力,人与人差距会被急剧拉大。他推荐契合AI创业者心态的游戏《33号远征队》,并说自己年内最想验证的是L3模型能否让Agent任务一次做到七八十分以上。

106: 与真格戴雨森长聊 Agent:各行业都会遭遇“李世石时刻”,Attention is not all you need|Agent#1
2025年3月9日 · 2:11:50
真格基金管理合伙人戴雨森在《晚点聊》中与曼琪、小晚长聊AI行业,认为OpenAI o1和DeepSeek R1是改变格局的两大节点:o1用强化学习开启后训练与测试时计算的Scaling Law,R1以开源和极低成本证明RL路线可走通,两者叠加推理、编程与工具使用能力提升,使Agent在2025年迎来爆发。他将AI超过人类能力的时刻称为“李世石时刻”,断言各行业都会经历,并指出“Attention is not all you need”意味着从争夺注意力的经济转向无需注意力的自动执行,解锁“工作的Scaling Law”。他判断Agent首批PMF在DeepResearch类的只读研究,再演进到可写操作和多Agent协同,成本下降必然发生,200美元月费的ChatGPT Pro与500美元月费的Devin“两瓶茅台价格体验未来很划算”。谈及DeepSeek开源,他认为其清场效应使多数“六小虎”掉队,月之暗面是少数仍能冲击前沿的创业公司,并分析了腾讯接入、字节不接的取舍,以及算力需求结构变化可能冲击英伟达。他个人为AGI准备包括投资早期团队、锻炼身体,并推荐《智能简史》与《第一只眼》。
由 PodHood 提供支持