在 晚点聊 LateTalk 中提及的产品。

178: 与田渊栋聊 RSI:模型自进化如何到来?
2026年8月7日 · 1:29:02
田渊栋做客《晚点聊》谈他联合创立的 Recursive SuperIntelligence(缩写同为 RSI)如何让 AI 自我进化:这家公司刚完成6.5亿美元融资、估值超46亿美元,他认为 RSI 比 coding agent 大得多,完全自动化短期不会到来。他讲述从去年用 GPT-5 合写论文到决定创业的过程,称模型已强到「不用再招实习生」,并对比十年前 AutoML:现在大模型能理解 AI 本身,搜索空间不再由人定义。关于公司6月初的 First Steps,他说系统在 NanoChat 的 BPB 与 Speedrun、英伟达 SOL-ExecBench 算子优化上取得 SOTA:Speedrun 比社区两年成绩再快约两秒,算子优化比专注 GPU 的以色列团队 Double AI 高10%;他也评价 Anthropic《When AI builds itself》更多是提效而非递归自进化。对「领先者会越甩越远」的假设,他提出变量:智能提升可能是阶梯式跳跃而非平滑曲线,若 scaling law 不是全部,初创公司仍有空间;他还谈到大公司超过150人后变慢,RSI 目前缺数据、算力与可解释性。他坚持可解释性是关键,相信 AI 研究终将变成科学,但承认这是少数派观点。

134: Meta AI人才动荡,上亿美元为何留不住人?| 与Pokee AI朱哲清盘点 AI 组织
2025年9月23日 · 1:20:24
本期节目与Pokee.ai创始人朱哲清(前Meta应用强化学习负责人)复盘Meta AI人才动荡:Meta以143亿美元收购Scale AI并天价挖人,但9月离职潮显示组织问题才是关键。朱哲清对比Meta、Google、OpenAI、Anthropic的组织特点,认为Meta因层级臃肿、分功不均导致人才流失,而OpenAI和Anthropic以使命驱动和精简规模更吸引顶尖人才。他表示顶尖AI人才最看重成为AGI核心贡献者,工程型人才决定2-3年发展,科学家型决定10年。他还给出AI原生组织建议:网状结构、任务抽象化、信任优先,并预测明年资本市场冷却将影响人才竞争。最后以斯坦福学生“上完课能否做出sota模型”的提问,批评当前AI教育浮躁。

113: 秘塔闵可锐1:回到故事开始,那些「神预言」
2025年5月5日 · 1:56:09
2023年3月大模型热潮初期,秘塔科技创始人闵可锐断言,中国VC很可能会集体错过最有雄心的中国大模型创业者,并分享了他对预训练范式、创业选择及行业格局的观察。他回顾了从复旦、牛津到伊利诺伊博士辍学,经历波森数据、猎豹后于2018年创立秘塔,因看好大规模预训练而选择法律翻译切入,理由是人比机器更贵。他认为预训练本身才是范式转变,Transformer并非关键,GPT-3只是把规模推到工业界不敢想的地步,并非新架构;AI应用已进入个人开发者、创业公司和大厂所有人PK所有人的战国时代,AI Native的突破很可能在交互。他提到秘塔写作猫注册用户超700万,付费率2%-5%,公司总成本小几千万元且已能自给自足;但热潮对秘塔并非全是好事,财务投资人因担心与大厂直接竞争而谨慎,战投反而更积极。他批评研发投入95%是浪费且不知浪费在哪,OpenAI的关键是找到会花钱的少数研究者并给他们大量资金;中国投资仍循着大佬站台的传统思路,可能错过真正能干事的人。他还预测未来半年厂商将密集发模型但热潮不可持续,拿不到正反馈的团队会速生速死,并会出现二手A100;开源是另一股力量,但真正千亿级开源模型并不多,中国团队多为微调。

80: OpenAI o1 来了!与硅流袁进辉聊 o1 新范式和开发者生态
2024年9月16日 · 1:40:20
本期《晚点聊》邀请硅基流动创始人袁进辉解读OpenAI o1:o1以强化学习、思维链与test-time compute的组合,突破了大语言模型在逻辑推理上的瓶颈,数学、编程和科学任务能力大幅提升。袁进辉认为这三项技术单独看都不是新idea,OpenAI把Alpha家族验证过的强化学习方法搬到大语言模型上,胜在组合,并验证了从train scaling law到inference scaling law的新范式;训练端用合成数据、推理端多次调用模型都会增加算力需求,但国内基础模型训练收缩,GPU短期有冗余、租金下降。从API定价看,o1每百万token约数十到上百美元,是4o的数倍到十倍,目前还不支持函数调用、流式传输,推理时间也长,但这些都可优化;而推理能力的提升让Agent范式更有望跑通。袁进辉还以硅基流动的一线数据反驳“AI应用降温”:大量小微企业和个人开发者正基于开源模型做应用,只是不在传统VC视野里,他称已有应用每天调用数亿至十亿token、每周活跃数十万;海外调用最多的是Meta的Llama,国内是阿里通义千问和幻方DeepSeek,千问胜在版本齐全,DeepSeek编程能力突出。他也不认为o1会改变大模型公司持续收敛的趋势,因为技术扩散和边际收益递减的逻辑未变。
由 PodHood 提供支持