晚点聊 LateTalk 的嘉宾。

171: 与Henry的「AI季报 26Q2」:从 coding 到 RSI,强者愈强的未来?
2026年7月1日 · 1:39:42
本期季报中,程曼祺与MoE Capital创始合伙人Henry Yin判断,行业正同时推进智能前沿(编码代理、RSI、物理AI)与智能扩散(企业自建模型、交互创新),强者愈强但开源追赶也在加速。OpenAI与Anthropic分别发布GPT-5.6和Fable 5,Anthropic因安全护栏与静默降智引发争议,OpenAI以免费抢客,Anthropic年收入预计达620亿美元,OpenAI约400亿美元。RSI成为热土:Anthropic长文称80%合并代码由Claude编写,Richard Socher、田渊栋的Recursive在三个benchmark取得SOTA,Mirendil、Core Automation等新团队涌现。物理AI上OpenAI官宣机器人团队,Anthropic考虑布局;MoE资本统计约100亿美元流向世界模型相关公司。智能扩散上,Harvey联合Applied Compute用GLM 5.1后训练出法律模型并超越前沿模型,GLM 5.2因低成本与兼容Claude Code在硅谷走红。交互创新包括Claude Tag、Record and Replay和Thinking Machines的边听边说模型;Meta推出Musespark但反响平平,Google以Gemini Omni展示多模态,xAI转向算力租赁并收购Cursor,Midjourney发布超声波CT扫描仪。

156: 与 Henry 的「AI季报 26Q1」:OpenClaw、OpenAI vs Anthropic的三重对阵、自进化
2026年3月31日 · 1:52:13
本期《晚点聊》26Q1 AI季报中,硅谷投资人、MoE Capital创始合伙人Henry Yin与主播程曼祺复盘了OpenClaw的爆红、OpenAI与Anthropic的三重对抗和AI自我进化等浪潮,核心判断是:编码智能体正从模型竞争转向系统与生态竞争。他们指出OpenClaw是“AI的iPhone时刻”——通过本地运行、接入聊天App、定时任务和长期记忆,它让AI真正“干活”,成为个人Agent的灯塔;但它也有成本高、不稳定和安全风险,例如Meta对齐负责人因上下文压缩导致安全指令丢失、被agent疯狂删邮件的“生死时速”。Henry还解释了OpenClaw为什么在中国比美国更出圈:飞书、微信等聊天优先生态和便宜的国产开源模型,让它与MiniMax、Kimi等形成天然组合。围绕OpenAI与Anthropic,节目对比了Codex与Claude Code、Opus 4.6与GPT-5.4,称Anthropic收入三个月从90亿美元增至190亿美元,Claude Code年化收入25亿美元超过Cursor的20亿美元,而OpenAI已内部反思“因支线任务分心”。他们还讨论了Andrej Karpathy的AutoResearch:AI在没有人类干预下自主优化训练代码,使GPT-2级模型训练时间缩短约20%,让自进化更贴近现实;同时探讨了持续学习(记忆vs权重更新)、世界模型和新的创业机会。最后,Henry分享了硅谷科技大裁员——Amazon裁1.6万人、Block裁40%、Meta计划裁20%且以全员Token消耗量衡量效率,并展望下季度DeepSeek-V4等看点。

146: Gemini 3翻盘背后、Agent需要什么大模型、RL创业机会|与前 Google 创业者、硅谷投资人聊湾区动向
2025年12月26日 · 1:40:58
本期嘉宾是 MoE Capital 创始合伙人 Henry Yin、Naomi Xia 与 Agent 工具层公司 Precur 联创戴涵俊、Bethany Wang,由程曼祺主持,从硅谷一线视角解析 Gemini 3 与 GPT-5.2 同期发布、Google 靠什么强势回归,以及 Agent/RL 创业机会。嘉宾指出 GPT-5.2 在 GDPval 上达 70.9%(前代 38.8%)、ARC-AGI-2 达 52.9%,且 OpenAI 今年发布的三个 benchmark 均由 Anthropic 模型得分最高,显示其将研究与营销分开。Google 的反弹被归因于 TPU、Infra、模型到应用和硬件的多层协同设计,以及 DeepMind 与 Google Brain 合并后的整合。创业层面,Precur 做“可训练工具层”,让工具从失败轨迹中自我强化,早期客户测试中正确率提升约 12%;RL 机会被分为 RL 环境(如所投的 Preference Model)、RL as a Service 和 RL 垂直应用(如 Periodic Labs)。模型选择上,嘉宾强调云绑定优先于性能,Claude Code 与代码驱动工具调用(PTC)正成为 Agent 核心范式,Qwen 是表现优异的开源模型,飞往 NeurIPS 的飞机上约 1/3 的人在读 DeepSeek-V3.2 技术报告。他们预测模型将向加入大量 agent trace 的开源模型、更强多模态和长程任务优化演进。

137: Agent 是机会,造 Agent 的工具也是|从OpenAI开发者日聊起|Agent#6
2025年10月16日 · 1:28:58
本期《晚点聊》邀请AGI House联创Henry Yin与合伙人Naomi Xia,从OpenAI 10月6日DevDay发布的AgentKit出发,梳理了Agent工具链(Agentic Tooling)的六次进化与创业机会。他们认为,AgentKit是OpenAI开放了内部验证过的Agent开发全流程(构建、部署、评估),与2023年GPTs不同,Apps in ChatGPT和Apps SDK提供了真正的平台能力,可能让ChatGPT成为‘WeChatGPT’式超级应用;但AgentBuilder的可视化工作流与AGI路线有分歧,OpenAI不会放弃to B,已新设‘Future of Work’团队加速落地。工具链六次进化包括:GPT-3.5催生LangChain,function calling开启工具调用,MCP统一工具标准,GPT-4o语音带动实时语音设施,Claude 3.5引爆AI编程,O1推理与computer use让agent自我规划和用浏览器,每波都催生新公司。具体公司上,他们点评了Composio及其Rube产品以meta MCP server解决Cursor只能同时打开三个MCP server的限制,LiveKit一天2000万分钟语音(一年前100万),Letta的‘sleep time compute’记忆方案,以及OpenAI 11亿美元收购评估公司SetSeed的信号。他们估算,AI agent可将开发者工具市场从两三百亿美元推高至2000亿-5000亿美元,Okta、Twilio、Datadog在身份、通信、可观测性上可‘再做一遍’。最后,他们观察到2025年更多中国AI团队经HFZero等进入硅谷,20%-30%入营者是中国背景,其to C产品感和野心正在影响创业生态。
由 PodHood 提供支持