晚点聊 LateTalk 的主持人。

179: 蒸馏风暴:一场无人公开谈论的技术竞赛
2026年8月16日 · 49:33
《晚点聊》主播高洪浩与《晚点 LatePost》科技报道负责人程曼祺在本期中拆解AI模型蒸馏:它并非简单抄答案,而是有门槛的复杂系统工程。围绕字节跳动,节目披露张一鸣在内部会上反对蒸馏,理由是只能逼近难超越,且会让组织依赖捷径、丧失长期探索动力;程曼祺也分析Seed 2.1可能曾用蒸馏,字节在讨论后仍决定不走这条路。节目梳理了蒸馏出圈的关键节点——OpenAI o1开启推理模型与DeepSeek-R1发布推动规模扩大,并详解大规模蒸馏的账号与数据管线know-how、隐藏行为的难度,以及学生模型理论上可超越教师但代价是组织激励偏向确定性路径。此外,节目提及Anthropic曾点名DeepSeek、Kimi、MiniMax和阿里千问疑似蒸馏,并讨论蒸馏对商业模式的冲击:更便宜的智能让许多任务‘够用’,V4和Grok这类高性价比模型正在‘斩杀’高价低能的模型。

176: 姚顺雨,来到腾讯300天
2026年7月31日 · 1:39:26
本期《晚点聊》与主笔高洪浩复盘姚顺雨空降腾讯、改造混元大模型团队的300天,核心判断是她在刘炽平(Martin)支持下快速换掉预训练、后训练、测评、Infra等关键岗位,引入原DeepSeek的萧学峰、张弛等人,以接近300B参数的小尺寸混元3作为首秀,目的不是登顶而是让团队磨合、重振士气。她本人也被评价为不像纯技术Leader,而是重视组织,经常找一线同学和实习生要反馈。姚顺雨为何选择腾讯而非字节?她认为下半场的关键是找到值得解决的问题,腾讯拥有社交、办公、内容、游戏等最丰富的Context(场景与数据),字节的DAU虽大但画像同质化。高洪浩还披露混元与微信自研WeLM“没有很直接的关系”,张小龙因极度在意隐私和数据可控更倾向自研,两套模型大概率长期并存,刘炽平希望腾讯面对AI能“拧成一股绳”,这仍是联邦制腾讯的长期变数。节目也讲了Kimi K3发布后混元内部的声音分化:一派认为后来者可用更先进架构和数据居上,另一派质疑小模型的意义;同时腾讯把元宝、WorkBuddy、IMA等AI原生产品集中到CSIG,混元通过后训练团队与游戏、新闻业务合作,并建设全公司共用的强化学习平台。最后讨论大模型竞争:第一梯队模型是否足以定义胜负、从程序员到更广泛白领的商业化拐点何时到来,以及今年下半年可能的泡沫转折。

162: 批量生素材、模型筛网红|与飞书深诺Meetsocial沈晨岗聊AI时代的出海营销
2026年4月26日 · 1:11:22
本期《晚点聊》邀请飞书深诺创始人兼CEO沈晨岗,与主播高洪浩探讨AI如何改变中国企业出海的营销模式;沈晨岗认为出海正从1.0的商品销售转向2.0的产品与品牌阶段,驱动因素是流量成本上升、同质化竞争加剧与媒体合规收紧,并以安克为例说明从第一笔生意起就投入研发与品牌建设的企业才能跨越分水岭。他提出D-MES模型衡量出海竞争力,即数字化能力、心智影响力、产品创新力与商业转化力,其中数字化是贯穿前者的乘数而非简单相加。关于AI,他说行业最大共识是AI很重要,最大非共识是AI究竟能解决什么问题;目前AI影响最大的是内容生成,策略与决策层面的能力仍在演进,麦当劳AI节日广告因与商业目标脱节遭抵制,他主张AI应用须嵌入具体商业目标,且AI难为高价值决策负责,容错空间小的场景仍需人类专家把关。对比中美,他认为美国大型营销公司受制于历史流程与分散数据,落地AI近乎需要推倒重组,而数字化原生的中国企业如飞书深诺自成立起累积数据,后发优势明显,美团餐饮系统出海遇阻即为美国市场惯性的例证。飞书深诺已用内部AI Agent重构创意生产,将任务拆解为多层Agent,曾在春节一周为短剧客户制作6000个创意,助其广告日消耗从几千美元涨到十几万美元,但他强调Agent必须对应明确可衡量的商业结果,否则只是空谈。他预测AI将推动营销平民化,让中小企业低成本制作高品质创意,并让营销与企业供应链、产品决策深度连接,成为未来全球竞争关键;他也建议出海创业者一开始就重视数据与长期主义,并善用合作伙伴以实现乘数效应。
由 PodHood 提供支持