在 晚点聊 LateTalk 中提及的产品。

177: 详解Kimi K3:强到冲击Anthropic估值的模型什么样?
2026年8月3日 · 1:55:18
《晚点聊》由曼祺主持,邀请RadixArk与SGLang创始成员赵晨阳、华盛顿大学博士生曾致远,从Infra与算法两条线拆解Kimi K3:这款近3T参数的开放权重模型以混合注意力架构逼近并部分超越Claude Opus 4.8等闭源前沿,同时引发对Anthropic估值的冲击与开源安全辩论。节目指出,K3用KDA线性注意力与MLA全局注意力按3:1混合,靠循环状态压缩历史,在百万上下文下获得6.3倍解码加速;其Quantile Balancing以分位数估计替代固定步长调整,支撑896个路由专家中选16个的极端稀疏负载均衡,Per-head Muon则通过逐注意力头正交化提升大规模训练稳定性。后训练部分,K3先用MOPD多教师在线蒸馏合并9个领域专家模型,既降低合版压力又提升迭代速度;在Kimi CodeBench 2.0上,K3得分仅低最强模型4分,成本却只有对方的38%。嘉宾还拆解了Attention Residuals如何让深层模型选择性读取浅层信息,以及Kernel Development Agent如何让早期checkpoint自主优化内核,甚至为国产GPGPU写Kernel。讨论也点明,K3开放了权重、MuonEP、Flash KDA和agent-inv,但未开源RL环境、知识图谱任务系统与原始专家checkpoint——权重是一次训练的产物,环境才是能反复产生下一代权重的'流水线',构成开源模型真正的护城河。最后,嘉宾判断开源模型短期内仍难超越闭源,因为OpenAI与Anthropic内部最强模型通常比已发布版本领先半代到一代,但KDA这类线性注意力混合架构已证明'条条大路通罗马'。

153: 阿里Qwen人事变动:误读、近况、伏笔和未来|solo
2026年3月4日 · 18:46
本期《晚点聊》聚焦阿里Qwen团队人事巨震:核心负责人林俊旸(供职于阿里云通义实验室)提出离职,同期原Qwen Code负责人惠彬元、后训练负责人郁博文也先后离开。主播程曼祺澄清三个广为流传的误传:林俊旸是主动离职而非被通知;Qwen考核纳入千问App日活的说法无事实依据;新加入的周浩是接替郁博文负责后训练,直接向通义实验室负责人周婧仁汇报,并非替代林俊旸。节目梳理了2023年以来Qwen从预训练与后训练紧密结合、多模态同队,到如今拆分为按模态和训练环节划分的水平团队的过程,并指出infrastructure支持不足以及林俊旸曾绕开周婧仁向阿里云CEO吴永明争取自建infrastructure资源,是这次调整的伏笔。3月4日全员会上,吴永明、周婧仁、蒋芳等高层的回应是:调整不是收缩Qwen而是扩大投入,但不考虑公司政治,沟通形式和节奏欠佳。团队成员仍感失望,外部猎头和投资人已开始争夺Qwen人才。节目最后提到,阿里内部对Qwen 3.5不完全满意,认为它是半成品;Qwen虽在美国市场与DeepSeek齐名,被Cursor等公司采用,但其开源影响力与阿里云商业目标之间的张力,将持续考验这个曾经的'小环境'团队。

128: 小众AI场景拿到10亿级收入:测测任永亮首次讲述14年创业史
2025年7月30日 · 1:17:27
本期《晚点聊》对话测测创始人兼CEO任永亮,讲述他从北大医学部预防医学专业转做程序员、因个人情感问题在2011年创立测测的14年创业历程,并首次详细拆解测测从工具型社区、双边服务平台到AI对话机器人的四个发展阶段。任永亮透露,测测现有5000万注册用户,80%为女性、80%来自一二线城市,公司长期自给自足,他拒绝了外界的高价收购要约,为的是用现金流支持现在投入巨大的陪伴机器人业务;这款机器人预计明年面世,成本不低,核心是主动交互和情感陪伴,对标日本LOVOT,试图通过产品形态激发催产素而非多巴胺,打破短视频式的沉迷循环。他还分享了对泛心理赛道的独特理解:MBTI是自我认知工具,星座、生辰本质是太阳历周期假说,人是一个对初值敏感的混沌系统,这些体系只解释了一小部分规律,之所以人们总想'测测'自己,源于智人寻找确定性的本能。对AI趋势,任永亮明确表示悲观,认为大模型不会像前几次工业革命那样创造新的分工和分配体系,反而会替代工具化岗位,让多数人失去价值感,因此测测想成为'精神避难所'。他同时透露,自己因错过GPT-2而极其后悔,如今把机器人项目视为'有科学家执念的不理性选择',并借用李想的经历表达80后创业者在大风口到来时想做更大事情的心态。节目最后,他留下一个开放式问题:这个世界到底是否可被计算,能否在爱因斯坦的质能方程中加入信息维度——这也是他高中以来一直思考的困惑。

125: 用AI复刻一个「我」,与心识宇宙陶芳波聊身份模型
2025年7月13日 · 2:06:34
本期《晚点聊》邀请心识宇宙(Mindverse)创始人陶芳波,讲述他为何放弃做《她》中的陪伴AI(her)和《钢铁侠》中的管家AI(him),转而用AI复制用户“第二自我”的身份模型(me)。陶芳波回顾了从清华、伊利诺伊大学到Facebook、阿里达摩院的AI研究经历,以及GPT-3后下场创业、将公司从通用Agent平台转向身份模型的过程。他介绍了Me.bot和开源项目Second Me两个产品,强调身份模型应通过微调参数而非RAG检索来内化用户记忆、偏好和价值观,并称100份思考或笔记即可训练,一天应微调一次。节目中他还演示了“共鸣”和“Talks”功能,设想身份模型可代表用户社交破冰、输出个性化表达,并讨论了大厂数据孤岛、开源建立信任、身份即服务的商业模式等话题。

123: 当只有AI,人会活成怎样?与五源孟醒和两位挑战者还原72小时AI生存
2025年7月7日 · 1:56:12
本期节目由曼祺与五源资本合伙人孟醒、青年导演利建磊、AI产品开发者陈郅悦共同还原五源资本发起的“72小时AI生存挑战”,核心是验证背景各异的人仅靠大模型、AI Coding等工具能否生存、并做出有影响力的作品或产品。孟醒表示,活动受1999年互联网生存挑战启发,唯一不考虑的就是筛项目,希望跳出投资人信息茧房,回应2025年初“普通人能否用AI做出惊艳东西”的分歧;参赛者没有智能手机和浏览器,只拿到一台配置受限的电脑和一瓶水,最后有7人从300多名报名者中入选。利建磊完全不会编程,在超过24小时未进食、反复把报错复制给DeepSeek无果后,反而确定了对抗算法的主题,最终创作了马航MH370主题短片《7.41》,并得出导演无法脱离互联网工具成为超级个体的结论。陈郅悦从文科转码、3个月上线第一个产品并获得每月约1000欧元收入;这次她做出让大模型给真人主播反馈的AI虚拟直播,让素人也能在友好氛围中倾诉,她发现成本远低于预期,正在准备内测。节目还讨论了Agent的“脚铐”:验证码、登录、支付体系都为人设计,Agent只能“跪在验证码前假装是人”,数字基建尚未为AI主体铺路;而选手们度过72小时后,最强烈的需求仍是和其他参赛者交流。孟醒最后说,他不完全相信AI会带来稳定的小而美组织形态,下一步想验证的前沿是理解与生成统一的世界模型。

122: 10分钟朱啸虎投资,泡泡玛特、米哈游都在试;Fuzozo孙兆治聊AI潮玩
2025年6月29日 · 1:33:42
本期《晚点聊》专访 RoboPoet 珞博智能创始人孙兆治,谈其新近发售的AI潮玩芙崽 Fuzozo——一款面向90后、00后女性的养成系陪伴硬件,预售399元,618期间在京东卖出超2000件,进入潮流盲盒榜前15,排在前面的几乎全是泡泡玛特。孙兆治曾在小鹏、滴滴及鹏行智能负责设计,他详述从具身智能桌面机器人转向毛绒挂件的减法过程:保留对话、眼睛、震动与触摸反馈,砍掉自由度和摄像头;五只金木水火土属性的崽会写日记、可通过脸颊NFC碰一碰交友,且记忆只能在同种族间迁移。他提到调研中约60%用户不希望Fuzozo说人话,但仍坚持选择会说话,因为理想状态是模型驱动所有反馈;团队用Memoryline架构做长期记忆,不同功能接入DeepSeek等不同模型。融资上,朱啸虎今年4月聊了10分钟就决定投资,金沙江和上影集团联合领投,建议是先赶紧把东西做出来;孙兆治也认为TTS语音与大模型在陪伴硬件中同等重要。竞争方面,他称米哈游、泡泡玛特、优必选已下场,但情绪价值产品是离散市场、壁垒是品牌,行业下一节点是端侧模型部署,预计一年内到来。他也回顾了从巴黎46天年假回国、定义滴滴D1、参与鹏行PX5设计,以及此前智能猫砂盆创业的复盘,认为抚慰孤独值得做深。

115: 华为发布超节点,如何搅动AI算力市场?与魔形智能徐凌杰聊芯片层新变化
2025年5月11日 · 1:28:13
本期《晚点聊》邀请魔形智能CEO徐凌杰(曾任英伟达、AMD、三星GPU架构师,壁仞科技联合创始人)解读华为CloudMatrix 384超节点,核心观点是:它本质是12个机柜、384张昇腾910组成的'横向扩展'(Scale out)集群,而非英伟达NVL72那种单机柜'纵向扩展'(Scale up),以数量换总算力——集群总算力300P,比NVL72提升67%,内存容量三倍以上、带宽两倍以上,但功耗约为后者四倍。徐凌杰认为,华为在成为英伟达之前已是'Mellanox',网络与交换积累是其能做多卡互联的原因;但国内厂商普遍缺乏NVSwitch类产品,超节点趋势短期不冲击英伟达,压力主要给到其他国产AI芯片商。他还拆解了AI算力结构:GPU之外互联、交换机、光模块同样关键,芯片成本已从晶圆主导变为显存主导,HBM占五到六成;并透露魔形智能在H20上优化DeepSeek满血版已实现API业务盈利。英伟达已为可能被禁的H20计提55亿美元损失,不排除通过恢复被屏蔽计算单元'变废为宝';华为在阿里发布Qwen3当天即宣布开箱即用支持。他判断英伟达最大威胁是客户集中(Google TPU、Amazon自研芯片),其已成立'半定制'部门防御;下一代算力变量或来自存算一体、类脑计算(脉冲神经网络)以及电力与散热等可持续发展约束。

109: 数字生命卡兹克如何用 AI:把任何重复3遍的事AI化
2025年3月30日 · 2:29:13
本期嘉宾是数字生命卡兹克(《数字生命卡兹克》公众号主理人),他讲述了自己从交互设计师到基金数据分析创业公司“九圈”的设计总监,再到2024年3月全职转型为AI内容创作者的历程。他所在公司在2022年底全员用AI,做出金融领域首个算法备案的基金问答产品,但因toB客户要求非标准化而商业化失败;他兼职做AI内容时,用Midjourney制作《流浪地球3》AI预告片出圈,并在Pika文章发布第二天一天做了13个券商线上路演。卡兹克自称“AI殿堂的门童”,用AI改造了内容工作流:每天自动抓取二十多个数据源,用模型打分筛选出10条AI资讯发到30多个群;用AI分析社群讨论和评论来挖掘选题;还曾用O1 Pro花11分钟完成过去11个人干两天的2400人报名筛选和分组。他认为目前真正帮到生产的Agent只有OpenAI DeepResearch,它生成的研究报告相当于三年研究员水平,甚至能写一个逻辑伏笔正确的三万字小说;多数Agent仍是玩具,因为多步任务的成功率会因每一步误差而趋近于零。他还提到DeepSeek的出圈让中国多了数亿从未接触过AI的用户,是“中国ChatGPT时刻”,也谈到与郭帆《流浪地球3》的AI合作、AI短剧《兴安岭诡事》分账盈利,并对比了2023与2025年AI产品推荐,担心AI越来越精英化,普通用户阈值变高,内容更难做。

80: OpenAI o1 来了!与硅流袁进辉聊 o1 新范式和开发者生态
2024年9月16日 · 1:40:20
本期《晚点聊》邀请硅基流动创始人袁进辉解读OpenAI o1:o1以强化学习、思维链与test-time compute的组合,突破了大语言模型在逻辑推理上的瓶颈,数学、编程和科学任务能力大幅提升。袁进辉认为这三项技术单独看都不是新idea,OpenAI把Alpha家族验证过的强化学习方法搬到大语言模型上,胜在组合,并验证了从train scaling law到inference scaling law的新范式;训练端用合成数据、推理端多次调用模型都会增加算力需求,但国内基础模型训练收缩,GPU短期有冗余、租金下降。从API定价看,o1每百万token约数十到上百美元,是4o的数倍到十倍,目前还不支持函数调用、流式传输,推理时间也长,但这些都可优化;而推理能力的提升让Agent范式更有望跑通。袁进辉还以硅基流动的一线数据反驳“AI应用降温”:大量小微企业和个人开发者正基于开源模型做应用,只是不在传统VC视野里,他称已有应用每天调用数亿至十亿token、每周活跃数十万;海外调用最多的是Meta的Llama,国内是阿里通义千问和幻方DeepSeek,千问胜在版本齐全,DeepSeek编程能力突出。他也不认为o1会改变大模型公司持续收敛的趋势,因为技术扩散和边际收益递减的逻辑未变。
由 PodHood 提供支持