在 晚点聊 LateTalk 中提及的产品。

175: 对话Liblib陈冕:关于活下来,以及所有接近死亡的时刻
2026年7月30日 · 2:08:33
本期《晚点聊》对话演语科技Evoken创始人陈冕。他回应了围绕Liblib、Lovart、LibTV的争议:公司现金流自5月起转正,月投流不足100万元,并非负毛利;LibTV的3.9折年费会员是基于用户消耗率与续费率假设的定价,而非补贴。他承认LibTV不是首个拿到PMF的产品,但强调“第一个发现PMF和最终赢得市场差十万八千里”,创新有成本,应用公司不能自由探索。陈冕复盘了创业初期账上只剩4000元、联创离职、CTO更替等时刻,承认自己随意给“联合创始人”头衔、忽视管理,是两个reward model没做好。面对模型厂商的“吞噬”,他用“逐鹿中原与占领江东”解释生存路径:在巨头缝隙中以时间换空间,最终通过用户创造财富构建双边网络,赌的是“十年以内人有没有价值”。他认为AI时代奖励更焦虑、更快、更有侵略性的人,而自己正是被时代选中的那种。

162: 批量生素材、模型筛网红|与飞书深诺Meetsocial沈晨岗聊AI时代的出海营销
2026年4月26日 · 1:11:22
本期《晚点聊》邀请飞书深诺创始人兼CEO沈晨岗,与主播高洪浩探讨AI如何改变中国企业出海的营销模式;沈晨岗认为出海正从1.0的商品销售转向2.0的产品与品牌阶段,驱动因素是流量成本上升、同质化竞争加剧与媒体合规收紧,并以安克为例说明从第一笔生意起就投入研发与品牌建设的企业才能跨越分水岭。他提出D-MES模型衡量出海竞争力,即数字化能力、心智影响力、产品创新力与商业转化力,其中数字化是贯穿前者的乘数而非简单相加。关于AI,他说行业最大共识是AI很重要,最大非共识是AI究竟能解决什么问题;目前AI影响最大的是内容生成,策略与决策层面的能力仍在演进,麦当劳AI节日广告因与商业目标脱节遭抵制,他主张AI应用须嵌入具体商业目标,且AI难为高价值决策负责,容错空间小的场景仍需人类专家把关。对比中美,他认为美国大型营销公司受制于历史流程与分散数据,落地AI近乎需要推倒重组,而数字化原生的中国企业如飞书深诺自成立起累积数据,后发优势明显,美团餐饮系统出海遇阻即为美国市场惯性的例证。飞书深诺已用内部AI Agent重构创意生产,将任务拆解为多层Agent,曾在春节一周为短剧客户制作6000个创意,助其广告日消耗从几千美元涨到十几万美元,但他强调Agent必须对应明确可衡量的商业结果,否则只是空谈。他预测AI将推动营销平民化,让中小企业低成本制作高品质创意,并让营销与企业供应链、产品决策深度连接,成为未来全球竞争关键;他也建议出海创业者一开始就重视数据与长期主义,并善用合作伙伴以实现乘数效应。

152: 千寻智能韩峰涛:具身模型淘汰赛和落地的非共识
2026年2月26日 · 1:41:42
本期嘉宾是刚完成近20亿元融资、估值超100亿元的具身智能公司千寻智能创始人兼CEO韩峰涛,主播程曼祺,他提出26年不是具身落地生死之年,而是具身模型性能爆发元年,行业会像23年的大模型一样进入模型能力淘汰赛。韩峰涛回顾15年从业:浙大毕业后因机器人岗位稀少先去了国家核电,2015年与同伴联合创办落实,经历三次资金链危机与个人连带债务后,这次为千寻找到联创高阳前密集见了100多人。千寻把80%以上精力用于数据卡点,从24年5月开发UMI、外骨骼等可穿戴数采设备,一年半把数据可用性从30%提高到95%,有效性达到遥操作的90%-95%;26年计划采100万小时,是此前最好开源模型所用1万小时遥操作数据的100倍,目标模型全球top3。落地路径是先工业、商业再家庭,宁德时代是首位大客户,他们从200道工序里选了电池最后插拔检测:节拍慢、容错率高、无需非标自动化改造。他还把具身模型比作GPT-2,认为真正大规模落地要到27下半年到28年;为对抗大厂要把自己变成一年卖10万台的中厂,组织价值观是信任与追求卓越。他判断26年拿不到足够钱、跑不到头部就上不了牌桌,雷军曾问高阳技术领先多久,回答是六个月。

151: MuleRun 陈宇森:Claude Code带来Agent创作新范式,未来的软件是日抛式的
2026年2月12日 · 1:46:45
本期《晚点聊》专访MuleRun创始人、33岁的连续创业者陈宇森,核心论点是Claude Code已是当下最强通用Agent,Agent创作门槛因此骤降,平台机会应从交易货架转向帮普通人用自然语言封装工作流程。MuleRun此前上线三个月未见理想PMF,团队约50人,现于1月16日内测Agent Builder,站在Claude Code这个“基础Agent”之上,提供Runtime、Skills评价体系和安全审计,让用户通过选择与对话创建可分享的Agent;他认为未来Market Place不再货架化,而应在对话中触发交易,且软件将“日抛化”,按需创建、执行、销毁,AI本质是制造业。节目含25年12月底与26年1月初两次访谈,还对比了N8N、Dify、Coze、蚂蚁灵光、Youware等同行路径,还指出Dify专注To B、Coze封闭生态,并判断2026年可能出现ARR达5亿甚至10亿美元的AI原生应用公司。后半段他回顾22岁浙大毕业创办长亭科技、2019年卖给阿里云,第二段同时做游戏与安全公司,游戏项目失败,2023年低谷后重新出发,以“用心”对抗平庸,也强调不要在选择题上出错。

138: 从你用手机到它更懂你,OPPO的手机AI实践 |与小布负责人万玉龙聊端侧AI|Agent#7
2025年10月23日 · 1:34:09
本期《晚点聊》中,主持人程曼祺与OPPO ColorOS智能助理部总经理万玉龙对谈,核心观点是:手机厂商做AI的关键不在于预训练大模型,而在于以新计算(端云协同降本提速)、新感知(结合传感器与屏幕内容理解用户)、新生态(以Agent接入第三方服务)重塑体验。万玉龙介绍小布助手将上线一键闪记(可记录视频要点、语音待办、账单并提取取餐码)、视频问答(结合声纹抗噪、哪里不会点哪里)、个性化简报等功能,并坦言渗透率低于预期:月活近1.7亿(四个月前1.5亿),但手机AI助手日活比不高,原因是过去语音助手的负面心智和手机助手需同时解决通用问答、本机上千条控制指令、三方应用执行等更复杂任务。产品方法论上,他认为AI产品是"by use"而非"by design",需通过圆点之旅等用户访谈和线上日志迭代;OPPO已转向更敏捷的研发,最快一周发一版。关于生态,他认为服务正从APP转向Agent,能力原子化后供模型调度比GUI Agent更符合直觉;OPPO正与支付宝等以A2A协议合作,但移动端尚无统一标准,日活、时长、广告等商业指标将被重塑。万玉龙判断用户最终只需要一个贴身管家来协调各类专家顾问,手机作为多设备中枢仍是管家最佳载体;他期待明年AI渗透率大幅提升,并认为真正的AIOS须从底层重构而非在安卓上叠加AI,新生态需要爆品催化,可能出现新玩家。

137: Agent 是机会,造 Agent 的工具也是|从OpenAI开发者日聊起|Agent#6
2025年10月16日 · 1:28:58
本期《晚点聊》邀请AGI House联创Henry Yin与合伙人Naomi Xia,从OpenAI 10月6日DevDay发布的AgentKit出发,梳理了Agent工具链(Agentic Tooling)的六次进化与创业机会。他们认为,AgentKit是OpenAI开放了内部验证过的Agent开发全流程(构建、部署、评估),与2023年GPTs不同,Apps in ChatGPT和Apps SDK提供了真正的平台能力,可能让ChatGPT成为‘WeChatGPT’式超级应用;但AgentBuilder的可视化工作流与AGI路线有分歧,OpenAI不会放弃to B,已新设‘Future of Work’团队加速落地。工具链六次进化包括:GPT-3.5催生LangChain,function calling开启工具调用,MCP统一工具标准,GPT-4o语音带动实时语音设施,Claude 3.5引爆AI编程,O1推理与computer use让agent自我规划和用浏览器,每波都催生新公司。具体公司上,他们点评了Composio及其Rube产品以meta MCP server解决Cursor只能同时打开三个MCP server的限制,LiveKit一天2000万分钟语音(一年前100万),Letta的‘sleep time compute’记忆方案,以及OpenAI 11亿美元收购评估公司SetSeed的信号。他们估算,AI agent可将开发者工具市场从两三百亿美元推高至2000亿-5000亿美元,Okta、Twilio、Datadog在身份、通信、可观测性上可‘再做一遍’。最后,他们观察到2025年更多中国AI团队经HFZero等进入硅谷,20%-30%入营者是中国背景,其to C产品感和野心正在影响创业生态。

136: Sora新世界 & Lovart 4个月复盘 | 与陈冕聊怎么做垂类Agent|Agent#5
2025年10月9日 · 1:59:43
Lovart创始人陈冕作客《晚点聊》第136期,与主持人程曼祺在Sora app发布前后两次对谈:他认为Sora打开的是一扇AI社交而非AI视频的大门,其核心是Cameo合拍与Remix共创,4小时体验里他惊艳于顺滑、音画同步和镜头语言;这类产品留给新玩家的窗口仅3到6个月,且更属于拥有顶尖模型和天量资金的巨头。同时他复盘了Lovart上线4个月做到15-20万日活、超过3000万美元年度预测收入的过程,坦言尚未覆盖API成本,但相信token会变便宜,订阅模式无需怀疑。他说垂直AI应用的本质是做两件事——特别的交互和特别的context,ChatCanvas是交互例子,即将上线的context模块会沉淀用户的reference和preference,增长方式是‘提前描绘未来会发生的东西,然后等它发生’;他也说现在已不再纠结开源闭源,应用公司的壁垒在于把context做到极致。在湾区旧金山California Street设办公室、参加多场线下活动并与FreePeak合办活动后,被反复追问热情的他更想清楚Lovart服务‘everyone who wants to create’,也因欧美设计师更贵更创意导向而在当地搭建了营销与设计团队。他判断To P的AI创业窗口接近关闭,下一波大机会在To C;技术变化太快,timing比移动互联网更重要,他几乎没错过重要窗口的原因就是焦虑——‘不焦虑的团队做不好AI创业’,组织必须高频迭代并拥抱焦虑。他也回顾了23年底公司濒临倒闭的危机,称坚持来自信念,信念来自认知;创业是痛并快乐,他最怕自己迭代不够快。

134: Meta AI人才动荡,上亿美元为何留不住人?| 与Pokee AI朱哲清盘点 AI 组织
2025年9月23日 · 1:20:24
本期节目与Pokee.ai创始人朱哲清(前Meta应用强化学习负责人)复盘Meta AI人才动荡:Meta以143亿美元收购Scale AI并天价挖人,但9月离职潮显示组织问题才是关键。朱哲清对比Meta、Google、OpenAI、Anthropic的组织特点,认为Meta因层级臃肿、分功不均导致人才流失,而OpenAI和Anthropic以使命驱动和精简规模更吸引顶尖人才。他表示顶尖AI人才最看重成为AGI核心贡献者,工程型人才决定2-3年发展,科学家型决定10年。他还给出AI原生组织建议:网状结构、任务抽象化、信任优先,并预测明年资本市场冷却将影响人才竞争。最后以斯坦福学生“上完课能否做出sota模型”的提问,批评当前AI教育浮躁。

128: 小众AI场景拿到10亿级收入:测测任永亮首次讲述14年创业史
2025年7月30日 · 1:17:27
本期《晚点聊》对话测测创始人兼CEO任永亮,讲述他从北大医学部预防医学专业转做程序员、因个人情感问题在2011年创立测测的14年创业历程,并首次详细拆解测测从工具型社区、双边服务平台到AI对话机器人的四个发展阶段。任永亮透露,测测现有5000万注册用户,80%为女性、80%来自一二线城市,公司长期自给自足,他拒绝了外界的高价收购要约,为的是用现金流支持现在投入巨大的陪伴机器人业务;这款机器人预计明年面世,成本不低,核心是主动交互和情感陪伴,对标日本LOVOT,试图通过产品形态激发催产素而非多巴胺,打破短视频式的沉迷循环。他还分享了对泛心理赛道的独特理解:MBTI是自我认知工具,星座、生辰本质是太阳历周期假说,人是一个对初值敏感的混沌系统,这些体系只解释了一小部分规律,之所以人们总想'测测'自己,源于智人寻找确定性的本能。对AI趋势,任永亮明确表示悲观,认为大模型不会像前几次工业革命那样创造新的分工和分配体系,反而会替代工具化岗位,让多数人失去价值感,因此测测想成为'精神避难所'。他同时透露,自己因错过GPT-2而极其后悔,如今把机器人项目视为'有科学家执念的不理性选择',并借用李想的经历表达80后创业者在大风口到来时想做更大事情的心态。节目最后,他留下一个开放式问题:这个世界到底是否可被计算,能否在爱因斯坦的质能方程中加入信息维度——这也是他高中以来一直思考的困惑。

127: 与真格戴雨森 25 AI 中场复盘:OpenAI的IMO金牌、Kimi K2翻盘、Agent普及和抢人大战
2025年7月21日 · 1:54:55
本期《晚点聊》中,主播程曼祺与真格基金管理合伙人戴雨森复盘2025年年中AI进展:OpenAI用未公开的通用大语言模型首次达到IMO国际奥赛金牌水准(6题做对5题),戴雨森认为这验证了推理时扩展定律、说明强化学习也能攻克难以验证的证明题,被OpenAI研究员Sébastien Bubeck称为'登月时刻';而OpenAI的ChatGPT Agent虽不惊艳,却标志Agent形态成为共识,也证明'壳'(应用)的价值被低估——模型进步与应用进化可能都在加速。他提出应用价值三层论:模型只提供底层智能,Context(组织与个人上下文)和环境工具须由应用提供,这正是Manus、Genspark等创业公司的机会。 他盘点各家公司走向:K2(月之暗面)已是目前最好的开源模型,OpenRouter编程类目调用量几天内从第10升至第5;DeepSeek R2要等新基模V4;字节Seed分设Edge、Focus、Base;Google回归第一梯队,Anthropic自造Claude Code加入应用层。被高估的是机器人进厂速度——特斯拉已下调Optimus产量预期;被低估的是模型能力进化速度、应用价值与优秀团队韧性。他还谈到硅谷抢人大战由Meta主导、腾讯成国内挖人最猛者,并预计Agent应用需要新的L3原生模型,以自己每月近1000美元的AI订阅费说明生产力场景token消耗将远超娱乐类。 面对未来,他持续好奇如何衡量智能边界——当模型已能解决IMO证明题、HLE得分从年初个位数涨到20多分,人类的评估体系正在失效;他也担心效率与公平的张力:当个人拥有巨大生产力,人与人差距会被急剧拉大。他推荐契合AI创业者心态的游戏《33号远征队》,并说自己年内最想验证的是L3模型能否让Agent任务一次做到七八十分以上。

125: 用AI复刻一个「我」,与心识宇宙陶芳波聊身份模型
2025年7月13日 · 2:06:34
本期《晚点聊》邀请心识宇宙(Mindverse)创始人陶芳波,讲述他为何放弃做《她》中的陪伴AI(her)和《钢铁侠》中的管家AI(him),转而用AI复制用户“第二自我”的身份模型(me)。陶芳波回顾了从清华、伊利诺伊大学到Facebook、阿里达摩院的AI研究经历,以及GPT-3后下场创业、将公司从通用Agent平台转向身份模型的过程。他介绍了Me.bot和开源项目Second Me两个产品,强调身份模型应通过微调参数而非RAG检索来内化用户记忆、偏好和价值观,并称100份思考或笔记即可训练,一天应微调一次。节目中他还演示了“共鸣”和“Talks”功能,设想身份模型可代表用户社交破冰、输出个性化表达,并讨论了大厂数据孤岛、开源建立信任、身份即服务的商业模式等话题。

117: 印奇的AI创业14年:所有不能闭环的辉煌都是暂时的
2025年5月20日 · 2:06:50
本期嘉宾是千里科技董事长、旷视创始人印奇,他在37岁、AI创业14年之际总结从旷视到千里的转变,核心判断是“所有不能闭环的辉煌都是暂时的”,商业闭环和ROI优先于单纯技术信仰。他解释了为何在继续推动旷视上市、大模型创业和入股力帆(后更名千里)三者中选了最后一项:力帆经历破产重组和吉利三年清理后没有历史包袱,吉利能成为AI+车的场景提供者与数据闭环支点,这不是绑定而是开放起点。技术路线上,印奇主张智驾走特斯拉式模型驱动路线而非华为式闭环供应链,认为中国智驾要回归基本功、提升模型化比例;VLA更属于具身智能,车的行为空间有限,概念被超卖。他回顾了旷视在科创板等待三年多、两次上市受阻的近5年低谷,称这是组织成长最快的“蹲苗”期,自己将理念改为价值务实在前、技术信仰在后,并把研发与营销投入比从3:1、4:1调到1:1。他也判断智驾已到冲刺期,赢下需要数据体系、纵向整合和客户联盟三个体系,最后最多4家、可能3家留在牌桌,明年见分晓。5月补充访谈中,印奇把大模型周期视为深度学习的决赛环节,认为Super App需兼具上限与短期爆发力,将Agent分为工作、创作、生活、情感四类,判断未来18到24个月会出现引爆点。

116: 当AI研究者写科幻,与Meta田渊栋聊他的智能想象:我们终会“所思即所得”
2025年5月17日 · 1:39:05
《晚点聊》本期请来Meta GenAI研究总监田渊栋,从他2024年出版的科幻小说《破晓之钟》切入,谈AI时代的科幻想象与现实印证:他2005年起研究人工智能,2020年动笔、2021年连载完这部完全手写的小说,书中“灵界立方”的互联设定源自英伟达GPU,两年后成了算力竞赛的真实图景。他借外星文明用虚拟世界“乐园”诱惑人类的故事,讨论未来人类可能一边进入虚拟世界、一边以计算载体走向星海,并预测科技终会到达“所思即所得”,而那时高级文明最想掠夺的是宇宙角落独一无二的智慧与“好点子”。小说主角是一群研究者,也带出他对学术圈的真实观察:他回忆了深度学习冷门时期在卡耐基梅隆读博的经历,区分了追求颠覆性突破与做实用改进的两类科研者,并讲述作为技术leader从“不要埋头苦干”到重新强调hands-on的转变,认为AI时代研发团队会更小更精悍。作为写作者,他对比了Claude、Gemini、DeepSeek等模型,认为它们仍缺乏对人物关系和长线逻辑的理解;他自己用Cursor等AI工具做了人机协作的写作软件,让AI补空、润色而自己保留核心创意。他相信人类独一无二的经验与见解是AI最需要的数据——就像银河联盟寻找全宇宙的好想法,而这本小说的续作《幽夜星火》正在网上连载。

114: 秘塔闵可锐2:“我不是演员”
2025年5月5日 · 2:01:51
本期《晚点聊 LateTalk》中,秘塔科技创始人闵可锐向主播曼祺与王与桐解释,这家成立七年的小AI公司为何刻意保持保守:他自评新产品“今天学点啥”仅70分,称秘塔80%的产品决策靠他“拍脑袋”,2024年只新融1亿多人民币、估值低得保守,还拒绝了去年的收购,因为他“当不了演员”,讲不了自己都不信的故事;他也提到秘塔搜索已接近100万日活。他说明为何不追Agent热潮——2025年上半年的模型能力仍撑不起相对通用的Agent,Manus的很多效果得益于Claude;也解释为何秘塔没有采用DeepSeek式高密度研发组织——“因为我们没钱”。他给出一个悲观判断:任何主要依靠大模型能力、有潜力做到1000万DAU的软件应用,大模型公司和大厂都会自己做,小公司只能“摸着石头过河,大厂摸着我们过河”。技术上,他认为Grok3证明了后发团队配上顶尖资源能快速追上一线模型,Llama4再次印证“一流资源、二流团队”干不过“二流资源、一流团队”,并强调预训练对推理模型至关重要,Scaling Law不是简单线性外推。节目还谈到“今天学点啥”下一步会为辅导孩子作业的家长优化,以及闵可锐对团队分工、没找产品合伙人和过去两年“各方面更会了”的反思。

113: 秘塔闵可锐1:回到故事开始,那些「神预言」
2025年5月5日 · 1:56:09
2023年3月大模型热潮初期,秘塔科技创始人闵可锐断言,中国VC很可能会集体错过最有雄心的中国大模型创业者,并分享了他对预训练范式、创业选择及行业格局的观察。他回顾了从复旦、牛津到伊利诺伊博士辍学,经历波森数据、猎豹后于2018年创立秘塔,因看好大规模预训练而选择法律翻译切入,理由是人比机器更贵。他认为预训练本身才是范式转变,Transformer并非关键,GPT-3只是把规模推到工业界不敢想的地步,并非新架构;AI应用已进入个人开发者、创业公司和大厂所有人PK所有人的战国时代,AI Native的突破很可能在交互。他提到秘塔写作猫注册用户超700万,付费率2%-5%,公司总成本小几千万元且已能自给自足;但热潮对秘塔并非全是好事,财务投资人因担心与大厂直接竞争而谨慎,战投反而更积极。他批评研发投入95%是浪费且不知浪费在哪,OpenAI的关键是找到会花钱的少数研究者并给他们大量资金;中国投资仍循着大佬站台的传统思路,可能错过真正能干事的人。他还预测未来半年厂商将密集发模型但热潮不可持续,拿不到正反馈的团队会速生速死,并会出现二手A100;开源是另一股力量,但真正千亿级开源模型并不多,中国团队多为微调。

109: 数字生命卡兹克如何用 AI:把任何重复3遍的事AI化
2025年3月30日 · 2:29:13
本期嘉宾是数字生命卡兹克(《数字生命卡兹克》公众号主理人),他讲述了自己从交互设计师到基金数据分析创业公司“九圈”的设计总监,再到2024年3月全职转型为AI内容创作者的历程。他所在公司在2022年底全员用AI,做出金融领域首个算法备案的基金问答产品,但因toB客户要求非标准化而商业化失败;他兼职做AI内容时,用Midjourney制作《流浪地球3》AI预告片出圈,并在Pika文章发布第二天一天做了13个券商线上路演。卡兹克自称“AI殿堂的门童”,用AI改造了内容工作流:每天自动抓取二十多个数据源,用模型打分筛选出10条AI资讯发到30多个群;用AI分析社群讨论和评论来挖掘选题;还曾用O1 Pro花11分钟完成过去11个人干两天的2400人报名筛选和分组。他认为目前真正帮到生产的Agent只有OpenAI DeepResearch,它生成的研究报告相当于三年研究员水平,甚至能写一个逻辑伏笔正确的三万字小说;多数Agent仍是玩具,因为多步任务的成功率会因每一步误差而趋近于零。他还提到DeepSeek的出圈让中国多了数亿从未接触过AI的用户,是“中国ChatGPT时刻”,也谈到与郭帆《流浪地球3》的AI合作、AI短剧《兴安岭诡事》分账盈利,并对比了2023与2025年AI产品推荐,担心AI越来越精英化,普通用户阈值变高,内容更难做。

105: 潞晨尤洋争议中谈三方云平台 DeepSeek 成本:为何我不做 MaaS 了?
2025年3月6日 · 48:56
在 DeepSeek 开源周数据宣称成本利润率达 545% 引发热议后,潞晨科技创始人尤洋在本期访谈中回应争议:他坚持认为,中小云厂商部署 DeepSeek 并售卖 API 的 MaaS 模式是巨亏生意,潞晨已停止相关服务。DeepSeek 官方称其 24 小时处理了 608B 输入 token 和 168B 输出 token,仅用 1814 张 H800 支撑 2000 万至 3000 万日活;而尤洋实测每节点每秒输出仅约 300 token,与官方公布的 14.8K token 相差 46 倍。尤洋解释,MaaS 按 token 计费却要按 GPU 时间承担成本,在线任务序列长度波动剧烈,需准备约 5 倍冗余资源,且中小厂商缺乏模型与技术壁垒,最终只会陷入价格战。因此潞晨科技转向为传统企业提供私有模型部署(PaaS),客单价在 10 万至 100 万元之间,目标对标 AI 版 Databricks。尤洋还主张,只有像 OpenAI 这样拥有独家顶尖模型的公司才应做 MaaS,高利润是对创新的奖励,并透露潞晨正布局视频生成模型。他称自己并不想与 DeepSeek 对立,抨击的是那些宣称推理速度比英伟达方案快十倍的中小云厂商。

99: MiniMax 创始人闫俊杰:做大模型,千万别套用移动互联网的逻辑
2025年1月20日 · 1:38:11
本期节目专访估值已超30亿美元的中国大模型公司MiniMax创始人兼CEO闫俊杰,核心主张是做大模型不能套用移动互联网逻辑:更好的模型可以导向更好的应用,但更多用户并不会导向更好的模型,因此MiniMax当前最重要的目标不是增长或收入,而是加速技术迭代。围绕刚开源的MiniMax-01,他解释开源是为了让问题暴露更快、提升研发效率并补上技术品牌;新架构把Transformer的注意力机制改成线性注意力,以支撑超长上下文,为Agent所需的记忆与多智能体通讯打基础。他也复盘了行业误区与自身失误:蒸馏o1数据复现o1不难但非最优路径,海螺文本失利是因为没有坚持技术驱动,而Talkie月活已超Character.ai、星野在国内同类第一的暂时领先来自技术路线选对与更懂用户。闫俊杰认为不应把创业公司单列为一类赛道,AI行业仍是技术驱动的长跑;2025年他更期待Agent能在专业领域达到专业人士水平,MiniMax也会围绕技术迭代设定目标。

96: 和楼天城聊 Robotaxi:学习人类优秀司机,让我绝望
2024年12月25日 · 1:27:58
楼天城在小马智行这次访谈中系统阐述了Robotaxi过去5年的技术变革:L4必须从“Learning by Watching”(模仿学习)转向“Learning by Practicing”(实践学习),以世界模型作为车端模型的训练环境。他提出多个反直觉判断:模仿学习最多只能“像人”,但人类对AI司机的双标要求使像人永远达不到L4;越是优秀的人类司机,越依赖超越传感器数据的经验与直觉,模仿其行为反而是“反向优化”;世界上不存在MPI(接管里程)为1000公里的L2产品,因为那要求人一个月接管一次且始终保持专注,违背人性。小马5年前因此彻底放弃模仿学习,转向生成式数据和闭环训练,从零追赶,前两年“没有任何进展”,承受了巨大压力;他强调决定自动驾驶能力上限的不是车载模型,而是世界模型这一“工厂”的精度。世界模型包括数据生成器、驾驶行为评估体系、高真实性仿真和数据挖掘引擎,其中交互模拟和细粒度指标是核心竞争力。楼天城还明确L2+与L4是两件事:L2以低成本辅助人为目标,用模仿学习没有问题,但无法跨越安全与人性的门槛,做得越好,距离L4反而越远。商业化上,他预计1-2年内可实现成本更优的千台级无人车队运营并转正毛利,净利则要到5万台;而特斯拉如果继续坚持Learning by Watching,转向实践学习仍需时间。

84: 与侯晓迪聊特斯拉 We,Robot:烟雾与现实
2024年10月16日 · 1:08:36
Bot Auto 创始人兼 CEO、图森未来联合创始人侯晓迪与主持人程曼祺复盘特斯拉 We,Robot 发布会,认为马斯克的说法多为 hype:他称 Cybercab 每英里运营成本低于 0.2 美元,但仅电池折旧约 0.15 美元、电力和轮胎各约 0.05 美元,合计已超 0.2 美元,违背物理定律;没有方向盘和踏板更多是操控公众意志,而非技术进展。侯晓迪提出 L4 自动驾驶应统一以 CPM(每英里综合运营成本)为指引,并批评端到端被“意识形态化”:它在最优/平均场景表现尚可,但在最差场景不可解释、难以合规,无法用于 L4;他更认同“世界模型”是 David Marr 提出的中层视觉表征的延续。他还引用 Cruise CEO Kyle Vogt 在发布会前列出的 15 个运营要点,认为这些实打实的细节才是行业下一步需要解决的问题。他还认为特斯拉用 Model 3/Y“Airbnb”式接单短期不可行,责任归属无解;远程操控人车比从 1:3 走向 1:10 可能比外界预期更慢;L5 是永远达不到的地平线,L4 是要挣钱的产品。谈及再创业,侯晓迪表示已融资 2000 万美元,选择休斯敦是为贴近物流运营,并总结图森教训:不要过早扩张,重要的是利润而非收入,计划一年内让全 L4 功能车辆在休斯敦路测。

72: “听完一百位设计师的抱怨后,我找到了用AI帮他们提效的办法” ,与 Motiff 聊 AIGC 细分机会
2024年6月17日 · 1:25:24
AI设计工具Motiff的运营副总裁张昊然(出自教育公司猿辅导)在节目中解释,他为何选定这个看似小众的方向——产品界面背后是庞大的生产市场,而AI将改变生产关系。他回顾设计软件迭代:Sketch用无限画布从通用型Photoshop手中切走UI设计师,Figma靠在线协同后发制人;Adobe曾以200亿美元收购Figma遭反垄断否决,后者目前估值约125亿美元、年营收约5亿美元。Motiff的机会在于AI能解决设计师重复劳动中的高频场景,比如他调研上百位设计师后发现的最高频动作"复制粘贴",其AI复制可一键生成不同样式的卡片。商业化上,Motiff从第一天起面向全球定价,基础版每席位每月4或15美元,仅为Figma的1/3到1/5,张昊然认为未来营收应主要来自AI功能价值。对"AI是否取代设计师",他持渐进态度:低端工作会被替代,但对界面美与体验的需求会扩大;同时他援引数据称全球每天使用AI产品的人仅约4000万,渗透率远低于想象,本质是缺乏真正好产品。他还反思教育行业的技术变迁,认为拍照搜题并非最大改变,AI将改变孩子认知世界的方式。

69: 每个人活着都不舒服
2024年5月15日 · 1:00:01
本期《晚点聊 LateTalk》中,主持汉洋与《日常的深处》作者、大学教师王小伟探讨现代人“每个人活着都不舒服”的根源,核心论断是:我们活在未来,把当下视为临时,导致生活被消费逻辑和解题思维掏空。回龙观程序员收入全国顶尖,却天天外卖、深夜刷手机,因为时间终于属于自己的;所有爱好都被转译成“买装备”——骑行、摄影、露营、滑雪都要先烧钱,Citywalk不花钱就成了“街溜子”。王小伟用130元的鱼缸说明照顾与眷恋才是生活细节,并批评科技圈的慕强与“新一定更好”迷思:ChatGPT被吹捧的方式与2015年深度学习如出一辙,“更有效”不等于“更好”,就像失去工作的工人不会觉得机器好;而互联网健忘,失败的炒作总被清零。他借“老妇人与猫”的故事主张生活不是待解的难题,而是对当下情境做出回应;同时剖析“你开心就好”在不同语境下可能是冷漠、是接纳、是广告口号,而“情绪价值”变成商品化要求后,反而让亲密关系多了一项任务。他还提到朋友在996做产品经理时写科幻小说,说明拥有私人主轴就能把痛苦从“莫名的难受”转化为可接受的创作挫败。最后,两人谈到幸福像肌肉需要锻炼,人要找到只与自己相关的生活主轴——无论是写作、开车还是养鱼——才能对抗那种说不清的异化感;这也是他在《日常的深处》中回望80、90年代人与物关系的原因。

64: 让奶牛猫跳洗澡舞,与阿里通义薄列峰聊多模态共识中的变量是什么?| AI 大爆炸
2024年3月27日 · 51:20
本期《晚点聊》邀请阿里通义实验室XR实验室负责人薄列峰,聊其以“数字人”为主线的多模态研究——包括让奶牛猫跳洗澡舞的Animate Anyone、一键换装的Outfit Anyone,以及用一段语音驱动蒙娜丽莎开口说话/唱歌的EMO;他的核心判断是多模态是大模型发展的必然方向,但“世界模型”如何实现仍是最大变量。面对Sora,薄列峰认为其60秒高质视频确实震撼,但视频生成和世界模型远未解决,业界对世界模型的定义也无共识;相比谷歌、字节的视频平台积累,他提示OpenAI可能还用仿真数据,数据问题仍有挖掘空间。他解释EMO与旧Talking head方法的区别:它不只对口型,语音会同时控制表情、眼睛、头颈和上半身,且是zero shot,任意照片加音频即可生成,这得益于大模型的容量。节目还复盘了他的跨领域经历:07年博士毕业时深度学习尚非主流,在Amazon Go用深度学习解决实际视觉问题后确认其效果最好,并由此理解AI与硬件结合;他认为机器人等物理世界AI进化慢,硬件自由度与能耗是长期瓶颈。他也讲了Animate Anyone接入通义千问后的用户启发:宠物跳舞比真人跳舞更受欢迎,上传狗的人比猫更多,团队为此优化了骨骼检测;现阶段免费开放更重视用户反馈与模型能力迭代,而非成本。最后他提出世界模型的未来变量:应能模拟因果而非统计关系,是否必须3D化、是否需要能主动与物理世界交互的实体智能体,都还是开放问题。

62: 对谈哲学教授姜宇辉:哲学能解决年轻人的意义危机吗?
2024年3月14日 · 1:34:10
本期《晚点聊》中,主持人朱丽琨与华东师范大学政治与国际关系学院教授姜宇辉对谈,核心回答是:哲学不是脱离生活的抽象思辨,而是能帮人面对意义危机的多种生命策略。姜宇辉指出大众对哲学的误解与对电子游戏的误解相似,都认为它们与生活割裂;哲学不给人现成答案,而是启发人找到自己的道路。他以自身经历说明哲学要直面现实、被刺痛才能更新:经历疫情冲击,他从德勒兹式的生命创造转向列维纳斯的否定性思考——无论世界怎样,总能对它说“不”;他批评韩炳哲《倦怠社会》只诊断不给出路,纪录片里甚至没和地铁上睡觉的年轻人对话。他梳理了三种人生意义道路——柏拉图的超越论、亚里士多德的内在论、萨特的虚无论,并指出大厂使命愿景是与人无关的数字超越,而亚里士多德的“实践智慧”才是审时度势、保持快乐的可行路径;他对比哲学与心理学,认为哲学不预设人有病,也比宗教更依赖思考。他还解释为何刷手机、买买买的感官快乐必然转向空虚,以及列维纳斯“面孔”所代表的对他人的责任如何挑战既有意义;他提到与小红书卖床垫的买手交流后修正了对数字经济的偏见。最后他回忆高三雨中操场“为什么我在这里”的顿悟,主张哲学应成为提前储备的应对危机的思维框架,甚至应从儿童哲学开始。

43: 美元基金与中国科技说再见?和前律师、现 AI 创业者聊聊拜登最新行政禁令改变了什么
2023年8月23日 · 54:11
本期《晚点聊》邀请前律师、秘塔科技联合创始人王益为,以从业者视角拆解拜登8月9日行政命令及财政部立法通知,认为它标志着美元基金与中国科技“甜蜜合作”的彻底转向:美国主体(含绿卡人士)被禁向中国半导体、微电子、量子计算和AI投资,交易分“申报”和“禁止”两类,仅留下二级市场和纯财务LP两个口子;其中AI限制按用途而非技术参数划界,主观性最强。王益为说“小院高墙”的主体和对象范围不会变,但细则要等45天意见征询后可能明年落地,博弈空间有限,而更早的2024财年《国防授权法案》覆盖更广;美元基金已在自我审查式撤退,他身边有基金直接表态“绝不投这四个领域”。秘塔今年2、3月还被美元基金追捧,ChatGPT宣布不向中国开放后“一夜之间人都走了”;翻译业务因跨境IPO、海外并购消失而萎缩,美国公司在华子公司因IT安全顾虑停止续约,公司上半年虽完成去年全年营收,7月起急转直下。为此秘塔转向法律垂直大模型,计划9月底10月推出,面向法律咨询和律师助手;但王益为说国内二三线律师助理月薪仅1500元、南大法学院毕业生包吃住4000元,付费意愿薄弱,同时考虑出海和中东资金,今年目标只是拿出模型并活下去。

40: 通用机器人,AI 的下一个浪潮?
2023年7月27日 · 1:09:48
本期《晚点聊》邀请梅卡曼德创始人兼CEO邵天兰,讨论通用机器人(人形机器人、具身智能)热潮:大模型让这个目标从“登月”变成“攀登喜马拉雅山”,首次呈现可行路线,但机器人四肢的进化远慢于“大脑”,大概率出现“聪明的脑子、笨拙的四肢”。邵天兰描述,世界人工智能大会上特斯拉人形机器人仅是模型也被围观,英伟达、微软、谷歌、字节跳动、腾讯等都在布局;通用机器人必须能在物理世界操作交互,智能客服不算。他解释,今天机器人完成简单任务仍靠大量人工编程,深度学习只占小比例,比如制衣厂自动化缝纫机切换新品要编程两天,而订单一两天就生产完了,因此设备闲置;农夫山泉生产线几乎无人,因为产品常年不变,而咖啡店店员一小时可能干几十种杂事,机器人做不到;全球工业机器人年销量约50万台,仅在汽车焊接、物流搬运等稳定场景普及。大模型能带来常识和推理(如“热饭”与微波炉的关联),但手、腿、驱动器等机械部件十年进化可能不到一倍,而算力讨论单位十年进化100万倍、训练数据从1万张图片变成全网文本,所以机械是更大瓶颈;他寄望用AI在仿真中加速机械工程设计,让人一年两次的迭代变成一天千次。对人形机器人,他认为世界为人设计,人形因此是最佳形态;特斯拉Optimus若真做出能干活的第一台,是从0到1,比造电动车难得多。他还谈到酒店电梯已为送货机器人做无障碍改造,ChatGPT反而训练人更清晰地沟通,就业担忧可参考洗衣机、织布机的历史,通用机器人技术不会被一两家垄断,而会像电脑一样进入并重塑每个行业。

37: 热度很高,投资很少?与 42 章经曲凯聊聊 AI 创投水温
2023年6月7日 · 47:02
本期《晚点聊》由程曼祺对话42章经创始人曲凯,聚焦中国AI创投水温与舆论热度的落差。曲凯指出,ChatGPT爆火的关键在于首次真正to C,而国内投资人看得多、出手少:模型层受青睐但初期融资战已近尾声,应用层被低估,中间层最不受待见。他更看好应用公司反向长出模型能力的路径——正如推荐算法时代最好的公司是字节跳动,核心在好产品而非技术本身。曲凯还分享了一线服务十余个AI项目的体感:真正拿到钱的公司不足百家,以美元机构为主,to B应用更稳、to C想象空间更大,已有公司实现商业闭环、月收入数百万元且月增30%。他判断应用层被低估,未来两个月将有更多有趣产品上线,并呼吁投资人更多出手、创始人更重视产品落地而非估值。

34: 开始用上 AIGC 的艺术家:和 Tianxi/轶轩一起聊文生图
2023年4月9日 · 57:09
本集《晚点聊》邀请影像艺术家Tianxi(Tim)和轶轩,与主播汉洋一起讨论AIGC文生图对艺术创作的影响,核心观点是AI不会取代艺术家,只能作为辅助工具。Tianxi用Disco Diffusion修复照片中模糊的草等细节,把AI生成的局部合成回原图,还开发出把AI当交流对象来梳理思路的用法;轶轩用Midjourney尝试生成长城般航拍山脉的山水画效果,并复现南方古猿回望火山的历史场景,也会让AI生成书法作品作为起点。他们认为摄影不赚钱,所以不怕被AI取代,而且真实照片蕴含的大量细节与个人经验是AI难以生成的。Tianxi指出照片的定义会逐渐融入图像,AI像无形的照相机,并认为AIGC的随机性不足,若出现真随机可能帮助人类想象无法想象的东西;轶轩则指出AIGC目前无法理解梗和语境,且作品编排成册等复杂工作AI做不了。两人还谈到摄影追求真实是伪命题,因为传感器只记录灰度,颜色全靠算法插值,并批评“AI将取代职业”是武断论调,认为AI只会倒逼从业者做更有创意的事,而不会替代艺术家的独立精神。汉洋则分享自己用Midjourney生成大量爬行动物照片,并认为AIGC的限制往往在人自己的想象力。

33: 人类本质是不精确的复读机:与李如一和重轻闲聊 ChatGPT
2023年3月26日 · 1:33:07
本期《晚点聊》邀请《一天世界》主播李如一与《不在场》主理人重轻,将ChatGPT等对话式AI当作可评论的软件来审视,核心论断是:它像“力大砖飞”的工程奇迹,能做好封装型任务,却只会输出正确而沉闷的“平均值”,缺少人类语言中不可量化的偏见与错误。三人从亲身使用出发:李如一称自己没有被魔法击中的感觉,重轻连续数小时使用4.0后,对比真人文章更觉其“平”;用ChatGPT练英语会导致“去身体化”的学习,无法体会某词在语境里的微妙差别。他们进一步谈到,AI只是作者,仍不能成为读者,因此也不会带来真正的范式转移;当它声称“我是大型语言训练集合、没有立场”,恰与政治正确、不担责的公关话术同构,而好奇与少数派权利被牺牲。对于“AI替人做脏活累活,人去做创造”,他们反驳说创造本身就有机地包含脏活,根本切不开。OpenAI不再Open在预料之中,Sam Altman的写作混乱也令李如一不看好其愿景。最后回到“人类本质是复读机”,他们强调人类是“不精确的复读机”,偏差与错误正是艺术和新事物的来源,太阳底下并非无新事。
由 PodHood 提供支持