111: Pokee.ai 朱哲清的 Agent 造法:强化学习作后端,语言模型作前端|Agent#3
2025年4月22日 · 1:34:56
本期嘉宾是 Pokee.ai 创始人朱哲清(Bill),他在《晚点聊》中提出一种与主流不同的 Agent 造法:大语言模型(LLM)只是 Agent 与人类交互的“前端”,后端决策与执行应由不依赖自然语言的强化学习(RL)模型完成。他批评以 LLM 为大脑的做法,称其上下文长度有限,调用工具超过 50 个就会产生幻觉,难以支撑复杂多步任务;而 Pokee.ai 用 RL 模型驱动,已打通几十个平台的上千个 API,单次任务成本约为同类产品的十分之一,执行一项任务只需数十秒。朱哲清还总结了优秀通用 Agent 的四要素:比人快、无需人工干预、能读能写、成本低,并认为技术本身不是护城河,真正的壁垒在于与用户工作流深度绑定。他分享了自己的创业历程:从斯坦福读博与 Meta 全职并行,到早期做旅行规划 demo、Shopify 垂直 Agent,直到 DeepSeek R1 带火强化学习后回归通用 Agent 方向;团队只有四人,却吸引了大量投资人和客户。关于行业竞争,他判断未来会存留三到五家公司,接下来各家将走向差异化;此外,他还给出了判断技术潜力的方法论——先构建一个极简的 ‘Toy Example’,证明只有你的技术能普适性地解决它,再投入规模化。