开场0:00
欢迎收听 《 晚点聊 》, 我是曼祺 。 这是 《I,AI》 的第二期 , 这个系列会讨论 AI 和我们日常工作与生活的关系 。
这一期的嘉宾是 Meta GenAI 研究总监田渊栋 ,他既是 AI 研究者 , 自 2005 年开始探索智能和人工智能 , 最近 10 年他一直在 Meta 从事 AI 研发 。
田渊栋也有另一重职业生涯 : 做一名小说家 。 从博士生期间开始 ,他就陆陆续续地写小说 ,在 2021 年连载完了第一部长篇科幻小说 《 破晓之钟 》。
这本书在 2024 年正式出版 。《 破晓之钟 》 是写作于 ChatGPT 热潮之前的书 , 全部内容都是人写的 , 没有 AI。 而书里的核心科幻概念和点子 , 则体现了一个 AI 科学家的技术思维 。
田渊栋认为 , 每个技术时代 —— 工业时代 、 电气时代 、 信息时代 、 智能时代 —— 都对应不同的科幻命题和故事 。他就是想写出有 "AI 内核 " 的科幻 。
回头看 , 书里的一些核心设计 , 预言了后来围绕算力与智能的攻防战 ,也讨论了当人类不再需要工作时, 可能会带来什么危机 。
这一期我们会从 《 破晓之钟 》 这本书开始聊 , 延展到田渊栋对未来 AI 技术 、 社会与人类命运的想象 。
因为这本书里的主角和英雄们是一群研究者 , 我们也由此聊了 AI 研究人员的生活与选择 。 最后, 田渊栋也分享了 2023 年之后 ,他如何尝试在写作的工作流程里加入更多的 AI:AI 现在到底能做什么 , 还是不能做什么 。
因为本期节目的目的 , 所以因此有一些瑕疵 , 请听友见谅 。 本期中提到的 《 破晓之钟 》 的续作 《 幽夜星火 》 正在网上连载 , 连载地址我贴在了 show notes 里的相关链接部分 , 感兴趣的朋友们可以阅读 。
下面我们就正式进入本期节目吧 。
今天很高兴邀请到 Meta GenAI 的田渊栋做客 《 晚点聊 》。他的主要研究方向包括决策 、 强化学习算法设计等 , 曾领导了 OpenGo 这个围棋项目 。
不过这期的主题比较特别 , 我们不是聊具体的 AI 研究 ,而是关于田渊栋的一项业余活动 —— 科幻小说创作 。
田老师去年也正式出版了 2021 年连载完的一本科幻小说 《 破晓之钟 》。 这本书中包含了一个 AI 研究者对未来世界的一些推演 , 所以今天我们是想以这本书为线索 , 来聊一聊未来的 AI 和我们的生活 。
田老师 , 你可以和我们的听友打一个招呼 , 简单地自我介绍一下 。
嗯 , 大家好 , 大家好 。 我叫田渊栋 , 我现在在 Meta GenAI 做一个总监的这样的职位 。 然后我们这边有一些团队在做一些关于推理 、 大模型推理的一些工作吧 , 大概是这样子 。
我在 Meta 已经 10 年多了 , 然后一直是在做人工智能方向的工作 。 然而业余的时间 , 我是有一些比较特别的爱好 , 包括就是写科幻小说这样 。
那么我写小说已经很多年了 , 我可能是 2005 到 2006 年开始接触网络小说 ,并且想要尝试自己写 。 那一开始写得不是特别好 , 后来就是慢慢慢慢有一些感悟吧 , 所以中间其实是写了一些小说的 。
那么这次这部 《 破晓之钟 》 呢 ,是在 2020 年开始连载 。 当然就连载之前呢 ,其实已经有大量的存稿 。
那么当时是这样 , 这本小说一直是有构思 , 然后有一些片段 。在写完之后, 就是我会觉得 , 如果没有一个连载的压力的话呢 , 可能这本小说永远不会完稿 。
所以就是在 2020 年的某一天 ,因为当时也是疫情 ,也比较无聊 , 所以就是会去想 , 就是某一天跟大家说 : 我们要连载一部小说 。
那么这样的话 , 就会有线上的压力 , 那么就每天就必须要写出去一章 。 那么通过这个方式呢 , 大概写了 3 个多月到 4 个月左右 , 最终把这部小说给连载完了 。
所以其中呢 , 就是在这个比较紧张的这样过程中呢 ,其实有很多的感悟吧 ,也有很多的学习到的一些知识和体验 。
所以在小说连载完之后呢 , 大概在 2022 年、2023 年的时候呢 , 电子工业出版社联系到我 ,他们对这部小说的出版是有兴趣的 。
当时我也是比较 , 我也是比较惊讶 ,因为我其实放在网上写的也是写着玩的嘛 ,但是放在书上连载 ,其实也是有不少的评论 。
那么但是后来想了想 , 就是既然有出版社联系我 , 那肯定是希望这部小说有个圆满的结局吧 , 所以最后同意了 。
然后 2024 年, 就是去年 6 月份 , 终于正式出版了 。 对 , 现在在豆瓣上和在微信读书上都有 。 那么现在豆瓣评分是 7.9, 还可以吧 , 还还就是已经算是挺不错的一个分数 。
对 , 微信上, 微信读上是前面 75%。 所以都还可以 , 就是属于值得一读的这个范围 。 不是说特别差 ,但肯定也不会特别好 。
但是作为我的一个业余爱好呢 ,其实这个已经出乎我的意料之外了 。 我觉得非常感谢广大读者对我的支持 。
你可以就是讲一讲 《 破晓之钟 》 的大概的故事情节吗 ? 因为这样的话 , 我觉得方便就是没有看过这本小说的听友 ,他可以比较好地进入到我们后面的讨论 。
故事设定5:04
对 , 这本小说其实 , 怎么说呢 , 它主题呢是想要做一些在人工智能这个时代的科学幻想 。 因为大家都知道 , 就是每一个时代都有自己的科学幻想 。
就是蒸汽时代 , 大家都幻想着就开着飞机 , 我去很远的地方 。 如果到电气时代或者到机械时代 , 大家比如说像海底两万里 , 就是我开着一个金属质的一个潜艇 , 我潜到很远很远的地方 。
或者说我把那个叫 《 凡尔纳的小说 》, 把那个一个大的桶 , 一个金属桶把它射到月球上去 , 然后在那边去进行探索 。
所以这些其实都是在反映 , 就是在那个时候的科技生产力水平下, 对应的这个小说的和科幻的这样的一个思维和方式 。
那么其实在人工智能时代出现之前 , 大家其实也对人工智能有很大的幻想 。 就比如说计算机刚出来的时候呢 , 很多人其实就已经开始设想 , 如果以后有机器比人更厉害 、 更聪明 , 那么这个社会是什么样子的 。
这个幻想其实在 , 应该说在 50 年、60 年前都已经出现了 。195 几年、196 几年的时候就已经出现 ,因为那个时候曾经有一次是第一波人工智能的一个浪潮 。
大家会觉得就是用计算机的方式去模拟人脑 , 能够达到人脑相当水平 , 甚至比人脑的水平更优 。
幻想出了大量的就是机器人的这种形态 , 对吧 ? 对 ,但是这些形态呢 , 往往都是比较刻板的 ,有这种刻板印象 。
比如说都是计算极其精确 ,但是没有缺乏人类情感 。 就是那种类型的机器人, 或者说机器人永远超越不了人类的这样的一些论调啊 , 就是这样的一个论调 。
但是真的到 2020 年、21 年、22 年的时候 ,ChatGPT 出来 , 然后我们再次卷入了一个深圳式人工智能的这个浪潮之中的时候呢 , 再回去看之前的 50、60 年代的那些幻想呢 ,其实有些时候会觉得它其实应该说是比较偏颇的吧 。
就是你有很多很多的当时的设想 , 跟现在呢其实是不一样的 。其实这样 。 所以这部小说当时呢 , 就是我写的时候呢 ,其实那个深圳式 AI 还没有真正出现 。
当时是应该说是前一波深度学习的浪潮刚刚过去 ,但是大家可能看到平台期的这样一个时间段 。 那这样 , 当时我们就在想 , 就是如果 AI 真的发展到很厉害的时候 , 会有什么样的一个故事出现 。
那么这部小说同时也是柔和了我之前在博士阶段的一些感悟和心得吧 。 当时我也写了很多小碎的这种小心得 , 或者说小的一些文字 。
那我希望总有一天能够把这东西写出来 。 所以这是一部其实相对来说比较有一些杂糅风格的一些小说嘛 。
所以它应该说是这样 , 它其实融合了其实比如说少年时候的这种少年心性 。 我说我是做一个弱者 , 我想妈妈要逆风翻盘这样的一个心态 。
同时又结合了一个就是中年大叔的这样的一种想法吧 。 就是说对中年大叔来说 , 一个重要的事 , 我是不是应该躺平啊 , 然后在原地过完自己一生 , 还是说不甘寂寞 , 想做一些有趣的新的事情 。
就是说有这样的各种各样的一些思维结合起来之后呢 , 产生了这样一部小说 。 总的那个故事情节呢 , 应该说是比较老套的吧 。
就是很简单了 , 外星人入侵地球 , 然后呢我们怎么样战胜外星人, 或者说不能说战胜外星人嘛 ,但是至少能跟它打得有来有回 , 最终获取自己应得的一个地位 。
大概是这样一个思路 。 只是说在这个新的 AI 时代的那个背景下, 我们怎么样把这个故事演绎得更像是现在新时代 AI 浪潮之后, 我们对这个世界有更新的认知了之后呢 , 它应该会发生的这个故事 。
所以大概是这样的一个故事 。
对 , 我可以补充一下这个情节 。 因为刚才其实田老师讲了比较多他想表达的东西 。 对 , 大的框架就是你刚才说的 , 外星人要来入侵地球 , 这是银河联盟对吧 , 派来的一个 , 你可以叫做一个前哨吧 , 要来入侵地球 。
然后它入侵地球的方式 , 我觉得也是挺 AI 的 。 它不是像以前那样 , 就是我直接来攻击地球 。 它给地球人算是设置了一个诱惑 , 这个诱惑就是可以让很多地球人生活到一个虚拟世界里 。在这个虚拟世界里 , 你是衣食无忧的 ,而且你不会变老 , 你也可以就是一直地生活下去 ,不会死 。
以及你在现实生活中可能是残疾 , 或者说有各种缺陷的人, 你到了这个虚拟的世界里也可以获得一个更完整 、 更健康的身体 。
你的触觉这些感官都是非常的真实的 。 就给了这样一种选择 , 就相当于在人类之中就分成了两派 。
有一类人就要去这个虚拟世界生活 , 然后还有一类人 ,他们只能苟延残喘在地下 。 因为虽然它没有攻击地球本体 ,但是它反正就是对太阳做了什么 , 导致这个地球的能源供给出了一些问题 。
对 , 就大概是一个大的危机背景 。 然后最后就是你刚刚说的 , 人类怎么去跟它战斗 , 然后获得一个应有的地位 。
它这个战斗的方式 , 我觉得也是非常 AI 的 。 就也不是以前那样 , 就是直接比如说我开个飞船去和外星人打 , 就不完全是那样 。
大概是这样一个故事情节 。 以及比较特别的是 , 就是这个故事里的这一群带领人类去对抗外星人的主角 ,他是一群博士生 , 可以这么说吧 , 一群研究者 。
对 , 一群科研人员吧 , 对吧 ? 就是这也是 , 就是为什么我当时在科研阶段或有博士阶段会有很多很多这个素材 。
那么这些素材最终会用在 , 就是它有个制作性 , 对吧 ? 可能 10 年以前才拿到这个 , 这个故事里面去用 。
所以就会有这样的一个设定吧 。
那我们可以展望 , 就是你刚才讲到有一个主题 , 就是你写这个小说的一个设想 , 我觉得是很有意思的 。
就是每一个不同的技术时代 , 它其实有不同的科学幻想 , 对吧 ? 从可能以前有蒸汽朋克 , 然后是凡尔纳那个海底两万里那个工业革命的时代 , 然后你想表达的是 AI 时代它可能的科学幻想 。
确实你这个书里有很多设置 , 我看的时候 , 我是我觉得能看出来这作者确实搞 AI 的 。 然后我自己也联想了一些 , 比如说我看到好像是有强化学习 ,因为这个里面就是大家居住的那个虚拟世界 , 它有个物理载体 , 就是叫灵界立方嘛 。
然后在这个里面 , 它其实大家也是在想 , 就是说这个里面是不是可以通过左右互搏 , 然后这个立方本身涌现出智能 。
我好像也看到了 , 就是后面 23 年 ChatGPT 火了之后, 很多人讨论的对齐 , 你这个小说里也提到了 。 就是说最开始捡到 , 或者说发现这个立方的那个人类 ,他是其实是想利用这个外星人的这个手段来保存人类的一些火种的 ,但是他觉得这个里面必须要内置一个人类的思维 , 否则他觉得就是这个立方可能和我们人的价值观是不统一的 。
这个我觉得也很像对齐的那一部分 。 包括里面还有一些就是它计算这个相似性什么 , 这个大家可以自己去看具体的情节 。
我觉得有点像这个注意力机制 。 就是您自己可以完整讲讲 , 就是您哪些设计是来自你对 AI 技术的一些思维的应用 , 然后把它放到这个故事情节里的 。
对 , 就是您看着很细 , 我觉得这个我非常感动 。 作者 , 作者 , 就是里面有一个地方呢 ,其实我应该说是一个表达的设定嘛 。
科幻设定12:03
然后这个设定其实也跟最近的那个 AI 的进展也是非常吻合了 。 当然这个我觉得也是让我觉得非常惊讶的一点 。
因为我们当时在写的时候呢 ,是 2021 年、2020 年的时候 , 当时呢大家都用了那个新伟达的卡 ,但是没有人真的去拿这张卡做很大的集群 , 做很大的训练 。
所以我在这本书里面就是这么写 , 就是说可能就是就承载每个人意志的意识的一个临界立方 , 就有个小的 , 就假设有抽象的东西 , 小立方 。
那么这个东西其实影射了就是比如说英伟达的 GPU, 对吧 ? 这样子 。 然后呢 , 那个立方之间是可以互联的 。
那么互联之后呢 , 它如果互联的带宽足够大呢 , 那么它们碰在一起 , 那么进行计算呢 , 会产生一个超级的智能 。
当时这是这样的一个设定 。 但是呢 , 就是无独有偶 ,在那个 23 年、24 年之后呢 , 你会发现就是确实 GPU 和 GPU 之间其实可以通过比如说 NVIDIA 那个 NVLink 连起来 , 它的速度非常快的 。
那么有这样的很快的互联方式呢 , 它的训练才会有很大的一个提高 。 那么但是呢 , 就是说如果互联的那个速度不够快呢 , 就可以限制这个整个集群的这样一个训练的速度和达成的那个超级智能的程度 。
大概是这样 。 那么其实这个跟这个银河联盟在这部小说里面用的方案也是一样的 。 对 , 所以这个是很有意思 。
那么破解这样方案的一个方法呢 ,其实也是就是通过某种方式呢去压缩这个两个立方之间的那个通信的带宽 。
就是说也许带宽就这么点 ,但是呢我可以通过某种方式把信息通过某种样方式传过去 , 这样不用损失信息本身 ,但同时可以降低这个带宽的程度 。
那么当时呢 , 就是小说里面有一些角色像苏燕把这个问题通过某种方式解决了 。 那么现实世界里面呢 , 你会发现其实大家广大研究者呢其实也用这种方式去绕过了这样的一些限制 。
所以其实很多时候呢 , 就是研究的思路呢和科幻的思路很多时候呢是有一致性的 。 所以这个很有意思 。
你当时 2020 年开始写这个小说嘛 , 你当时设定临界立方 , 你心里想的就是英伟达的 GPU 什么 。
这肯定是有关系的 。 对 ,因为我觉得 GPU 是当年的 , 就是 2022 年的时候是当然能看见 , 就是对 GPU 需求是很大的 。
就是我们如果做深度学习 , 肯定是要 GPU, 这个没有任何问题 。 那么 GPU 怎么把它连起来 , 然后变成一个巨大无比的集群 , 然后去训练 。
那么这个当时也是有 ,但是并没有想过就是这个通过这个训练呢 , 我们可以得到像大语言模型这样一些非常强的模型 。
那么这模型可以做很多事情 。 当时其实并没有预见到这样的训练能够那么快的时间内达到那么好的效果 。
这个我觉得我应该说没想到 。 我把它作为科幻点子来写的 。
对 , 两年之后科幻照进现实 。
所以这个是我也是挺非常惊讶的事情 。 因为我觉得我把它写成科幻点子 , 意味着就可能这件事情可能要过 10 年或者 50 年才能发生 ,但其实没有 。
所以这个有些时候会觉得科幻小说还是早点写 ,不然的话可能点子就过时了 。 因为别人玩实践了 , 我们现在这个进化已经到这样的速度 。
对 , 你刚才讲到那个互联确实最近有很多进展 。 因为 24 年在 GDC 上 ,其实黄仁勋就是也是 ,他当时不是讲了这个 NVL72 吗 ?
就是我把那个 72 个单格的芯片连起来 , 一个更大的互联方式 。 最近华为也发了一个新的技术 ,他们叫超节点 ,他们那个更吓人 ,他们是 380 多个芯片 , 然后连起来 。
一个是弥补它单个芯片的性能可能没有英伟达好 , 另外可能就它也是应该是通过什么方式 , 就是去把这个通信做得更好 , 然后让整个系统的性能可能达到一个差不多的这个状态 。
我觉得这些都还挺实际的 , 就是这个从情节里看还挺有前瞻性的 。
这个我觉得应该是很有趣的一个体验 。 对 , 就是发现自己写东西 , 后来就真的成为了一个不一样的方法 ,在现实中呈现出来 。
其实你刚才也提到 , 就是这本书是有一些是你的科幻的想法 , 或者是对 AI 技术的想法 , 然后有一些是你多年来积累的在做研究 , 包括读研究生 、 读博士期间的一些心得 。
这也是我看这个书的我自己的一个感受 , 就是它是给你两种很反差的体验的 。 一是基本上所有科幻小说都会包含的一些科幻概念 , 或者是你刚刚说的科幻点子 , 比如说这个里面的灵界 ,以及它的情节上确实也是比较经典典型的科幻 , 就有末日危机 , 然后人类面临生死存亡的抉择 。
但是另一方面它又有非常日常的一面 , 就是你这里面写了很多科研工作者什么怎么开组会了 , 师兄怎么带师弟 , 然后导师是一个什么样的角色 , 怎么去争取资源 ,以及不同的学术思路 , 然后还有一些办公室政治之类的东西 。
就对吧 , 学术圈也有人情世故 。 所以我觉得接下来我们可以分这两个大的方面去展开聊一聊 。 第一部分我觉得可能更多是聊 AI 和未来 , 然后第二部分我觉得是可能对挺多更年轻的研究者 , 我觉得也会有一些启发吧 。
就我可以讲一下就是 《 破晓之钟 》 里展现的这个未来世界 。 就我读到的一个大的部分 , 就是我刚才说的 ,其实是把人类置于一个两种选择嘛 。
两种选择16:52
人类变成了两派 , 一类它是走向虚拟世界 , 可以安稳的生活 ,但是他们应该不可能再有更多的科学发现和进步了 。
因为其实你是生活在外星人给你就是设置的这个虚拟空间里面 。 然后还有一派就是我们要奋力一搏 , 我们要对抗银河联盟强加的这个安乐世界 , 去自主的寻找在宇宙中发展的空间 。
然后就你可以讲讲就是你当时设计的这个大的这个情节是怎么想的 , 这个算是本书的一个出发点之一吗 ?
对 , 就是当然就是这种就是小作者里面这种冲突呢 , 肯定是必要的 ,不然的话就不好看了 。 所以你永远会存在这样的一个可能 , 就是说你总是会想就是我 AI 对于人类来说 , 我到底是想要一个欲去欲求的一个世界 , 然后就不用去探索了呢 , 还是说我希望真的去永远去找未知的世界 。
那么这未知世界是你没有经历过的 , 这个总是会出现的 。 那我觉得就这部小说应该可能比如说比较有意思的一个点 , 就是也许最终的结论答案是两者这个一个结合 , 这样的一个答案 。
就是说我们一方面确实还是需要最终可能会走进虚拟世界 , 这是我觉得是有可能的 ,而且很大可能 。 另一方面呢 , 就是我们可以带着虚拟世界继续去星际里流浪 。
我觉得就是说也许就是这两边都会有 ,因为毕竟人类的肉体还是太脆弱了 。 所以你要把一个人把一个宇航员放松向太空 , 所以需要很多需要很大的能量 ,而且还需要照顾他的各种饮食起居 , 然后照顾他的各种那个身体上的需求 。
但是那个这个其实就是对于星际航行来说呢 ,其实是很大的负担 。 这个是一个 。 然后另外呢 , 就是说然后人的肉体呢 ,在 100 年之后呢 ,其实还是会腐朽的 , 对吧 ?
所以肯定是需要有办法去让肉体能够有永生的能力 。 所以最终人进入虚拟世界 , 我觉得这个是不可避免的 。
但是呢 , 就是在进入虚拟世界之后呢 , 人本身的求知的和那个欲望呢 , 或者说人本身对未来这个探求呢 ,其实也仍然是会存在在那里 。
所以最终我们还是会愿意去翱翔在星海之中 。 所以这两个应该是合在一起的 ,而不是对立的 。
所以这个其实我很早以前就想过这个问题 。 我觉得这可能是我们唯一的一个真的走出太阳系的方案吧 。
这个选择就是你要看到 ,其实要看到这个小说很后面你才会发现 ,是你刚刚说的那个方案 。 就是一方面大家又是在虚拟世界里 , 就所有人类其实最后都进入了虚拟世界 ,但是它其实还是有一个计算载体的 。
这个计算载体是可以在宇宙中的不同的地方去探索的 。 就那个时候其实我们已经在你这个小说里是已经来到比邻星了 , 对吧 ?
不在太阳系了 。
对 , 太阳系已经被大战毁灭了 , 比如说这样子 。 所以大概是这样的一个思路吧 。 当然这是最后的一部分吧 。
对 , 所以这个还是一个比较有意思的一个方案吧 , 就是最后会这样 。 那么这里面会带来很各种各样的问题 。
这个问题就是说 ,因为一个首要的问题就是说 , 你可能会在一个虚拟世界里面突然之间 , 你所有毕生所追求的所有东西马上唾手可得了 , 对吧 ?
你要多少钱就有很多钱 , 你要海景房 , 马上脑袋一动就有个海景房送给你 。 如果你要什么香椿美女 , 马上就有无数香椿美女送过来 。
对 , 所以就是对于就是在这个虚拟世界中, 就是日常的 , 或者说是之前在现实社会现实世界里面那些所有的欲望全部都变成了唾手可得的东西的话 , 那么人本身的这个进步的能力 , 人的那个进取的那个动力到底在哪里 ?
我觉得这个是一个很大的问题 。 我觉得这个可能是就是之后就是第二步会继续写的这样的一个主题 。 这个可能就是未来世界怎么样能够让未来世界还有动力继续前进 , 所以这个是一个很大的问题 。
其实你这个小说后面也写到了一些 , 就是在这个虚拟世界里它也是有经济系统的 , 甚至还有房价 , 对吧 ?
然后就那虚拟世界里的人到后面还在讨论说这个房价在上涨什么的 。
对 , 这个是因为是这样 , 就是比如说吧 , 我们可以说就是一开始造出来的这个虚拟世界是一个第一版 ,有灵界 1.0 版 。
那么这个版本里面呢 , 所有人的欲望都会被满足 。 那么大家后来发现了这个版本的问题 ,因为里面的那些人呢 ,其实已经不在乎地球安危了 。
就是对他们来说 , 地球其实是一个遥不可及的梦 。他们在里面待了半年之后, 他已经就被他不记得这个地球这个东西了 ,因为生活太舒适了 。
所以对于这个就是母星啊 , 或者说对于那么这个虚拟世界的物质基础 ,他们没有很深的理解 。 所以那么这一版呢 , 就是会让就是因为我们在这个小说后期其实会想写到一些这方面的一个工作 , 就是说比如说吧 , 我们让灵界的人和虚拟世界的人和现实世界的人去投票 , 投票到底是愿不愿意加入银河联盟 。
投降了 , 我们说我们就直接加入银河联盟算了 , 我们不想跟你打 。 如果你要投票的话 , 你觉得你们灵界的人会投给谁 ?
就是大家真的去想想的时候 , 你会觉得灵界的人其实会更愿意去直接加入银河联盟 ,而并不是说去要维护母星本身的一个独立性 。
所以这个其实是对于这个可能对于灵界 1.0 版本 , 这个版本可能质量就会有一些人会觉得这个版本不是特别好 。
所以在这个故事的最后呢 ,其实倒退到了一个就比如说灵界的 1.5 版本 , 那个版本里面可能比如说房子呢 , 或者说是物品呢 ,并不是完全完全无价的赠送的 , 那可能是需要回到就是现实生活中的经济系统 , 让大家拥有这个动力去继续努力 。
但是这个版本应该说不是一个完美的版本 ,因为这个版本本身呢 , 就不是很稳定的 。 所以在第二步里面呢 , 应该会讲一下它的弱点 , 还有讲一下有没有什么更好的方案 。
所以这些东西其实是会有很有意思的 , 就是可以会继续往下想 。 因为在这个新的系统中, 就是什么样的经济系统是稳定的 , 然后最终大家会以什么样的方式和思路去在这个虚拟世界中生活 , 然后呢 , 继续爆发出各自的重要的创造力 。
我觉得这个是个很有意思的话题 。
结局悬念22:41
其实这个故事到最后还有一个悬念 , 苏燕就是这是其中一个角色 , 她算是带领人类成功反抗银河联盟的最大功臣之一 , 然后还有小何也是这个反抗者的其中之一 。
然后他们最后的一个对话其实揭示出了 , 就有可能就这个小说最后展示了这个结局 ,也不是说人类真的逃离了银河联盟 ,而是银河联盟就像梦中梦一样 , 就银河联盟让你以为你逃离了银河联盟 ,其实你还是在它所设置的这个虚拟空间里面 。
这个有点像黑镜最近一期就是讲的那个 , 比如说宇宙那个 Infinity 的那种游戏的感觉 ,其实你还是在这个虚拟世界里 。
作者可以官方解答一下吗 ? 就这个悬念它到底是更偏向我们真的跑出来了 , 还是我们实际上还是在银河联盟的控制之下 ?
应该说是这样 , 就是说这个是有解答的 ,因为这个其实是一个藏得很深的一个坑 , 这个坑会在第二步出现 。
对 , 我觉得就是说其实应该这么说吧 , 就是说其实还是会受到比如说在联盟联盟的控制之下 ,但是呢 , 这个控制呢 ,不是像虚拟世界那样进行的完全的控制 。
那么这一方面呢 ,其实体现出了就是银河联盟本身的科技含量是很高的 , 还有很多黑科技 , 你想象不到黑科技能够让能够制造还是能把你控制住 。
但是另外一方面呢 ,其实也是说就是也可以引出银河联盟本身的它的目的 , 就是说它对于偏远行星的一个文明来说 , 为什么它要千里迢迢的跑到你这来 , 就是对你做一些事情 。
这个其实说实在的 , 就是这个事情呢 , 如果没想清楚的话 ,其实很违背逻辑的 。 因为就如果比如说我们把我们比作我们现在是在银河系的第三玄壁的某个角落里面 , 这个角落应该说是非常荒芜的 , 非常那个跟中心一点关系没有的一个小村庄 , 比如这样子 。
为什么比如说那个银河系中央的大军要跑到我们这来 , 对 , 跟特别对我们这些人有兴趣 。 所以这个其实那个背后呢 ,其实是有那个银河联盟的一个目的的一个深层次的一个解读的 。
所以这两个其实是结合在一起的 。 因为这样 , 所以他们才会过来 ,他们才会采取就是各种手段嘛 。
就比如说如果这个银河文明是不是特别强的 , 那他们可以对它置之不理 。 如果这个文明比较强 , 那么我们可以希望银河联盟会说我希望你加入我们 , 就像那个小说里面讲的那样子 , 我们搞个通告说你们加入了 , 你们现在是 A 级文明 , 我们很荣幸的把你们拉进来 。
但是如果那个当地的文明 , 这个文明再强一点的话呢 , 就是这个时候呢 , 银河联盟会感到威胁 。
那么这个威胁他们是怎么样去处理的 , 然后他们是怎么样对待这个当地的这个新的文明的 。
所以这个其实是不一样的 。 如果要剧透一点的话 , 应该是这么说 ,因为最终对银河联盟来说 , 它想要的是一个叫就是独一无二的这样的一个性质 。
因为对于银河联盟来说 , 很重要的是 , 它已经完成了一个非常高级的文明 , 能达成的一切 , 比如说任何一个个体 , 它都有一个叫所思即所得的能力 , 就是他们想到什么 , 这件事情马上就会具象化 , 成为真实的东西 , 这东西可以为他而服务 。
我想我要一个工厂 , 然后马上就工厂建起来 ; 我要一个飞船 , 这个飞船马上就建起来了 。 所以这个过程应该是非常顺滑的 ,因为科技已经达到了很高的境界 , 这个整个生产过程是毫无问题 , 毫无障碍的 。
那么对于这样的一个那个文明来说呢 , 它到底还需要什么 ? 就是我想要的所有东西都已经会马上满足 。
所以我当时就是我觉得吧 , 再往下走的话呢 ,他们想需要的是什么呢 ? 他们想要知道的是自己是不是处在就是发展的一个最优路径上面 。
因为如果这个联盟或者这样的一个高等文明 , 它有这个能力的时候呢 , 它也会担心就是自己的思路走入了一个死胡同 。
那么如果有偏远地区的任何一个新的文明 ,他们可以同样有这个所思即所得的能力 ,但是呢 ,他们有一种新的思路和新的见解 。
那么这种新的思路和新的见解可以通过所思即所得的能力瞬间具象化 , 然后变成了一个比银河联盟更加强大的 , 或者更加有能力的这样的一个一套体系 。
这套体系呢 , 就会代替银河联盟本身 。 这个其实可以类比成什么呢 ? 就是应该说 100 多年前 , 比如说那个清政府跟比如说八国联军 , 或者跟那个那些殖民政府去聊的时候呢 , 就是一开始比如说他们会觉得我们要把那些路都修好 , 那些路修好之后呢 , 就是那些偏远的村庄 ,他们就可以把那些物资运出来 , 然后卖给别人, 这个是一个很好的想法
。 但是过一阵子呢 , 清政府会觉得我不应该修这条路 ,因为修了这条路之后呢 , 就是虽然说那些偏远村庄的物资能很快的运出来 ,但是呢 , 别人也会很快的打进去 。
所以就是为了让那个自己不那么容易被征服 , 宁愿把那条路修得差一点 。 那么这个其实和银河联盟的这个设计是一样的 , 就是银河联盟已经到了比如说已经想到什么就已经会发生的这样一个这样一个境界之后呢 , 那么任何一个外来的人, 或者说外来的一个思路 , 它都会马上变成现实 。
那么这个现实可能会威胁到联盟本身的一个架构 。在这种情况下 ,其实它其实非常是希望找到银河系的每一个角落里面的一个新的新生的这样的文明 。
那么看这个文明呢 ,有什么新的思路和新的想法能够被银河联盟所吸纳 ,但是呢 , 又能够置于银河联盟的控制之下 ,不会产生和银河联盟不一样的这个一个异己的力量 。
我觉得这个可能是银河联盟的一个就是在这样的一个情况下, 它的一个最大的一个目的 。 如果地球成为这样的一个地位的时候呢 , 那么它就要小心对待了 。
因为对于银河联盟来说 , 一个是我希望把这块东西保留起来 ,因为他们是他们里面有一些非常先进的思路 , 这些思路呢 , 可能银河联盟自己是没有的 。
所以我们希望它保留起来 , 就像把它变成一个野外保护地一样的地方 。 我不希望自己的想法去污染它 。
如果污染它了之后, 那么这块地就没有用了 ,因为这块地的思维就被我同化了 。 那么它的一些新的想法和新的思维就没有办法再展现出来 。
但是另外一方面呢 , 我又不希望这块地呢 , 发展得太过太过厉害 , 然后呢 , 反过来把通过银河联盟的这个科技呢 , 把它的那个思路呢 , 给展现出来 。
所以它其实是应该是一个非常矛盾的这样一个中间状态 。 所以这就为什么就是最终在第一步的结局的时候呢 ,是会有这样的一个结构出来 。
那这个其实是原因就在这 。
就其实是因为它得让你以为你自己是独立的 , 你还在探索未知 , 你才能真的有产生不同的想法 。
但是它又要把这种探索置于它的控制之下 。
是的 , 这个是就是为什么它会有这样的一个措施的一样原因 。
你刚才讲的这个我觉得也特别反映了 , 就是从之前的工业革命时代到现在 AI 的不同的科学幻想 。 因为你看这本小说 , 可能你最开始看到这个外星人的表层的目的 , 它是比较像以前的那种目的的 , 就是它是为了争夺能源 , 就是最开始的表层的目的 。
但实际上它最后它想要的是智能 , 或者叫智慧 , 或者 idea, 散落在宇宙各处的 ,不管它有多么偏远的地方的可能性的不同的智慧 , 它想要的是这个 。
是的 ,是这样 。 这个应该说是那个第二步的一个动机吧 , 就是说这套要怎么写 , 应该是这样方式去写 。
但是具体就是说银河联盟本身它的社会形态是什么样子 , 然后会有产生什么样的故事 , 这个我觉得应该会挺有趣的 。
所思即得29:44
你觉得就是如果真的到了所思即所得的这个状态 , 首先是你觉得科技有可能到这个状态吗 ? 其次就是如果到了这个状态之后, 可能会面临的大危机是什么呀 ?
就可能会面临的非常高级的文明 ,也会遇到的大的危险可能会是什么 ?
对 , 我觉得是这样 , 就是首先第一个在科技上来说呢 , 这个应该是迟早会发生的 。 因为我们的就是你看过去 400 年的这样的科技史 , 就是其实很多时候是把一个很难的问题转化成一个很简单的问题 , 然后最后变成了水和空气那样子 , 就是突如可得的东西 。
这个过程一直在发生 , 比如说我们的手机 , 就当年这个 EMIC 这个计算机做出来是算大道的 , 像算高大上的那些科学计算 , 现在我们这些手机里面的芯片速度比原来的那个晶体管要快大几百万倍 ,但是拿来 OK, 我们玩游戏 , 玩上网页 。
所以这个是通过这个方式呢 , 把这个高大上的东西平民化 , 然后最终呢 , 变成一个水和空气一样的这样的东西 。
那么中间的很多链条 , 很多科技上的一些具体的那个技术上的困难呢 , 被它绕过去了 , 然后变成了就让这个思路可以直接和最后的那个结果能结合起来 。
所以这个过程一直一直在出现 , 一直在出现 , 所以一直在迭代 。 所以我觉得以后如果中间有任何的科技上的一些困难 , 那么这些困难也会被克服 , 然后被压缩到一个就是你看不见的地方 , 然后你的思路和你的想法会直接的作用于这个现实世界 。
那么现实世界可以得到你想要的东西 。 所以这个过程一直一直在出现 , 一直而且是一直存在的 。 所以我觉得这个事情一定会发生 , 虽然说我不知道是什么时候会发生 ,因为有很多的技术上的限制或技术上的那个局限性 , 需要大家去克服 。
但是总的来说呢 , 我觉得以后一定会一定会出现的 。 就比如说我现在把水龙头一打开 , 就有水哗哗哗流下来 。
但是那个古代人去拿水是很困难的事情 , 我们要去河边打水啊 , 然后打完水之后在里面放米饭 , 让这个里面的脏东西沉淀下来 , 对吧 , 还要杀菌 , 然后终于可以喝 , 然后煮水才可以喝 。
但是现在呢 , 就是我们都准备了这些步骤 , 比如抽水马桶的发明 , 让人们的这个卫生环境变得非常好 。
所以这些都是很重要的一个过程 。 我相信以后就是你想要制造任何东西 , 或者说想要制造任何的部件的话 , 都可以通过这个方式产生出来 。
我觉得这个是很重要的 。 然后比如说我们现在大语言模型可以用它来写代码 , 写完代码之后它可以直接跑 , 可以直接完成想到的事情 。
那么这个世界这个以前也是不可想象的 。 以前我就说我要做一个网页 , 或者说我要做一个那个商务逻辑 , 跟别人去对接 , 我需要招一个团队 , 比如说招 10 个人团队 , 我是老板 , 然后我跟大家说我们要做什么东西 , 然后大家把那个计划书写下来 , 然后把它分解成子任务 , 对吧 , 然后一个个人去把代码写完了之后测试 , 然后上线 , 然后
终于可以服务于其他人。 但是现在整个过程呢 , 就被压缩了 , 被那个大语言模型压缩了 , 变成一个自动化的过程 。
你可以让那个 AI Agent, 那个 AI 代理去做很多很多这样的一个细活 , 然后最后它会直接把那个代码写完 , 然后还能够上线 , 还能可以直接用 。
所以其实整个过程呢 ,其实也是很相似的 , 就是把一个非常繁杂的一个一个很大的一个任务通过自动化的方式越来越越缩越短 , 越缩越自动化 , 然后最终呢 , 让一个普通人都能完成这个整个过程 。
所以这个过程一直是有的 。 我相信以后呢 , 只会变得更加利 , 然后最终会达到所思即所得的境界吧 , 就现在已经开始有一些迹象 。
对 ,有些体验确实是 。 对 , 那刚才第二个问题就是说 , 如果你已经到所思即所得这么高级的科技和能力了之后, 可能会面临的大危机是什么 ?
其实我自己有想到一个 , 就是我前段时间跟马毅老师 , 就是港大的马毅老师录了一期播客 , 就我们聊到就他认为那个生命是智能的载体嘛 ,因为智能是一个学习的过程 , 你可以去学习外部的规律 。
但是如果按照我们现在对宇宙的观测 , 就有可能它是一个熵增的系统 , 那有一天这个宇宙岂不是就非常混乱 , 然后你就没有规律可以学 , 那智能怎么继续存在 ?
就这个问题可以解决吗 ?
我觉得这个是这个可能是另外一个更大的问题吧 ,因为这个是跟物理学有关系的问题 。 因为总的来说宇宙当然熵增的了 , 就是但是呢 , 局部只要有局部的那个负熵流进来 , 那么这部分的生命和这部分的那个复杂系统就可以开始发展 。
所以像地球太阳就是一个典型的系统 , 对吧 , 太阳把能量给地球 , 然后地球最后把能量散播出去 。
那么这过程中会造成一些那个负熵流 ,因为太阳过来的能量是高度有序的 , 它从一面过来的这个能量可以转化成很多其他的能量 , 比如说通过光合作用可以变成葡萄糖 。
所以我觉得这个局部上来说这个是对的 。 那马毅老师说可能比较大了 , 就是在整个宇宙的那个命运 , 就整个宇宙的这个年龄尺度下, 那么最终智能会怎么样 , 这个 。
但是这很远 , 这很远 , 这可能是几十亿年后的事 。
对对对 , 可能不止几十亿年, 几百亿年还是几千亿年后的事 ,因为就是我看过一些讨论吧 , 就是你最终还是可以找到一些小区域 , 生命还可以继续活下来 。
比如说你在黑洞附近 , 比如说你找到一个地方 , 那么你通过你把东西扔进黑洞 , 那么它给你会有黑洞的能量 。
那么这个过程可以重复很多很多年 。 那么因为黑洞不会只会越来越大嘛 , 它不会那个显著的变小 , 所以在这附近呢 , 你会有很多很多时间来做这个事情 。
所以另外还有方面就是说 ,也许你是整个整个物理规律 , 或者说物理的那个世界其实应该说是说它里面有很多的未知的规律嘛 , 可能还不知道 。
也许我们通过探索宇宙 , 可能会发现物理规律需要修改的 。 那么在这里面可能会发现新的有意思的事情 , 可能可以让这个某些大家认为是正确的那个趋势呢 , 发生逆转 。
虚拟趋势35:11
就是你刚才说就是关于这个到底未来人类是随着计算机和 AI 这种技术发展之后, 人类未来是进入虚拟世界 , 还是说我们变成一个星际文明 。
你很早就在思考这个问题 , 这个起点是什么呀 ? 包括你觉得在真实生活中, 因为现在我觉得这可能真的越来越现实了 , 这可能是个比较现实的问题 。
你觉得真实生活中人实际上会怎么选择 ?
我觉得这个是我们看过去的历史吧 , 就是这个问题有两个两个层次吧 , 一个层次是说为什么我会想这个问题 , 另外层次是说就是人类现实生活会怎么选 。
对 , 一个就是说我本身也是一个特别喜欢想东西的人, 然后会有一些有意思的奇怪的这个思路会冒出来 。
所以为什么我会去选 , 比如说我们要选计算机啊 , 我们选人工智能啊 , 这个方向 。 当时也是基于一些想法吧 , 觉得就是以后 AI 是不是可以代替人类 , 或者说为什么人总是有一个天生的一个先进性 , 好像这个先进性其实并没有被那个正式的定义所证实或者证伪 。
所以因为有这样的一个思维在那里呢 , 所以你如果永远是想这个问题 , 就是说也许哪一天大家发现人没有那么特殊 , 那么在这种情况下呢 , 我们应该怎么样 。
所以通过这个方式呢 , 去思考就是这个世界 , 或者说这个 AI 会怎么样去发展 。
那这是在 08 年左右吗 ? 因为你是 08 年开始就是研究生 , 然后包括后面读博士 , 那个时候正式做人工智能这方向 , 对吧 , 算是 。
可能更早吧 ,因为其实我在那个 05 年到 08 年这段时间 , 我是在交大大学做硕士嘛 。 所以那个时候呢 ,其实是在那个我们有一个叫脑科学的 , 就是说应该说是脑机接口的实验室 ,是张立青老师的一个实验室里面 。
那么那个实验室里面其实是做这样的一些研究吧 , 就是研究大脑是在各种不同的那个刺激下, 或者各种不同的任务下, 它是怎么样运作的 。
比如说你可以戴一个这个帽子 , 然后上面有各种那个胶 , 粘上去之后, 然后你可以算 , 你可以可以那个检测这个脑电图 , 对吧 , 如果让这个人做什么事情 。
我其实也曾经是受试者之一吧 ,因为所有的所有的那个实验室里面的人都会被自动认定为受试者 。 对 , 所以这是很有意思的一个一个一个一个一个 ,不过但是我会去想这些这些问题 , 会觉得这个很有意思 , 然后为什么那个人大脑那么神奇 , 这个是一个很大的一个出发点 。
当然就是说我不会觉得一定要通过大脑的方式才能去理解清楚这个人是怎么做这事情的 , 可以从数学出发 , 从第一性原理出发 ,也许会有更好的 , 会有更清晰的一个思路 。
但是不管怎么样 , 就是我们是存在着这样一个系统 , 这系统就是我们的人脑 , 这个脑脑的功率非常低 , 比如说只有 30 瓦 , 比如说 20 瓦或 30 瓦 , 然后获取的知识它的效率也非常低 , 远远低于现在的那个 AI。
比如说跟别人交流的效率很低 , 我跟你说话 , 我可能每秒钟只能最多给你个 10 个比特的信息 , 然后一辈子就可能只能看 , 比如说那个一个比例的 token 这样的大 , 或者 10 个比例的 token 这样的一个数量级的数据 。
这些数据对于现在的机器学习来说真的是毛毛雨 , 什么都不是 ,但就是这些数据的输入和交流能够产生那么聪明的东西 。
所以其实我一直觉得就是现在的这个 AI 呢 , 它的能力呢 ,其实还远远没有到上限 , 我们现在用的算法还是非常笨的 。
所以有这个也是一个很大的原动力吧 , 去整体去思考这个这个问题 , 就为什么我要去想这个问题 , 为什么会有这样的想法 , 会往这方面继续走 。
另外一个问题就是说全世界的人类呢 , 会不会进入虚拟世界 , 对吧 , 会不会那个进入这个那个跟 AI 结合的这样的一个一个一条路径 。
我觉得这个是肯定是可能的 ,因为现在其实已经这样了 , 就比如说现在我们大家都知道有手机 , 对吧 , 然后这手机基本上是不能离身的 ,有各种各样的信息会传进来 。
所以其实我们应该说已经一只脚踩进了虚拟世界 , 这个虚拟世界里面有很多的信息 ,有很多的那个讨论 ,有很多的那个情绪 , 对吧 , 所以这个其实已经在慢慢适应中了 。
就是我们虽然一直在说人类还是跟机器是要划清界限的 ,其实已经不是那么清楚了 。 所以我觉得其实这个事情以后慢慢去会发生嘛 , 对吧 ,以后之后可能会这样的 , 就是如果你用了某个特别的电子元件 , 或者说某个特定的 APP, 或者说是芯片 , 然后你的成绩提高 20%, 那就会产生一个效应 , 就是你如果不用 , 你会落后于别人。
所以一定大家会拼命的去使用这个这些东西 , 最后慢慢会就是说会有一个融合的过程嘛 , 就这个过程会自然的方式发生 。
对 ,但不会像小说中那样 , 小说中那个时候是因为有外星人的外界的压力 , 让你不得不进入虚拟世界 ,不然的话你可能就在地表会冻死 , 比如地表现在变成零下 50 度了 , 你如果不进入虚拟世界 , 你就会你就会死掉 。
所以你就必须在很短时间内全部都进来 , 这个是一个一个外界的压力 。 但是如果没有这外加力的话呢 , 我觉得人类也会慢慢的进入这个状态 。
对 , 就是一个慢慢融合的过程 , 就有了这个融合过程之后, 就一方面可能就像你说的 , 你认为它是不可避免的 ,但另一方面它肯定也会带来一些新的问题 。其实这个我在小说里也看到了你的讨论 , 就是这个小说 , 就我可以再讲点情节 , 就到了比较后面的一章 , 就已经很到后面了 , 讲了一个新人物在虚拟世界的故事 , 然后他是一个三流画家 , 然后他就是一直自
怨自艾 , 觉得怎么都比不上一个他的一流画家的朋友 。 我当时看到这一节开始的时候 , 我是觉得非常莫名其妙 ,因为前面都已经讲了那么多事情 , 然后很后面了 , 突然出现一个新的人, 然后后来我看到更后面 , 我才知道为什么你就是写了这个 ,是因为苏彦就是那个人类的大工程 ,他其实是故意把整个临界的时间节奏给调的非常的快 , 就是
相比于真实的物理世界的节奏 。 所以在一个比较短的时间里面 , 这些临界里的人, 就类似于这个三流画家这样的人 ,他们就经历了很漫长的一段时间 , 然后他们慢慢觉得在这个临界里待着其实是很空虚 , 甚至很残酷的 。
然后这样人类就是两派不同的人, 虚拟的人和真实的人才能达成共识 , 去一起反抗银河联盟 。 你可以讲讲就是你想设想到的这些问题吧 , 就是当那个人和虚拟融合 , 然后界限变得更模糊之后 。
对对对 , 这部分呢 ,其实是特意作为一章写在里面的 , 通过这个方式呢 , 让大家知道就是我们是怎么翻盘的 , 就是或者说这个人类是怎么翻盘的 , 这是第一个 , 对吧 , 然后第二个就是其实也是设想了 , 就是虚拟世界真的铺开之后呢 , 大家会有什么样的想法和思路 , 对吧 , 这个是一个非常明显的一个情况 。
对 , 我觉得就是这样 , 就是这种融合呢 , 短期一定会产生很多问题 , 然后这个问题呢 ,是就比如说嘛 , 对于现在生命来说 ,AI 来了之后 ,其实大家接下来几年可能会对世界产生很大的变化 , 就很多人会发现自己赖以生存的工作 , 比如说可能会被 AI 取代 , 或者被 AI 那个给给给代替啊 。
对 , 然后就是这个其实是有很大的空虚感 , 很多人会觉得突然之间获得了很多东西 , 这些东西呢 , 可能是以前我一辈子都拿不到的 , 然后呢 , 我就不想干活了 , 或者说是我发现我做的事情做再好 , 都没有 AI 做的好 , 那基本上就不会再去想着要把这件事情做好 。
我觉得这个是一个短期的一个很大的一个问题 , 我不知道大家会通过什么方式来克服 , 这是第一个 。 然后中期呢 , 就是就是那个你刚才说的那那个情况 , 我觉得就大家开始卷了 , 就开始卷那些就是已有的赛道 , 就是大家都知道 , 我我们以前的那个事情就做不了了 , 我得去想办法去求新搞怪 , 吸引别人的眼球 , 通过制造一些独一无二的这样的一个感觉 ,
让大家去觉得就是自己是有价值的 。 那么这个过程呢 ,其实是应该说是比较痛苦的过程 , 就是因为会很多人会觉得就是自己并没有这个天赋 ,但是一定要去被迫去卷这些这些赛道 。
但是呢 , 就是在往前 , 我觉得长远来说呢 , 我觉得应该说是乐观的 ,因为大家可能会意识到就是我们以前的工作 , 就是我们以前有这个 T4 的惯例嘛 , 就是我们现在上学受到教育 , 受到教育之后呢 , 目的是获得一些有用的技能 , 然后用这个技能去工作 , 工作了之后呢 , 拿到那个薪水 , 然后养家糊口 , 然后养育下一代 , 然后继续这样循环 。
它是这样子一个修个这样的方式来来赚起来的 。 但是以后如果就是你发现就是大部分人就是受到教育之后做的工作 , 这个工作本身和那个 AI 相比没有竞争力的话呢 ,其实大家可能会放弃这个想法 ,因为长远来说 , 每个人最好还是想做自己想要想喜欢的东西 。
像我看到我很多朋友嘛 ,他们业余可能是个画家 , 或者说业余是个小说家 , 或者说业余是歌唱家 ,但是呢 , 对他们来说这些只是业余活动 ,因为他们还是要比如说做写代码 , 然后通过这方式来获取那个工资 , 对吧 , 然后然后可以买房 , 然后可以买车 , 然后可以养孩子 。
所以这个过程呢 , 就是其实是限制了大家真正天性的发挥 。 如果大家真的去做自己想要的 , 或者说完全出于内心特别热爱的工作的话呢 ,而不需要担心就是收入是多少 , 或者说有什么样的地位的话 , 我觉得这可能是会是一个有意思的一个一个一个事情 。
那么这个这样的话呢 , 可能会出现这个职业的那个多样化的一个爆发期 , 大家都会发现其实有那么多事情以前没有想过的 ,但是可以去做 。
这个爆发期之后呢 , 就是大家可能会发现其实最后还是比原来更开心了一点 。 我感觉上是会有这几个阶段吧 。
对 , 长远上来说我还是比较乐观 , 还是比较乐观 ,但是就是说中间有什么波折就很难讲 。
你现在有观察到就是你说的第一个阶段 , 或者第二个阶段的一些情况吗 ? 因为从 23 年、24 年到现在 ,其实 AI 确实发展的很快 , 包括 coding 啊 , 然后这个写作啊 , 它都是有很多的进展的 。
那可能对程序员 , 对吧 , 对一些文案从事者 , 它可能都会有一些影响 。
对对对 ,是的 , 我觉得现在已经开始出现了 。 对 , 那个但是呢 , 就是可能没有什么全球机会去统计这个 , 或者说已经开始统计了 , 只是我还不是知道这个事情 。
对 , 就是应该说冲击是很大的 , 就是比如说写文案的朋友们 ,他们可能会觉得用 ChatGPT 写出来的东西其实比自己写的好 , 或者说那个可以用 ChatGPT 先写 , 然后自己去润色 , 这个都可以 , 就是跟以前的那个流程有很大的不同 。
所以这个一定会一定会发生 , 一定会发生 。 那么之后就 AI 越来越强 , 然后那个用的起来越来越便利 , 那我觉得会更多的人会波及到 , 这个应该是一个很大的一个一个过程 。
可能再问一下, 比如两到三年的时间内 , 就是可能会有很多的比较大的变化 , 就是这些变化可能对于就是 AI 研究员来说没有那么看得见 ,因为我们比如说天天看文章 , 或者感觉有什么最新的进展 ,但是这些 AI 本身会下沉到每个领域的各个细分的一个方向上, 那么会改变就是每很多人的一个具体的工作流程 。
那么这个过程呢 ,其实应该说是滞后的 ,但是应该会慢慢 , 应该会在慢慢的情况下再慢慢的发生 。
那么这个发生的过程呢 , 会会改变这个世界的或整个社会的运作的一个方式 , 我觉得这个很大的一个一个变化 。
AI 与科研45:34
你觉得你自己的这类工作什么时候可能会被 AI 很大程度的取代啊 ? 就是我指做研究的这类工作 ,因为现在其实很多人他们的想法 , 就包括很多 AI 研究员自己的想法 , 就是希望 AI 能做科研 。
对对对 , 我觉得是 , 就是现在就是看起来就是有些比较简单的科研的操作其实都是可以的 , 就是说比如说让它查文献 , 对吧 , 让它去收集一些资料 , 这个现在这个叫 DeepSeek, 就是 Search,其实都已经还不错了 。
当然就是说能不能提出有深度的观点 , 能不能找到一些深层次的联系和想法和思路 , 这个现在的这个 AI 还做不到 , 就是就是它现在属于这种这种状态 , 就是外行看起来这个东西很内行 , 内行看起来就是很外行状态 。
对 , 就是如果我去查一些我不知道的东西 , 这个那就是现在的那个大语言模型非常急 。 对 ,但是如果真的碰到了就是我喜欢的 , 或者说我热衷的 , 或者说我特别精通的东西的话呢 , 就是我能看见很多的漏洞 。
对 , 所以但是这样的话 , 就是其实意味着就是研究员还是有事情可以做的嘛 ,因为他对这个世界有很深的理解 。
那么这个理解而且是随着就是经验的增多 , 那个研究的深入呢 , 会越来越深 ,而这个理解的速度呢 ,其实是超过大语言模型的那个学习速度的 。
所以这一块呢 ,其实 AI 研究员还是有自己的优势的 。 就大语言模型呢 , 现在还是有一个问题 , 就是它的数据的复杂度还是太高 , 比如说你学一件事情 , 你肯定要很多很多样本 , 比如学一个事情 , 你肯定要需要 1,000 个以上的样本才能学会 。
当然对于顶级的那些研究员来说 ,他们可能一两个样本看一下, 然后知道哦 , 这里有问题 , 那里有问题 ,他会联想到一个正确的 ,但是非常细小的一个因素上面去 ,并且这个因素呢 ,是确实是正确的影响它的因素 。
因为有这个能力呢 , 所以人类研究员还是能够站在那个大模型的前面 , 就是大概是这样的一个感觉吧 。
对 , 所以这个问题可能在现在的这个大语言模型 , 它的训练的那个算法没有改进之前呢 , 可能还是很难解决的 ,因为现在还是预数据的方式训练 。
就说现在这种预训练的这种方法 , 或者说这个机制它没有变化的话 , 它其实和人的那种真正的去思考 、 理解 , 或者发现一些东西的那个状态是不一样的 。
这我觉得是不一样的 , 当然可能每个人想法不一样 ,有些人可能会觉得就是一样的 ,但是就在我的角度上来说 , 我觉得还是有很大的区别 。
那么这个区别可能是本质上的一个区别 , 这个是有不一样的地方 。 但是如果以后真的是 AI 进化了之后, 比人的学习速度更快 , 那可能研究员的工作就干掉了 。
所以这个时候呢 , 你可以考虑 , 比如说我可以继续写小说 , 会不会做一些就是跟现在不一样的事情 。
你觉得这件事情很快会发生吗 ? 我指比如说数年内有可能会发生吗 ?5 到 10 年内 。
我没有那么乐观 , 这个我倒没有那么乐观 。 对 , 我觉得就是这种是属于涉及到就是怎么样去训练这个模型本身的一个改变 , 这没办法通过对数据来完成的 。
所以这个可能没有那么容易 ,也许可能还需要比如说 10 年的时间 ,20 年的时间 , 我觉得是这样的 。 因为就是比如说你要去问一个下围棋的围棋国手 ,他一定会说 AI 不行 。
对 , 所以但是过一段时间之内 , 你会发现 AI 的水平已经超过围棋最强的那些人。 所以就是对于每个人来说 ,他有没有自己的 , 我也有自己的那个 , 比如说一个自尊呢 , 或者说是就是人人应有一傲的这个这部分 ,但是呢 , 就不一定就是 AI 不一定超过它 , 这都是有可能的 。
研究者48:50
那接下来正好可以聊一下就是研究生的生活的这一部分 ,因为其实这个也是书里的一个主线 , 我觉得对很多其他的类似的人士会有启发的 。
就我看这本书的时候 , 我是感觉这里面的博士生非常艰苦 , 尤其是最开始出现的那个角色 , 就是他们的大师兄风惜云 ,他是要在赚钱养家和继续做科研中做一个非常难的选择 。
但是这个好像跟我理解的最近这几年的 AI 领域的现实是不太相符的 。 我想问一问 , 就是你这个博士生的生活是来自于什么呢 ?
是来自于因为你可能是更早进入这个领域吗 ? 就当时那还是在 2012 年之前的好几年, 是因为那个时候这个领域比较冷是吗 ?
所以你们当时确实挺艰苦的 , 还是故事性的原因 。
是 08 年那段时间其实是比较没有那么热的 , 应该说在我毕业那一年才开始真正的真正的发展起来 。
对 , 那段时间是这样 , 就是大家都知道有机学习这样的一个方向 ,但是呢 , 这个方向有没有用 ,有没有效果 ,其实大家还是存有疑义的 。
大家可能会觉得我机器学习其实我的数据和我的特征还是需要人去写 , 数据需要人说 , 人特征需要人去写 。
所以机器学习可能就是线性拟合 , 或者说是一个最小二乘这样的一些统计上的方法吧 。 就当时大家的认知是停留在这上面的 。
所以很多时候是这样 , 我当时我记得有个师兄告诉我说 :" 哎呀 , 你不要做机器学习 , 这东西没有没有效果 , 肯定不行 , 你得做一些更加接地气的东西 。"
就这么说 , 就是没有那个 。 就当时我的老板呢 , 我当时的博士导师 ,他也不赞成机器学习 。他对他来说 ,他做的工作呢 ,是那个基于物理的一个图像式识别 , 或者说基于物理的图像上的分析 。
对他来说 , 真实的东西呢 , 就是物理公式 , 这些公式呢 ,因为它是真正是对的 , 那么通过这个对的公式呢 , 可以得到对的对的答案 。
如果通过机器学习的方式呢 , 它里面是黑盒子 , 所以他也不知道会发生什么事 。他也是很反对这个那个机器学习的这个这个这个介入吧 。他甚至跟我说 , 就是他觉得他的世界里面没有概率 ,他觉得他世界里面都是确定性的 , 就是物理写好了之后, 公式写好之后就是对的 , 要不就是错的 。
所以当然他没有反对我去做 , 就是更加偏机器学习的方向 。 对 , 所以这也是也是挺好的 。 最后变成了就是我去专门去那个研究这个技术上的一个突破 , 那么他帮我去帮忙去 , 比如说让我让我能够更好的那个演讲 , 更好的表达自己 , 那个交流能力有些提高 。
那么这个这种这种组合呢 ,其实对我来说应该说在过去在在这个博士阶段呢 , 还是比较好的一个组合 。
我一个一个是他我自己会有发挥 , 另外就是我能够发现自己的短板 , 然后让自己变得更加成熟 , 这个是个比较好的一个组合 。
那在卡耐基梅隆的读博士的时候 , 那个组里就是只有你自己在做机器学习吗 ?
对 , 应该说是这样 ,因为其实我其他的师兄师姐他们都不是做这个方向的 ,他们都是做就偏物理的一些建模 , 然后对视觉的一些分析吧 , 大概是这样的一个方向 。
对 , 我我觉得可以讲讲就是你当时的一些学术选择和你怎么度过就是这个领域那会儿看起来还有点前途未卜的这个阶段 。
我觉得这个对现在更年轻的研究者也有启发 。
对 ,因为还是说比较喜欢嘛 , 就是我特别喜欢做一些自己想做的事情 。 对 , 所以比较我可能是一个比较内心驱动的人, 不是很在乎外面怎么说怎么怎么想 。
所以我觉得哎呀 , 这个东西我搞出来了 , 或者说这个东西我想通了 , 我特别开心 。 那我其实并不想要就是外面有什么样的那个奖励啊 , 或者说有什么样的那个认可 。
所以这样的话呢 , 就是一般来说 , 如果对自己的东西特别有兴趣或者特别喜欢的话呢 , 就会有一个就是自信和坦诚的这样的态度 。
对 , 所以通过这个方式呢 , 就可以把这个博士阶段这个比较艰苦的日子给它度过去 。 大概是这样的一个过程 。其实我以前也是一个非常内向的人, 然后也不太说话 。
对 , 我在上台说话的时候就我会卡住 , 就我之前有口吃的毛病 。 但是在通过这个学习过程中呢 , 我会慢慢的发现就是自己特别喜欢的东西 , 就会把这个自信给发挥出来 。
所以你现在看到我现在这个样子呢 ,其实也是说是因为博士阶段呢 ,有这样一个锻炼吧 。
在博士阶段 , 包括就是后面早期开始工作的时候 , 你觉得中间做到哪些事情 , 或者说做的哪些成果 , 让你慢慢对机器学习这个方向的信心是变得越来越强了 ?
一个当然是就是我觉得就是自己那个对有些问题的理解变得更深入了 , 这个对我自信是很大的帮助 。
然后另外就是说确实能看见就机器学习在整个过程中就是能够做一些比较重要的效果 , 比如说我们领导的围棋的项目 , 对吧 , 这个项目能够真正做出一个模型来 , 这个模型下棋的水平非常高 。
那么这个时候你其实对机器学习的这个 , 或者说对那个生物学习的它的能力呢 ,有更深的更好的理解 。
我觉得这个这个很重要 , 就是真的自己做出东西来了 , 然后不仅是理解方向的 ,而且还是实践方向的 。
那么这两个东西都能够给自己一个强化的一个动力 , 然后觉得就这个东西真的是有效果的 ,而且这个效果呢 , 一定程度上来说呢 , 我自己也是可以预测的 。
那我就对这个问题呢 , 或者对这个东西的理解就变得非常深入 , 我也会对它更有自信 。
在这个过程中外部反馈重要吗 ? 比如说你们投会 , 然后有些他中一些鼎会的这个奖啊什么的 。
因为还是希望有一个自我的一个一个内心驱动力去做这事情 。 我觉得这个事情是对的 , 我觉得应该做下去 , 这个跟外面没有关系 。在外面如果承认了我会更开心 ,因为我觉得我说的话至少别人还认同 , 或者别人会觉得这个东西还是有道理的 。
所以这是两个相互加强的过程 。 但是我觉得就作为博士生呢 , 就是可能先要有内心的驱动 , 然后呢那个才有外界的反馈 。
当然有些人可能想反的 ,但是最终这个反馈能够转起来 , 产生一个非轮回效应之后呢 , 那么这个博士生就慢慢慢慢做得更好 。
就你刚才也讲到你当时读博的时候有师兄劝你要接地气一点嘛 , 然后你这个书里面也是写了两类研究者 。
我觉得它确实代表了两种做学术的思路 , 一个就是风惜云还有林芙羽 , 就是他们是很执着于做一些颠覆性的但比较冒险而未知的研究 ,而且它是有可能做不出来的 。
如果是对一个普通的博士生来说 , 这个可能就是搭上了自己的青春 ,但是后来因为人类面临危机嘛 , 所以他们去赌这个方向 ,其实也有可能会搭上人类的命运 。
然后另一种就是他们都是罗老板下位的 , 就另一个老师叫孟天峰 ,他就是想用有限的资源去做一些小的改进 , 一些实用性的技术可以比较快能用起来的 。
我觉得这两类角色就是在这个小说里他们都是很有魅力的 。 我觉得并没有就是特别明显说谁好谁不好啊 。
就是你可以讲讲就是你当时为什么设置了这两类角色 , 包括你觉得如果在一个非常极端的情况下, 实际上可能应该把资源放在做什么样的研究是你比较认同的 。
我觉得这两类人都是都是应该有的了 , 就是都是非常重要的 , 应该不能说是谁好谁坏 , 对吧 ?
对 ,因为就算是非常接地气的 , 或者说非常平易近的研究员 ,他的贡献也是很大的 。他可能会把这个 , 比如说把整个地下城的通关系统做得很好 , 然后大家都过得很开心 , 这个对他来说其实很大的一个一个动力 。
特别就是我小说里面可能就是我有些写得比较多了 , 就是有些东西可能写得太散 ,但是像天峰这样的一个人呢 ,他其实应该说更加注重别人对他的看法 , 所以他会特别想要让别人开心 。
我觉得就是他肯定是这样的一个角色 。他最终在就最后那一章他在牺牲的时候呢 ,他其实也是为了想要让别人开心 , 想要让那个弥合就不同的见解之间人的一些裂缝呢 ,他他愿意坐下来跟大家谈判 。
但是这个本身呢 , 就是因为他有这样的一个内心的动力在那里呢 , 所以他其实肯定愿意去做一些更加偏应用的研究 。
另一方面 , 就比如说像那个林芙羽和周西海这样的人呢 , 或者包括风惜云这样的人 ,他们可能总的来说就是他们可能更偏向于内心深处的一个动力 。
那么他们希望这件事情一定要在他手里面做得更好 ,他们没有那么那个想太多就是别人对他的评价 , 所以对他们来说可能会更加想要去做一个别人做不出来的事情 。
那么那么他们就会去冒险去赌博 。 所以这个两类人呢 ,他们的驱动力是不一样的 。 那么驱动力不一样的话 , 导致他们不同的结果 。
当然驱动力还要加上能力 , 能力如果不够强 ,但是驱动力很强的话呢 , 那可能会造成比较悲剧性的结果 。
风惜云其实是这样的一个 , 应该说是这样的一个角色吧 , 就是他的驱动力非常强 ,但是他能力没有那么强 。 那么这样的话呢 , 就会产生一个问题 , 就是可能会有很长的时间之内他得不到很好的反馈 。
比如说我作为一个博士生 , 我资质是很平平的 ,但是我非常想要发鼎会 , 我非常想要发全世界震动的结果 。
那么这种情况下就会有很多很多年他没有办法达成他想要的东西 。 那么他就会非常郁闷 , 对吧 ?
他会非常伤心 。 那么他有可能会做出一些比较极端的 , 或者说比较冒险的举动 。 这就是为什么整个书中会有这样的一些剧情的一个原因 。
所以这个其实这这两类人其实我是当时在写的时候呢 , 是一个相对来说做了一些比较深入的思考和写的 。
当然就是那个可能写完之后因为这里面东西太多了 , 所以我觉得很多读者也没有完全看得很细 , 所以很多时候会有些反馈说这个人物比较扁平啊 ,不是特别那个不一样啊 ,但是其实是有一些不一样的一个一个一个动机在里面的 。
所以我觉得从从社会角度上来说 , 这样的人都是需要的 。 因为你就算像 OpenAI 这样的很很伟大的一个公司吧 ,因为他们做了一个 ChatGPT 引领整个世界 , 那么他需要 Ilya 这样的一个能指导方向的人 ,但是也需要很多的研究员 ,他们能够把具体的那个数据啊 , 然后把具体的那个基础设施给搭好 , 这样的话整个系统才能真的真的跑起来 。
所以这两个人都是需要的 。 所以至于最后的问题就是 , 如果真的地球处于小流动的危机 , 那么什么样的研究员是比较重要的 。
所以这个很难讲 ,因为在这种情况下呢 , 任何一个小小的那个信号 , 或者说小小的发现呢 , 都可能会改变整个人类的一个研究的思路 ,其实是很难的 。
应该说就是这两个类人最终可能会统一到一个方向上, 就是说我不管怎么样我要拯救地球 , 然后怎么拯救地球我也可以用任何手段去做这个事情 , 可能变成这样子 。
我也许可以赌博或者冒险 , 或者说我可以扎扎实实做那些非常简单的但是非常重要的具体的事情 。
这两件事情都可以切换 ,但是呢 , 这完完非常取决于就是每个人看到什么样的迹象和踪迹 , 然后每个人心里有什么样的道路 , 然后自己走过去 。
大概是这样子 。 所以这两个人可能会合并 , 就是在那个真正地球里面出现这样的危机的时候呢 , 可能会出现这样的情况 。
然后这也涉及到我想问的下一个问题 , 就你刚刚说的这个情况 , 它要合并 , 或者说这两类人要更好的协作 , 大家来一起使用比较有限的资源 , 那就需要一个统筹的角色嘛 。
其实你书里也有这样的角色 , 就是他们共同的老板 , 就是这个罗教授 。 罗教授就是一个开始看觉得他好像有点那种官样 , 或者说甚至有点学阀 ,但是你后面会觉得啊 , 这个人还是挺有魅力的 。他有一些他的考虑 , 就像你说的 ,他可能是有一个大的目标 , 然后他要用很多手段去达成他 ,他也要用不同的人不同的团队去达成他 。
然后你自己其实也带团队嘛 , 就你这个书特别好玩的地方 , 就是它这一部分真的特别日常 , 就写了这些 , 包括罗老板其实怎么管团队的 , 然后他下面那几个老师 , 你刚刚说天峰对吧 , 然后林芙羽他们是怎么带团队的 ,他们每个人都有不同的风格 。
然后你自己也做技术 leader 其实很多年了 , 你每年的这个年终总结里面你会发在知乎上, 你会分享一些带团队的思考 。
就你现在会觉得一个技术团队里面好的 leader 他应该做什么不做什么 。
技术领袖1:00:04
对 , 我觉得是这样的 。 我现在的想法是这样 , 就是那个一个技术 leader 最重要的是就是能不能找到好方向 , 就是这个团队整整体来说我要做什么 , 这个做的东西应该通过什么方式来完成 , 然后团队里面每些每每个人他想要做什么 ,他应该做什么样的事情 , 然后每个人有什么样的长处 , 然后能不能那个无为而治嘛 。
就是大家其实我就比如说表现来说 , 我其实没有那么过多干干涉大家 ,但是最终大家合在一起把事情做成了 。
我觉得这可能是一个比较好的一个状态 。
因为你现在在 Meta 这个大的体系里面 , 就是你们组做什么 , 你是自己比较自由的是吗 ? 还是说也会就是整个组织会有一些压力给到不同的团队了 ?
对 , 这个完全看具体在哪个大的那个环境下吧 , 对吧 ? 就之前我们在那个在那个 Fair 这个这个环境下的时候呢 ,其实还是比较自由的 。
应该说对这个组下面的那个具体的方向呢 ,其实我这边有一些话语权 ,其实可以定下来的 。 对 , 所以这个是一个比较好的这个情况 。
这种情况下因为大家都在做研究 , 研究的那个前沿是无限的 , 所以其实这个空间是比较大的 。 就关键是作为一个团队的那个那个方向上的那个人呢 , 这个人比如说像 leader, 这个 leader 怎么样的把这个方向定下来 , 然后让大家觉得这个方向是有前途 , 然后有希望的 ,并且大家愿意花时间花力气把它做完 。
我觉得这个是一个比较重要的一个结果 。 当然我们最近是从那个 Fair 转到了那个 GenAI, 那么整个大环境呢其实是不一样的 。
那么对这个对 leader 来说其实能不能找到一个好的方向 , 一个是就是让大家有活可以干 , 然后另外就是那个而且能指出来大家就别人看不见的方向 , 能让大家觉得跟着我跟着这个 leader 往前走呢 ,是有有前途的 。
这个其实是一个很重要的一个能力 。
因为其实我觉得在现在这个就各个公司或者各个组织之间技术竞争非常激烈的情况下 ,其实最核心的最中间的力量就是每个组织里的技术的 leader。
因为 leader 也会吸引到更多好的人, 然后他其实也是关于就说实际上一个成果是怎么做出来的 , 一个最关键的角色 。
这个是很难当 ,因为他其实要在两方面要做平衡 。 一个是就技术上来说 , 这个 leader 还是需要有一定技术高度的 , 然后大家愿意跟你一起做 , 然后有这个吸引力让大家愿意过来加入 。
然后另外其实 leader 也要有一个人事上的一些能力和敏锐的这个洞察力吧 。 对 , 如果人和人之间出现关系裂痕呢 , 或者说人和人之间有一些不同的问题 , 那么怎么样去解决 ,他其实需要有管理的一些一些能力 。
所以这个都是比较难的一个组合吧 。
就是我看你在知乎上写的这个年度总结 ,有一个跟你自己的角色相关的变化 , 就是 2021 年的年度总结里面 , 你是说首要的任务不是埋头苦干 , 就类似你刚刚说的可能最重要的我是要看方向 。
然后到 24 年的这个年度总结 , 我看到你说要更多的 hands-on, 可以讲讲这个转变吗 ? 包括这个转变是不是和 ChatGPT 之后整个生成式 AI 的一个加速的变化是有关系的 。
对 , 这个是这问题是非常好的问题了 。 我觉得能看那么细 , 我觉得是我非常感动 。 这是一个就这里面其实有一些有些变化吧 , 就是有个成语叫先看山是山 , 然后再看山不是山 , 然后又回到看山是山这样的一个状态 。
比如说一开始吧 , 比如对于我来说 , 你可能一开始是一个那个 individual contributor, 就是说实话实说就是贡献者 , 就是作为一个大头兵对吧 , 然后我把一件事情做好 , 这就是我的目的 。
但是呢 , 就是如果要成长为一个 leader 的话呢 , 就是不仅不仅要把手上的事情做好 ,而且可能要看得更加长远 , 然后对整个团队的方向要有一定的感觉 。
那么这个时候呢 , 就是说很多时候不要纠结于手上的一个技术细节 , 然后要往外看 , 就是你可能要站更高的楼去看 , 往下看 。
这是第一个飞跃 ,因为这个飞跃其实是一个比较难的一个飞跃 。 很多人可能就是我就是希望把手上的事情做好 , 我也不想去管太多的 , 那么就很难去达成这第一个飞跃 。
那么第一个飞跃飞了之后, 那我对这个团队的这个整个故事有了解了 , 然后我对这个战略的思考也会有比较明确的方向 。
那么这样的话呢 , 一般会成为一个比如大厂里面一个一个标准的 leader, 比如说一个 manager, 一个一个经理啊 , 然后管一些人做一些事情 。
那么这个状态的时候 , 就是我会在这个时段时间会写一些博客 , 说啊 , 我不应该去首要任务是不能埋头工作 , 我得去看看总结一下过去的弯路对吧 , 然后看看有没有什么大的方向去想 , 然后大的格局上是什么样子的 , 这个是我会去想的 。
那么这是从 1 到 2 转变 , 然后从 2 到 3 的转变呢 , 就是一旦变成了一个比如说更加偏管理者的角色 , 变成了偏大方向控制的人角色呢 ,有些时候你会慢慢的失去自己对技术上的一个细节上的把握 。
这个其实是很难的平衡吧 ,因为就是很多人是这样 , 就是从大大大厂上比如说成为经理之后, 然后慢慢慢也不管下面的人在干什么了 , 就是你们下面随便做 , 然后对我来说我只要保证每天报告写得很好对吧 , 然后那个项目文档做得很好 , 然后上面有交代就行了 。
但是其实你会慢慢发现这种模式在新一代的生成式 AI 出现之后呢 , 慢慢的会受到一个挑战 。 因为就是你会发现就是那些做得最好的那些 lab, 像 OpenAI 啊 , 像 Trophy,他们他们很多时候是这样 , 就他们里面的所有的 leader,他们所有的那些人都是会写代码的 , 然后都是懂技术的 , 然后对技术有很高的敏感性 。
有这样团队 , 这样团队如果工作得好的话呢 ,他的那个产出和速率是非常高的 ,而且同时那个交流起来的那个速率也是非常非常快 。在这跟传统的大厂这种就是上面有一层经理 , 然后下面那个做事的人拼在一起这样的一个模式上来说呢 ,他们其实有更强的战斗力 。
那么现在整个生成式 AI 出来之后呢 , 我觉得大家都在往这个方向去走 , 就是希望上面那些经理甚至是总监都是有一些基础的能力 。
那么这种能力呢 , 就可以让这个整个团队的那个速度变得很快 , 然后调整变得非常通畅 , 然后也不会出现就是一合一合在干活 , 八合为官这种这种情况 。
对 , 所以所以这个是一个很大的一个一个转变吧 。 另一方面就是待会你会发现就是之后一个人战斗力会变得很强 , 一个人加上很多 AI,他战斗力可能会强于一个小的团队 。
那么在这种情况下呢 , 就是这个核心的这个人 ,他对于技术上的敏感性是远远重要的 , 就是比那些大厂那些那些那个大的就是偏那个人事管理的那些经理 ,他的技术上的那个深度是远远要高于那边的经理 。
所以所以这个其实是也是一个很大的转变 。其实我我会看到就是这样一个一个一个趋势 , 这个趋势是说就团队越来越变得少而精 , 然后呢 , 团队里面每个人特别是他的那个核心人员 ,他的那个技术能力要求越变越来越高 。
通过这个方式呢 , 才能很快抓到问题关键 ,而且并且很快执行下去 ,而不是说是在不停的那个交流和扯皮中呢消磨时间 。
这个转变呢 ,其实应该说是在最近的两年里面变得非常明显 。 所以为什么很多小公司他执行速度会比大公司要快很不是很多的 , 所以主要是因为这个原因 。
所以我们也肯定也是我们也往这方向去转的 。
对 , 包括外界就是去分析 DeepSeek 说他们也是有这样一个特点嘛 , 就是梁文峰他自己作为创始人 ,他也是会参与到比较一线的工作 。
嗯哼 , 对的对的对的 , 我是听说是这样子 。 对 , 听说如果下面人没有拦着他写代码 ,他就会写代码 。
比如说那个时候 OpenAI 的那个 O1 O1 preview 出来了之后 ,他其实对这个方向是非常敏感的 。 我觉得这个是一个非常好的 , 就是因为技术的一个 leader,他对于最新前沿技术非常敏感的话 , 整个团队的这个转向和那个集中力会非常非常强大 。
这个远远强于一个对技术已经不太敏感的这样的 leader。 那么这样的话 , 就是对于公司或者整个团队来说 ,他的转向速度啊和他的那个产出的那个速度就会快很多 。
敏感性表现在什么地方 ?
就是比较细的认知吧 。 那个比如说对于推理模型 , 它能做到什么程度对吧 , 然后有什么样的局限性对吧 ,有什么样的那个能够做的事情 , 然后什么样的问题能够在这上面做得更好 , 这个都是会有很比较深的想法 。
现在的这种范式或者说方法之下, 能不能达到更高的智能 , 就类似于可以发现知识 、 发现规律的这种智能 。
因为你刚才有说到 ,其实你是站在不太能做到的那一派的 。
我觉得主要还是看就是在目前的范式下, 就是什么样的改变能够更大程度上呢去榨取这个模型的能力 , 应该这么说 。
这个可能是更加切切合现实的东西 , 比如说我们要改变整个训练的思维方式对吧 , 思维人的模式对吧 , 然后能不能把整个问题给重新 formulate 一遍对吧 , 现在大模型什么问题这都可以讲 。
但是因为这些东西相对来说更加难执行 , 它可能是一个更加难的研究问题 , 所以更加深刻的或者说更加深入的或者说更加那个能够做的事情 , 那可能就是看现有的模型还有什么样的能力能够被激发出来 。
对 ,他们确实是在现有这个机制之下, 我觉得是做了很多改进的 , 包括我们最开始聊到的就是他用这个 FP8 对吧 , 就是一种更低精度的方式 , 我怎么去弥补就是这个带宽的问题 。
因为他们用的是 H800 嘛 ,他们没有用这个 H100。
啊 ,是的 , 这个其实在他们报告里面是有写的 ,而且很细 , 就是专门把一些那个 GPU 上本来来计算的那些 streaming process 拿拿出来 , 这个让这些 streaming process 专门去做通信的那些工作 , 应该说是一个就打破封锁的一个方案吧 , 对吧 , 应该是这样子 。
你自己现在就是保持这种技术敏感性 , 包括去学习这种新的 AI 的变化的方法是什么 ?
这个是应该说是这样吧 , 一个你经常会读文章嘛 , 这是一个对吧 , 然后叫我去整理之后 ,其实应该说看代码的时间会更更多 ,因为有很多的重要的东西要要看一下, 对 , 甚至有时候会自己写 , 这个都是需要去做的 。
文章还是要看 , 就这个这个都是比较重要的一些工作吧 。
嗯 ,在你之前自己合作过的其他的技术 leader 里面 , 你觉得哪些人的风格或者说方法是你觉得很好的 ,是值得学习的 ?
呃 , 应该说是这样 , 就是我其实之前也合作过一些人, 然后他们有些相比有些人非常非常聪明 , 然后反应非常快 , 然后他们对问题有很深的理解 , 然后听到这问题之后肯定很快的速度反应出来最大最难的问题在哪里 , 或者最本质上的一个思维和那个根在哪里 , 这个很重要 , 就是这种 critical thinking 的能力 , 看到有些人非常强 ,他们能够在很就是说
比如在几分钟的讨论中马上找到最大问题 , 然后想到方向去去改进 , 这个是很重要的一个一个能力 。 还有一类人呢 , 就是他们看过很多文章 , 然后思维非常广 , 那个想法非常多 , 那么他们可能会发现比如这个和那个不一样的研究的那个方向 , 这两个方向之间其实有相似的地方 , 或者说有那个非常接近的一些部分 。
那么通过这把这方两个方向连起来 , 我们也可以得到一些更深的结论 , 这也是也这样的人。 对 , 还有一些人呢 , 就说他们可能对就是具体的那个具体的那个应用的这个方案 , 或者说实现的这个细节非常了解 , 就你对他们说我们要做这件事情 ,他们马上就说这件事情不能不能做 , 或者说有什么原因导致他不能做 , 这些都是很厉害的人。
你说到这个 , 我想到其实你书里就除了刚才我们讨论的罗老板旗下的那些研究者之外, 还有一些挺神奇的人物 , 比如说这个安德森对吧 , 就是他是那种比较天才型的 , 就可能是你刚刚说第一类就特别聪明 , 然后他也很喜欢喷人。
哎 , 这个形象有点让我想想到乐坤哎 。
对啊 , 乐坤 , 哈哈哈 。
刚才我不知道你写的时候想了没有 , 可可可可能你没有想到这个啊 。
嗯 , 对对对 , 那个他对一些重要的问题有自己的非常独特的坚持 , 这个坚持会让他一直走下去 , 大概是这样子 。他经常会在社交媒体上对现在的一些方法 ,他会有一些比较犀利的评价吧 。
是的是的 , 就是这个其实对于研究员来说很重要 ,因为每个人都有自己的一个独一无二的地方嘛 , 就是每个人有自己的一个主见和想法 , 要把这个事情做好 。
对 , 那为了做这件事情呢 , 就必须把这些资源聚拢起来 , 然后把它这个事情做成了 。 所以其实都是就是如果一个人只会人云亦云 , 那就不说我觉得大模型是对的 , 那所有人都觉得大模型是对的 , 那这个其实就是构不成一个研究员的一个方向吧 。
对 ,因为大家都做一样东西呢 ,其实无法就是说明就是这个人他到底有什么样独特的见解和观点 。
我觉得以后在那个 AI 泛滥的年代 ,在那个大家都去虚拟世界了 , 然后大家都有 AI 来做自己的那个研究助理的时候呢 ,有没有自己独具化的观点和想法和思路 ,并且能够坚持下去 , 这可能非常重要 。
AI 写作1:12:27
对 , 我觉得最后这一部分是想聊聊 , 就是你自己作为一个 AI 的使用者 , 我是指就是作为创作者的这个角色和 AI 的研究者之间的这个双重身份的关系 。
而且你现在作为创作者 , 你也是会来用 AI 的嘛 , 虽然可能之前没有用 。 因为 《 破晓之钟 》 这本书是 20 年开始写的 ,21 年写完的 , 然后我知道这一本是你完全手写的 , 就是手敲的 , 没有借助任何的大模型 。
那你后来也是有分享过说你写续作 《 幽夜星火 》 的时候 , 你是试了用一些模型来辅助自己的 , 你你可以分享一下这些体验吗 ?
对 , 体验上来说呢 , 还是应该说现在的模型还没有那么好 , 这个是我现在一个初步的一个体验 。 因为主要还是在于就是模型本身 , 它的目的呢 , 一个是我希望这个模型去模仿人的写法 , 就是说我希望预测 , 比如说人给他喂给他的那些数据 , 希望他预测下一个那个字符 , 下一个 token,他预测的比较准 ,是这样的一个非常简单的一个目标函数 。
那么意味着就是说这个模型训练完之后, 它的能力就局限于这个模型 , 这个数据给给它的能力 , 它的目的是希望去模仿别人的写法 , 所以它就没法出新 。
就是具体版型来说就是这样 , 就是你让它写一段故事 , 它可能会写到最后就收敛到一个王子和公主的幸福结局 , 或者说是那个从此之后地球又和平了 , 这样的一些就比较泛的一些一些故事吧 , 就比较难让它真的去思考一些在一些极端情况下会发生一些奇怪的走向 , 它是非常不擅长的 。
这个是我可能看到的很大的一个问题 , 就可能你会发现就是它在写的比如说前 500 个字或者前 1,000 个字 , 它会有一些比较有趣的人和人之间的互动 ,但是在往下写呢 , 它就失去了这个互动的意义 , 然后它会收敛到相对来说比较平凡的或者说比较无聊的一个结尾 。
所以这个其实是一个比较大的一个问题吧 。 对 , 应该说这里面因素是有多方面的 ,有一些方面是因为这个模型目的是为了服务于人, 所以它必须和人类价值观是一致的 , 所以你想让它写些价值观不一样的东西呢 , 它就写不出来了 。
所以这个是一个问题 。 另一方面就是说 , 就是模型本身的长文本能力也没有那么强 , 如果显示长的话 , 它就忘记之前那些设定 , 然后回到一些比较简单的 、 比较单纯的设定 , 这都是问题 。
你觉得不同的模型在表现上会有什么区别 ? 比如说像 4o, 像 Claude, 还有 Gemini, 还有 Llama, 包括我知道春节的时候我看你发朋友圈说你也用 DeepSeek, 就是试了一下它的这个文本创作的能力 。
啊 , 对对对 , 那个 DeepSeek 呢 , 就是说虽然说你乍一用看起来好像它的故事脑洞非常大 , 对 ,但是真的用起来也不是很好使的 ,因为它的逻辑性没有那么强 , 还是有很多的奇奇怪怪的莫名其妙的想象吧 。
所以它的脑洞太大了 , 然后有很多想象是没有根据的 。 对于小说创造者来说呢 , 这个是比较麻烦的事情 , 所以它比较适合脑洞 ,但是真的沉稳 , 我觉得这个模型不太好使 , 所以还是比较适合比如说用 Gemini 来来写这个最后的文字 , 这个是我的想法 。
然后 Claude 我感觉上它的训练的方式应该跟其他模型并没有那么一致 , 我感觉它里面应该也没加了一些很多的比如说合成数据啊 , 或者加了一些有意思的数据 , 让它写出来的东西呢 , 就是感觉上逻辑和分析性比较强 。
就比如说你给它一段话 , 里面有几个角色 , 包括一个主角和若干配角 ,其他的模型只会根据主角去写写故事 。
但是它这个模型 ,Claude 这个模型 ,3.5 这个模型 ,3.7 我还没试 , 它至少会分析这些角色之间的关系 ,而且并且写出一些就是他们之间有可能会发生的互动 , 这个让我觉得非常有趣 。
这个应该是我其他模型没有那么强的对于配角的一个感知的能力 。 对 ,4o 可能比较平淡吧 , 应该就是说可能就是一般的情节发展到最终会得到一个比较无聊的答案 , 这样子一个一个东西 。Gemini 至少我在 2.0 的时候我用了一下,2.5 还没有用 ,2.0 的时候用的时候我觉得应该说它比较细 , 就它写的时候文笔其实还是不错的 , 就是它的文笔或者它是描述性文笔 , 它会
跟你说啊 , 这个环境是什么样子的 , 然后这个人在什么地方怎么做什么事情 , 就是它写的会比较细 , 相对其他的模型来说 。
所以这个其实让那个 Gemini 2.0 至少我觉得好像让它让它写一点具体的情节 , 给定这个大纲之后写情节它还是可以写一点的 ,但是就是写了之后还是会觉得比较平淡吧 , 就是说其中还是希望有一些比较好的那个转折 ,但转折还是需要人去思考 。
总的来说呢 , 还没有那么强大 ,但是应该说比一年前要强大得多 。 因为我们 23 年的时候嘛 , 我们还有一部分工作是做用大语言模型来写小说 ,是有过几篇文章 , 这时候用的还是比较差的模型 , 比如 GPU 3.5 这样的模型 。
那么这个时候就是你会发现这个水平就就差很多了 。 所以现在这个模型的水平已经远远超过之前的模型 ,但是还没有达到那个人类写手的能力吧 , 应该说应该说就是有一些巨大的鸿沟 , 应该是这么这么说 。
嗯 , 那完整总结一下的话 , 现在可以用的部分 , 或者说你自己摸索出来的 , 让 AI 帮你写小说的这个工作流是怎样的 ?
你刚刚提到了一点 , 就是说给大纲的情况下,Gemini 2.0 是可以写一些具体的情节的 。
啊 ,是的是的 , 一般是这样 , 一般是你先有个想法 , 然后用它来细化大纲 , 对吧 , 然后那个大纲慢慢的再细化一下, 然后把每个大纲拿出来写一写一段 , 大概是这样的一个一个过程 。
你要保证这个大纲它的结构是比较完整的 , 然后那个人和人之间的关系也比较自然 , 或者说比较一致 , 那你最终写出来的那个文或者情节应该没有太差 。
就说这是能看的 , 就说可能是可以作为一个比较拙劣的作品 , 可以拿出来给大家看看 , 这可以 。 但是你要真的去细的去读一句句的话的话呢 , 你会觉得哎呀 , 这个人写的这个描述呢 ,不是很够味啊 , 或者说那个人写的描述跟这个写的描述差不多 , 就是或者说前面这个人在做了一个很细微的事情之后呢 , 后来后来把这件事情忘了 。
所以这些问题呢 , 现在来说没有那么容易解决 。
你细化大纲也是用 Gemini 来做吗 ? 还是用哪个模型会更顺手啊 ?
大纲的话还是会用 , 比如说人来写 , 就是有些重要的故事那个发展嘛 , 就是你因为你在故事发展的时候 , 你还是会想希望有些新奇的东西出现 , 对吧 , 然后希望这个故事的发展呢 , 还是要让人去真正的去去体验 , 去真正去思考 。
我觉得这还是重要重要的 。
就是你试图用模型来做过这个小说的大纲 ,但是都效果不太好 , 对吧 , 可以这么说吧现在 。
对 , 应该说是这样 , 比较因为就总说就是他们会陷入某些套路嘛 , 对 , 比如说像外星入侵地球这样的一个大纲 ,他们一定会说啊 , 先入侵地球了 , 然后地球哀鸿遍野 , 全部快快挂了 , 然后有一个领袖出现了 , 对吧 , 然后他带领大家战胜了外星人, 然后自由获得和平 ,是这种这种故事应该说你是烂大街了吧 , 大家都知道就怎么写 。
但是你作为小说家 , 你不太希望就是故事真的是按照这个方式写 , 或者说至少在这里面应该会有一些比较更加自我的 , 或者更加大的波折 , 然后把这个事情做成 。
应该说就是小说家应该是很挑剔的一个人吧 , 就是凡是被 AI 生成过的东西就不想写成这个样子 。
所以它就是我感觉上是可能小说家永远不会满足吧 , 应该是这样子 。
你现在用 AI 来辅助写小说的话 , 它会就怎么影响你写作时的那种状态啊 ? 就是比如说它会让你更有心流 、 更专注 , 还是它会打断这个感觉 ?
对 , 这个很好的问题 , 我觉得其实还是会打断的 , 就是应该说很多时候这样的一个过程吧 , 就是如果有一段是真的我是想写的 , 然后我也不想让 AI 打断的话 , 我就会完全让自己写 ,而不会去让 AI 去改 。
然后把这段写完之后, 然后可以说这段是我我保留的 , 我不希望你动 , 或者说你有些润色就可以 。
然后有些部分呢 , 我可能是有有部分我也没有空写了 , 然后我让它来去填充 , 通过这方式可以组合 AI 跟人之间的那个创作 , 这是这种办法 。
但这个其实需要一些 , 就是你需要写个程序吧 , 就是比如说你输入的时候你有一大堆的东西 , 就这里面有一些是人写的 ,有些是空的 ,但是有一些大的想法 , 然后这大一部分拿过来 , 然后用 AI 去处理一下, 然后它发现这部分需要用 AI 填充的 , 那么你是呼叫 AI, 呼叫 Gemini, 呼叫这个模型 , 然后把它填进去 。
所以你是自己做了一个这样的小工具给自己用是吗 ?
啊 , 对 , 我有这样很多这样的小工具 。
哦 , 这个我觉得挺好的 , 它其实是一个囊括了 AI 和人的一个协作的一个写作的软件啊 , 我我可以这么理解吧 。
啊 , 对对对 ,但是其实也这种东西也是变化很大的 , 就是你可能每天换一个想法重新再写一套 , 这都是有可能 。
你这个是现在只是在自己用是吗 ? 你有分享给比如说其他写东西的朋友用吗 ?
没有没有没有 , 这个我都不太好意思拿出来 ,因为我感觉它都非常操 , 对吧 , 然后很多东西要修改 ,而且这个流程本身也在不断变化中吧 ,也不是说是固定的 。
那你写这个工具本身你是自己敲代码写的 , 还是也是用 AI 帮你编了一部分程序 ?
那当然是 AI 帮忙的 。
哈哈哈 , 哦 , 就是比如说 Cursor 之类的这种是吗 ?
对 , 我我是订阅的 , 我是 Cursor 用户嘛 , 我一个月 20 美金可以订阅 。
嗯 , 了解 , 所以这个 AI 其实是渗入了现在的很多环节 , 对吧 , 先用 AI 帮助编程一个写作的软件 , 然后再用这个写作的软件又可以调模型来和人一起写小说 。
这个肯定是目前最有解嘛 , 就我现在看不到更比较更好的 ,但是具体怎么调用啊 , 具体通过什么方式把人和 AI 的那个写作合起来 , 这个都是很好的问题 。
对 , 我觉得你现在这个生活很有意思 , 就一方面你是一个 AI 研究者 , 这是很新的一种职业 , 然后另一方面作为一个小说作者 ,其实是讲故事嘛 , 这是人类可能有了语言文字以来最古老的一个活动之一 , 就是你同时做这两件事 , 它给你带来的比较特别的体验是什么 ?
体验应该是这样 , 就是之前我也曾在书上分享过 , 就是我觉得我不靠谱的想法 , 我就写小说 , 靠谱的想法用来写论文 , 大概是这样的一个想法吧 。
那么这样的话不会浪费掉我的一些想法 , 然后这两边的那个交互呢 ,其实也可以让我自己有些新的想法和体验 , 包括比如说这次就是这个采访 , 对吧 ,也会让我一些新的想法 。
所以这个本身是一个让我觉得非常 enjoy 的一个过程 ,也是一个调剂吧 ,因为如果你天天想写代码 , 或者天天想那个 research idea 的话 , 它思维还是会枯竭的 。
如果有一些跳出这个局部的那个优化 , 或者局部的工作的这样一个大的一个脑洞式的工作的话呢 , 可能会让这个局部的工作变得更有趣 , 同时你能够看到更远的东西 。
比如今天的采访会让你想到什么新的东西啊 ?
对 , 就是今天采访让会让我去想 , 就是像比如说之前那个您跟我问的那些问题啊 , 比如说 lead 的一些转变 , 对吧 ,其实那个你在问我这个问题之前呢 , 我没有意识到我在我的博客里面会有这样的一个转化过程 。
期纲里面写完之后, 我突然意识到哎 , 我真的是有这样的一个 , 就是就是全身您您把您做了这样一个数据化学的工作 , 然后我发现啊 , 我的博客里面确实就这么写过 。
我意识到其实我的思想和想法也是在随时间而变化 , 这个对我来说也是很大的一个帮助 , 我也非常感谢 , 对 , 这个很有意思 。
像之前还有个问题嘛 , 就比如说包括这部小说写的博士生是搞物理的 , 搞纳米的 ,而不是搞那个计算机的 , 对吧 , 我觉得我在写的时候没有想过这个为什么要从搞物理入手 ,但我潜意识的觉得从搞物理那边去写呢 , 会更有意思一点啊 , 所以我从这个方向去写 。
但是我看了这问题之后, 我会想到嗯 ,其实我当时可能潜意识的觉得 , 如果从计算机的方向出发呢 , 可能会陷入这个赛博朋克的风格啊 , 就是啊 ,有个黑客 , 然后计算机非常厉害 ,他潜入某个系统 , 然后把系统黑掉了 , 然后从此成为救世主啊 , 这样的一个模式呢 ,其实应该说比如说在那个 Matrix 啊 , 黑客帝国里面已经出现过了 , 对吧 , 所以我可能在写
作的时候 , 下笔的时候 , 下一步会避开这个有一条套路 , 去找另外一条路啊 ,但是我自己没有想过这个问题啊 ,但是你这边一问呢 , 我会想到啊 , 可能是有原因 。
所以这个通过这个方式呢 , 可以把一些比如潜意识的东西给具象化 , 然后会有更更好的思路会冒出来 。
而且它在情节上也是更严谨的 ,因为你这个故事里 , 它其实是中间有一个东西完成了所思即所得 , 那个还是靠物理完成的 , 就是他们那群博士生当时在研究的这个纳米机器人。
对 , 就你有这个东西你才能实现 , 就是最后我们又生活在一个虚拟世界里 , 然后实际上我们又有一个服务器 , 可能被发射到了比明星或者一个很遥远的宇宙的角落 , 然后让人类可以用虚拟的方式在这个宇宙里去探索 。
啊 ,是的是对 , 你还是需要物质基础嘛 , 对吧 , 你不可能直接完全是那个数字化的啊 , 所以这个还是是需要这么写的 。
所以总的来说 , 我觉得就是通过这样交流 ,是有很大的一些有意思的一个思维碰撞 。
创作与遗产1:25:10
你觉得未来一段时间 , 什么样的写作可能会被 AI 替代 ? 什么样的写作是不会被 AI 替代的 ? 比如说就未来 5 年吧 , 可能说我们可以说稍微短一点的时间 。
呃 , 我觉得是这样吧 , 就是还是希望每个人能够分享自己独一无二的 , 或者说是没有人见过的一个见解 。
我觉得这个可能是不会被 AI 取代的那部分啊 ,因为总的来说 ,AI 还是需要新的知识作为它的知识资源吧 , 然后进行训练 。
如果这个新的知识 AI 现在没有办法创造 , 或者说没有办法生成的话呢 , 那么每个人类自己携带的新的知识 , 它可能会成为 AI 最想要的东西 , 或者说会成为最有价值的信号 。
我觉得这部分应该说是比较难 , 就是最终可能大家会变成自己的个性化写作的过程 , 就每个人都想分享自己的经验 , 然后每个经验可能是从来没有被探索过 , 从来没有见过的啊 , 比如说是这样子一个一个一个一个设定 。
那么这可能会成为人类真的是探索心海的一个原动力吧 。 这这可能我之前也在一个博客里面写过 , 就是如果真的大家变成这样的一个社会的话 , 可能有人说我愿意去月球 , 或者我愿意去火星 , 我成为第一个登登陆火星的人, 然后我把所有登陆火星的知识都分享给大家 ,因为这部分知识是就是我们的数据库里面从来没有过的 。
我觉得这个应该说是非常重要的 。 但是这种就是程序性写作 , 比如说公文啊 , 函件啊 , 比如说法律条文 , 这些东西可能就没有那么创意的那种 , 可能会被 AI 的那个标准程式 、 标准模式给给取代 ,是有可能这样子 。
你说的这个点和小说情节又呼应了 , 就像银河联盟 ,他最想要的就是散落在宇宙各个角落里的新的想法啊 , 然后 AI 可能未来一段时间最想要的是人们的独特的体验和想法 。
我觉得应该是这样的 , 这个都是一致的嘛 , 对吧 ,因为我并没想过这些东西 。
就是在这个 《 破晓之钟 》 里面有一个很经典的情节 , 就是有一刻人类可能要灭绝了 , 就编制了一串遗产信息 ,是关于人类文明的记录的 。
你在书里是这么描述的 :" 我们是人类 , 曾于银河系悬臂太阳系第三行星居住 , 被银河联盟毁灭 。
我们知道四种基本力及 118 种由不同原子构成的元素 , 目前模式识别方式为多层非线性神经网络 。 我们存在过 , 进步过 , 抗争过 。"
嗯 , 感谢你的收听啊 , 然后这个里面就是它其实都是讲的一些理工科的成果啊 , 好像没有放什么文化艺术的东西啊 , 就是如果如果可以放的话 , 你会你会放什么 ?
啊 , 我觉得是这样啊 , 就是首先第一个这个是个无心之事啊 , 我不觉得文化艺术是不重要的啊 ,不过当然对于这样的一个信息来说呢 , 我觉得比较重要的是 , 如果真的我们人类要发出这样的信息 , 一定是在信息的一开头给大家讲一些共通的知识啊 , 比如像数学和科学技术那些是共通的 , 全是就是假设物理定律是一样的话 , 那么全宇宙都是有同样
的信息 。 那么发出这样的信息呢 , 如果有其他的生命接收到 ,他们可能是更容易理解啊 , 然而文学艺术那个是独一无二的那个信息 , 所以这个信息呢 , 应该说不那么容易被那个地外生命所理解吧 , 所以我会下一次能放在后面 。
那我想补充问一下, 就是在你放的这些共通的信息里面 , 我觉得对经常看科幻的人来说 , 比如说描述地球在银河系的位置 ,在宇宙的位置 , 包括物理的四种力 , 对吧 , 什么强力 、 弱力 、 电磁力什么的 , 然后化学元素 , 这些都比较常见 。
这个模式识别方式为多层非线性神经网络 , 这个显然是在说 AI 嘛 , 就是你可以讲讲就是它为什么是这样去描述的啊 ,因为这好像不是我们一般去说人工智能的描述的方式啊 。
对 , 我觉得我这么放的一个原因呢 ,是因为嗯 , 这个其实是代表了就是人类对知识的 , 或者对于那个智慧 , 对于数据的一个那个工具的一个方式 , 对吧 , 就是我可以认为 , 就比如说我们大家从一个信息的处理的这样一个方式出发吧 , 对吧 , 你有很多方式可以处理信息 , 比如让人去处理信息 , 然后让那个简单的模型去处理信息 , 或者让比较复杂的深度学
习网络来成型处理信息 。 那么根据人类处理的信息的一个方式呢 ,其实可以大概判断出就是这个这个种子 , 它大概处于什么样的状态啊 , 所以这个可能是一个标志性的事件 , 应该可以这么说 。
对 , 就是当然我我也是 AI 从业者 , 所以我会下意识的把 AI 的地位拔高啊 , 所以这个有一个自我的一个拔牙刺在上面 。
对 AI 来说 ,因为一旦这个机器能够更智能的处理信息的话呢 , 那其实对于整个人类的认知能力呢 ,是有很大的提高 。
在多层非线性神经网络之前 , 人类的模式识别方式是什么呀 ? 就哪些东西叫做模式识别啊 ?
啊 , 那真的是这样 , 就是一般是就是在那个生物学系出来之前啊 , 我们一般是这么做的啊 , 我们先有一些那个人工写下来的那些特征啊 , 比如说我知道今天天上有云啊 , 所以有可能会下雨 , 这样的一个简单的一个逻辑推论 。
那么对于那个人类来说呢 , 就是在神经网络出现之前 , 我先把天上有云这件事情作为一个事实写在数据里面 , 然后我希望这个模型呢和天上有云直接联系到下雨啊 , 这样的一个学习过程 。
但是呢 , 就是说对于这个学习过程来说 , 首先需要有人把天上有云这件事情写下来 。 那么这部分其实是人类的知识 , 人类知道天上有云这件事情跟下雨是有可能有关系的 ,但关系有多大不知道 ,但是我先写下来让机器去学 。
所以那个时候呢 , 机器学习相当于人类已经知道了大概的那个逻辑关系了 , 然后让机器学定量的关系 。
但生物学系其实把这个过程给颠覆了 , 就生物学系来说 , 就是我其实并不用写天上有云这这些四个字 , 我只要拍一张 , 比如说今天的照片 , 然后这张照片用它来预测接下来会不会下雨 。
那么生物学系呢 ,在足够样本情况下呢 , 它可以自动的把这个照片里面那些可能的那个模式连接起来 , 然后让它预测会不会下雨 。
那它比如说可能会把那个上面那些像素拼在一起啊 , 然后拼在一起之后呢 , 看起来像是个云的形状 , 发现这个云的一个高层的概念跟最后的那个最后那个下雨这个结局是有关系的 。
那它因为这个原因 , 所以它会自动学出来这个云的概念 ,而不是让人去照顾它这个云这个概念 。
所以因为有这个能力呢 , 所以它其实又在很多情况下 ,其实它展现出一种比较超乎寻常的啊能力 , 它会自动去学习概念 , 自动去总结那个高层的经验规律 , 然后用它去预测将来预测其他的一些数据 。
那么这个其实是个飞跃 , 你知道越来越人其实并不需要那个花很多心思和代价去真的去帮机器去标注很多高层的概念 , 然后去学最后那功力 ,而让机器把整个过程都自己做了 。
这个其实是应该说至少对我来说 , 我觉得是生物学系啊 ,在获得那么大成功的原因所在 。
那我们目前能看到模式识别的下一个方式的苗头了吗 ? 就多层非线性神经网络之后可能是什么 ?
现在应该说还没有完全看见吧 , 对 ,因为嗯 , 我觉得还是现在目前还是在这个框架内在玩 。 我觉得可能之后可能需要呃 ,有办法能够找到更有效率的找到这样模式的方法啊 , 然后不用通过大量数据 。
还有一种就是你怎么样去学更加高层的概念的组合啊 , 比如说小学生其实都知道怎么算多位数加减乘除啊 , 告诉他规则 ,他马上可以知道任何两个数字乘起来应该怎么算 , 画个数式一个算 。
那么只要小学生足够细心 , 答案一定是对的啊 。 但是机器就是或者说大语言模型 , 对目前来这目前来说 , 它还是没有办法学会这种高层的规则啊 , 让它去做一个三位数乘三位数的乘法 , 它能它能做对 , 四位数也可以做对 。
但是比如说你大到比如 12 位数乘 12 位数 , 它就开始错了 , 它有一个界限的 , 然后在这界限之外它就做不出来了啊 。
所以它其实并没有学到真正的就是乘法的规则啊 ,但是它是通过大量的模式匹配 , 比如说它看到了就最后两位数是 25, 两个 5, 那下面肯定是 25, 大概是这样的一个逻辑结构吧 , 或者这样的一个经验规则啊 。
它把这些经验规则全部拼起来之后呢 , 大概能猜出来最后的答案是什么啊 , 大概是这样子 。
所以但是它并不是一个真正的那个逻辑规则去来计算那个多位数乘法啊 。 所以这个能力呢 ,其实现在应该说还没有吧 , 应该说这是一个很大的问题啊 。
但是怎么样去解决它 , 然后怎么样能够让那个 AI 变得更聪明啊 , 这个其实是我们现在研究员想要做的一个事情 。
我有一个小的问题 , 就是为什么把它翻译成宇宙都能听懂的共通性语言的时候 , 你没有直接用人工智能 ,而用的是模式识别 ?
因为人工智能这个名字实在过于太大了 , 过于是哦 , 对对 , 所以我可能会更加想用工程性的 , 或者说精确的一个描述去回答这样的问题吧 。
对 ,因为 AI 这个字就是可能是对大众来说可能是一个一个符号 ,但是对业内人来说还是希望讲的更加细 、 更加精确的会比较好一点吧 。
那最后一个问题就是关于如果你能在这个人类遗产的信息里面放下更多的文化内容的话 , 比如说放三本可以进入人类遗产的科幻小说 , 你会选哪三本呀 ?
我可能要选三体 , 哈哈 , 三体 。 我觉得三体是应该是为数不多的小说 , 我看完之后会觉得整个世界发生了变化的这种感觉 。
嗯 , 对 ,因为就是说它给整个世界给了一个不同的解释嘛 , 对吧 , 然后或者说你会让你有种感觉是我现在活着这个世界是没有那么真实 , 于是到后面还有一层深的真真实在那里啊 。
这是我看完的一个感觉 , 我可能有连续几天有这种感觉 , 慢慢才会缓过来 , 就是后劲特别大 , 所以特别是第二部的结局吧 , 应该说是比较嗯 , 比较大的 。
然后当然还有就是比如说那个 《 基地 》 系列的这种这样子一些经典啊 , 咱们也是应该说是能够放进去的 。其实那个刘慈欣也写过一个小说 ,是关于呃虚拟世界还是去探索宇宙的选择的一个短篇小说 , 就是 《 不能共存的节日 》。
那个你可能应该也看过啊 , 对 , 它是一个二选一的选择 。 然后我觉得就是 《 破晓之钟 》 这个故事挺有意思的 , 它其实是告诉了说在这个二选一之外是有另外一种可能的 。
嗯嗯嗯 , 对呃 , 对 , 我觉得可能是人类应该会找到自己的出口 ,并不是说一旦进入虚拟世界之后大家就完蛋了 。
嗯 , 我们我觉得现在之前的很多小说都这样子 , 就是大家进入虚拟世界醉生梦死了 , 然后就不再探索宇宙了 。
但是真的这种事情发生了之后呢 , 我觉得应该会有一个中间 ,有很多中间状态 , 这种状态其实会找到一些自己的出口 , 然后啊 , 让我们的人类的好奇心还继续能够留存下去吧 。
我觉得应该是这样子的 ,也没有那么极端 ,也没有那么极端 。 嗯 。
好的 , 那今天非常谢谢田渊栋田老师来做客 《 晚点聊 》, 分享了他创作 《 破晓之钟 》 这本科幻小说的思路 ,他想表达的主题 ,以及这本书中涉及到的一些科技的想法和 AI 的思维 。
那这本书的一个出发点就是想去写 AI 时代的和 AI 技术相呃硬核的新的科幻的幻想 。 然后这本书里确实也有很多这方面的巧思 , 包括我们最开始提到的 , 它某种意义上也和后面 AI 这几年的一些发展可以印证上 。
那欢迎大家有兴趣的话可以去看这本小说 。 另外, 这本小说的第二部正在田渊栋老师的个人主页上连载 , 大家有兴趣的话也可以去看 。
那今天谢谢田老师做客 。
好 , 非常感谢啊您的邀请 。
嗯 , 好好 , 拜拜 , 拜拜 , 拜拜 。
本期 《 零点呈现 》 分享两个和之前节目的呼应 , 一是在聊 《 破晓之钟 》 里的一些 AI 技术和思维时, 田渊栋提到他在 20 年开始写这本书 , 设计承载人类意识的立方体时, 就有部分影射英伟达 。
书中外星文明对立方体设计了一个屏障 , 式立方体之间的带宽有严格限制 , 这就是为了防止大量立方体的互联涌现出新智能 。
而我们看这之后几年的 GPU 和 AI 芯片系统的优化思路 , 就是互联更多的芯片 。在 115 期与模型智能创始人徐凌杰聊华为 4 月新发布的 Claude Matrix 384 时, 我们详细讨论了这个趋势 。
除了华为之外, 英伟达也推出了 NVL 72,是它在 2024 年之后最重要的 AI 服务器方案 。 那么书里的人类是怎么绕开带宽限制 , 突破银河联盟的防线呢 ?
其实和后面的业界思路也很相似 , 就是找到一个方式 , 能在传输数据时尽量不损失信息 ,但又降低对带宽的需求 。
比如 DeepSeek V3 在 H100 的带宽减配版 H800 上, 就是用了 FP8 这种低精度的数据格式 , 降低了对通讯带宽的要求 。
二是关于更强的 AI 到来之后, 社会和世界怎么变化 , 这其实是我们在过往多期聊 AI 时都会涉及的议题 。在 I,AI 系列的第一期 《 晚点聊 》109 期中, 从个人的角度聊了普通人可以怎么应对和使用 AI。他说 AI 是一次放大个体能力的机会 , 大家可以对 AI 多一点耐心 ,不要试一下就放弃 , 可以多摸索一下现在的 AI 的能力边界 , 能做什么不能做什么 。在 106 期与戴雨森真格聊
Agent 时 ,他则是从社会结构的角度提到了一种有可能比较惊悚的未来 。他的观察是强化学习进入的领域 , 陆续遭遇李世石时刻 , 即 AI 超过人, 甚至强到人无法理解的时刻 。
那么如果 AI 模型越来越强 ,有钱就等于有算力 , 就等于有生产力 , 这会不会带来资金转化为生产力的 scaling law, 让本身掌握资源的人有更多资源 , 让阶层流动和新公司的崛起变得更难 ?
田渊栋则用科幻故事的形式 , 更详细的描绘了他设想的未来 。 这里有虚拟世界中三流画家的空虚 ,有一边进入虚拟世界一边走出太阳系的可能 ,也有他对高级文明的需求的想象 。他认为科技最终会发展到所见即所得的状态 , 这时一个已经非常高级的文明会担心什么 , 想要什么呢 ?
他的答案是宇宙中独一无二的智慧和想法 ,是其他的更优解的可能 。 这其实有点像大模型现在对我们的需求 , 它需要更多数据 ,而数据又是对人类想法与智慧的抽象 。
我们产生新的优质数据的速度 , 好像有点赶不上大模型的需求了 。 不过这一定是一件坏事吗 ?
本期节目就到这里 , 欢迎收听 。 如果你对今天聊的话题有观察 、 好奇或疑问 , 欢迎在评论区分享想法 , 这也会成为我们节目的一部分 , 让整个讨论更完整 。
你也可以把我们的节目分享给对这个话题感兴趣的朋友 , 欢迎推荐更多你想听的主题和嘉宾 。
你可以从小宇宙 、 苹果 Podcast 等渠道关注 《 晚点聊 LateTalk》,也欢迎关注我们的公众号 《 晚点 LatePost》。 下期再见
。






