晚点晚点聊 LateTalk2023年3月26日· 1:33:07

33: 人类本质是不精确的复读机:与李如一和重轻闲聊 ChatGPT

本期《晚点聊》邀请《一天世界》主播李如一与《不在场》主理人重轻,将ChatGPT等对话式AI当作可评论的软件来审视,核心论断是:它像“力大砖飞”的工程奇迹,能做好封装型任务,却只会输出正确而沉闷的“平均值”,缺少人类语言中不可量化的偏见与错误。三人从亲身使用出发:李如一称自己没有被魔法击中的感觉,重轻连续数小时使用4.0后,对比真人文章更觉其“平”;用ChatGPT练英语会导致“去身体化”的学习,无法体会某词在语境里的微妙差别。他们进一步谈到,AI只是作者,仍不能成为读者,因此也不会带来真正的范式转移;当它声称“我是大型语言训练集合、没有立场”,恰与政治正确、不担责的公关话术同构,而好奇与少数派权利被牺牲。对于“AI替人做脏活累活,人去做创造”,他们反驳说创造本身就有机地包含脏活,根本切不开。OpenAI不再Open在预料之中,Sam Altman的写作混乱也令李如一不看好其愿景。最后回到“人类本质是复读机”,他们强调人类是“不精确的复读机”,偏差与错误正是艺术和新事物的来源,太阳底下并非无新事。

  1. 0:00开场
  2. 2:15第一印象
  3. 7:46实用案例
  4. 15:55学英语
  5. 25:51词不达意
  6. 30:50信息与偏见
  7. 47:05OpenAI
  8. 54:32力大砖飞
  9. 58:57知识缺口
  10. 1:05:53重要工作
  11. 1:14:31创造与苦活
  12. 1:22:04复读机

PodHood 提供支持

文字稿

开场0:00

重轻0:29

大家好 , 欢迎大家收听本期的 《 晚点聊 》。 我是主播汉洋 。 那本期节目我们想聊的话题是一个最近您可能已经看了很多 、 听了很多的主题 , 就是 ChatGPT, 或者说以 ChatGPT 为代表的这类玩意儿 。

我们本期请到的两个嘉宾是 Lawrence 李 , 李如一 , 和重轻 。Lawrence, 你先跟大家做个自我介绍 。

李如一0:46

嗯 , 大家好 , 我是李如一 。

重轻0:48

我发现咱俩录节目 , 你的那个自我介绍就是基本上永远是这句话 。 就如果这个人没有听过你的节目 ,他们怎么能更好地了解你呢 ?

李如一0:55

他可以看那个 show notes 啊 。

重轻0:57

OK。

李如一0:58

Show notes 应该会写吧 ? 我 、 我是假定他在听之前可能有扫过一眼 show notes, 然后更详细的介绍好像也不需要了吧 。

重轻1:05

可以 。

李如一1:05

因为接下来会聊嘛 , 就他直接听内容就可以了 。

重轻1:08

OK,OK。 对 , 就是自我介绍的时候总是会多少有一点点对于听众和你关系的揣测和预设嘛 。 所以我也不会说就啰里八嗦地把所有我干的事全说一遍 ,但是我会说稍微多一点 。

大家好 , 我是重轻 , 然后我是呃 , 播客 《 不在场 》 的主理人, 然后我平时会在集合做一些节目 。

也 、 也没多多少 , 差不多一个信息量 。OK, 好 , 那我们直接进入正题吧 。 我假定你在听这期节目的时候 , 应该已经知道 ChatGPT 这个 、 这个东西了 , 所以我们这样就可以跳过一些科普的过程 。

太多写这方面的文章了 , 我们可能更多的是想在本期里面聊一聊我们是怎么看待这个技术的 。 科普文章也很重要 ,但是在我的视角中, 对这种技术进行评论本身是也是一件很重要的事情 。其实这个是一个软件里的老传统了 , 就你发现有 、 有很多人专门评论软件 , 包括像当年就是 《 爱听论 》 时代就我们经常聊的一哥们儿 ,他就会评论每一代的 macOS 10 的系统

, 然后还有一些人会像 Ben Thompson 之类的这些人,Michael Harmon 他们也会评论很多软件嘛 。 那在 ChatGPT 其实我们这期可能想做的是一样的事情 , 就是我们从科普的角度之外, 我们就是来评论这个技术和以这个技术为代表的一些思想的 。

所以这个可能是我们今天主要要聊的话题 。 那开始的时候我想先问二位一个 、 一个简单的问题 , 就是你们是怎么看待这个技术的 , 或者就是说你们的第一印象对这东西是 、 是什么感觉呢 ?

第一印象2:15

李如一2:25

嗯 , 它不是去年 10 月份出的吗 ? 然后我其实过了一两个月才开始使用 。

重轻2:30

嗯 。

李如一2:30

然后最近一段时间又跟朋友借了一个那个 Plus 账号去用它那个 4.0 的版本 。 就是这种魔法的感觉其实一直没有完全地消退 。

就这个应该是我这辈子用过的那个所谓的高科技 ,有魔法的感觉最强烈的一个东西 , 同时又让我觉得很困惑 。

所以就是一会儿觉得这个东西特别的神奇 、 不可思议 , 然后一会儿又觉得这个东西明显是问题很大 , 这两个事上来回摇摆 , 一直到现在 。

对 。

重轻2:57

那你呢 ,Lawrence?

李如一2:58

呃 , 我先想补顺着你刚才的话说一个 , 就是你说软件评论嘛 , 就是这种对话式的 AI 啊 。 就因为今天是刚 、 好像刚好那个 Google 的那个 Bard 已经公开了嘛 。

重轻3:08

嗯 。

李如一3:08

但是它是现在是只能英国和美国的用户用 ,但是反正就是我们大概一个月 、 两个月前听说 Google 要做这个 Bard, 今天反正是放开了 。

今天哪怕在那个东京的地铁里 , 你都可以看到这个消息在那个上面的屏幕里 。 然后我们知道微软也有它类似 , 微软用的就是 OpenAI 的技术了 , 对吧 ?

然后它在那个 Bing 里用了 , 就这种对话式 AI 是近年的科技潮流里比较可以去评论的一个 。 因为你看其他的这个潮流 , 像 、 像 Crypto、 区块链这些 , 它其实不属于一个 , 怎么说 , 我知道汉洋你有写相关的这个 Crypto 方面的评论 ,但是它不是一个像智能手机刚出来的时候 、App Store 刚出来的时候 , 是一个普通人每天都会接触到的一个东西 。

而 ChatGPT 就 、 就它 、 它就是嘛 ,因为它就是其实你就是跟它说话嘛 , 然后它就我觉得这个是一个挺大的一个区别 。

呃 , 我自己一开始的印象 , 我不觉得有魔法 。 是这样 , 我虽然知道它是魔法 ,但是我就身体感受上我没有魔法的感觉 。

因为魔法 、 魔术其实就是有些东西你看不见嘛 ,因 、 因为看不见 , 所以你觉得有魔术的感觉 。

这个我觉得用它来用 、 用魔术来形容 GPT、ChatGPT 是很恰当的 。 但是我 、 我身体感受上我没有这种感觉 。

我的第一感觉就是它的行文 , 就是它 、 它吐出来那些文字 , 我觉得很像就是我们在网上经常看到的 , 就写得不怎么样的文字 。

这是我的感受 。 这个所谓写得不怎么样 , 就是说写得非常的八股吧 , 或者可以这么说 。 它 、 它很正确 ,但它正确得让人看得很觉得很沉闷 , 这是我的感受 。

重轻4:40

对 , 那我 、 我再多问一句 , 就是你说的这个正确但是很沉闷 ,是同时包含了英语和中文 , 对吧 ?

因为我觉得它的英语和中文给的回答还不是完全一致 。

李如一4:48

我没有太试过中文的 , 我基本试的都是英文的 。 而且我 、 我必须坦诚啊 , 就我 、 我试的数量很少 ,而且我也没有用过这个 4.0 版本 。

也要补充一下, 所谓正确当然不是指它给的答案是正确 ,但我们都知道它给的答案经常会是用现在中文常见的说法 , 就是所谓一本正经的胡说八道嘛 , 就是语法都是非常的完美的 , 逻辑也是完美的 ,但是它给出的那个最终的那个说法可能完全是错误的 。

我说的正确恰恰是 、 是 、 是指它形式上的正确 。 就是它很像一篇 , 比如说如果你是个把英语当成外语来学习的人, 你会觉得说它作文写得很好 ,是这个意义上的正确 。

重轻5:22

对 ,因为我 、 我可能用得稍微多一点 ,因为我毕竟要做这方面的研究嘛 , 我就把能找到的这种大模型都用了一遍 , 包括像是 Cura 出的那个 , 然后 ChatGPT, 然后 3.54 都用了用 ,而且我还有包括百度那个文心一言我也用了 。

我会拿一个问题问所有的 AI, 看它们能给我什么样的回答 , 或者不同的回答啊什么的 。 就是我第一感觉也同样没有感觉它是魔法或者魔术 ,因为我 、 我知道它的是怎么来的 , 所以我对我来说它不神秘 。

但是我感觉这东西有点东西 ,因为它还是超出我的想象在某方面 。 我 、 我最开始以为它就是哦 , 又是 another 以这个噱头出现的东西 , 像当年小兵一样 。

我不知道大家还记不记得当年微软小兵刚出来的时候 , 就是有很多溢美之词 ,也是当然也是他们买了很多 PR,但就那个溢美之词你读下来 , 你感觉形容 ChatGPT 也是没有区别的 。

所以最开始我有种感觉就是哦 , 又是大家不知道发啥了 , 然后找了一个救命稻草 , 开始狂发狂写 。

但用了一下我发现它是少有的跟你夸它能达到差不多效果的技术 。 它不会让你非常惊讶 ,但是它不会让你失望在很多层面上 。

因为你会想它会有什么问题 , 它的确也有 ,但是在它做得对的地方 , 它做得非常对 。 而另外一点我也挺同意 Lawrence 说的 , 就是它是一个可以被评论的技术 。

就 Crypto 之所以有些东西很难评论 ,是因为我们对它的定义差别太大了 。 但是至少在今天我们在聊这种对话式 AI 的时候 ,在聊 ChatGPT 的时候 , 我们所有人都说的是一样的东西 。

就这点其实挺不容易的 。

李如一6:42

不是 , 主要是 Crypto 对于大众来说 , 它能评论的就始终停留在它的 vision 上, 就是我们想象 , 就是它在理念上 、 在道理上它应该是怎么怎么样 。

重轻6:52

对 。

李如一6:52

但是 ChatGPT 现在已经就是在你眼前就泰山压顶了 , 这个 。

重轻6:55

对 。

李如一6:56

而且就是它已经完全越过了那个新科技 , 就那个 novelty 的那部分 。 因为 GPT-3 当时的那些新闻你还记得吗 ?

就是前几年就说 , 呃 , 什么财经记者已经开始使用 GPT 来生成一些新闻了 。 然后当时你就觉得这种 use case 非常的 , 就有点牵强 。

就是你能明显感觉到就是因为这个东西新 , 然后对 journalist 的冲击特别大 , 然后呢 ,他们试着去 integrate 一下, 然后呢 , 果不其然就是到了去年到今年的时候 , 你 、 你就是你能够在网上看到就是记者们又开始说这个东西实际上就是一个 , 就是又 phase out 了 。

就当时是大伙受到了惊吓 , 然后试图去拿这个提高自己的效率 ,因为要跟别人去竞争效率什么这些东西 。

所以 GPT-3 的那一波是那个 、 那个就是新技术给人的直观冲击的那个 、 的那部分 。 但是 3.5 到 、 到 4 的这个时候就是已经摆在你面前 , 已经是一个 reality, 你要接受这个现实了 。

实用案例7:46

重轻7:46

我可以说一下就是我对它我第一次感觉到 , 呃 , 就让我对它改观的一个 、 一个事情 , 就是是我一个喜欢日本音乐的美国朋友 , 那他是不会日文的 。他有一次在网上找一张即将要发布的唱片的资料嘛 , 当然这些资料都是零零星星的 ,因为最终的结果没有出来 。他反正拿到了一堆日语 , 然后呢 ,他是让 GPT 不知道怎么是把它把这些日语按照一定的格式让它排起

来 , 然后方便它导入它的那个 MP3 的 ID3 tag, 这个大家都知道是什么东西吧 ? 就是 、 就是 、 就是后 、 后摄数据 metadata。

李如一8:23

元数据啊 。

重轻8:24

就是它作为一个完全不懂日语的人, 然后它通过 ChatGPT 来做这件事情 。 这是一个我根本就没有想到过的使用案例 ,而这点我觉得很 、 很有意味 。

为什么 ? 因为我是一个长期在几种语言里游走的人嘛 ,而它是一个基本上是个单语言人。 这里有一个区别就造成就是说它会对于无论是 ChatGPT 还是因为它长期是用这个 Google Translate 在推特上跟一些日本人以日文对话 , 就是它先把那些日文翻译成英文 , 然后它要说的话也先写成英文 , 再翻译成英文 , 再 、 再回去进行对话 。

就是它对于这所有这些工具非常的信任 。 这是我做不到的 。 就是我 、 我们这种就是做过翻译 , 然后又相对比较在乎各种微妙的就是在两种语言转换之间那些比较微妙的东西的时候 , 我们天然的就会不信任这类的工具 。

而它就是像是一个就直接跳下水游泳的人就开始用 ,而且我发现它用得很好 , 完全达到了它想要的效果 。

啊 , 这个就 、 就让我觉得我觉得这是一个挺 、 挺有标志性的事的一个 、 一个例子 。 因为呃 , 我们看到现在实际在用 ChatGPT 或者类似的对话式 AI 在帮助自己工作的 , 往往都是这一类的应用 。

就它不是经常我们在坊间看到的那种 grand narrative, 那种科幻感很强的 , 甚至带有末日感的那样的一种叙述 ,而恰恰是自己的某个工作流程里的某一小段 、 某一小块 。

呃 , 这一块我发现刚好用 ChatGPT 可以很方便地解决 ,而且也 、 也很容易 , 然后很容易就可以降低成本 。

我觉得这些领域可能是目前是比较去谈论它是比较有意义的吧 。 但是很可惜的就是我发现谈这些问题的人, 就是虽然可以理解 ,但是依然很可惜 , 就是他们感兴趣的更多是这种偏科幻感的 、 有末日感的叙述 。

那些叙述我认为其实基本上属于噪音了 。

李如一10:15

对 ,因为我自己用 ChatGPT 现在工作的时候的两个很重要的场景 , 第一个是改代码 , 就是让它帮着看代码 。 因为我们之前有个同事 ,他有一天想这个 bug 需要一个小时修 ,他想那个大家不都说 ChatGPT 吗 ?

然后他就试了试 , 然后 5 分钟修好了 , 之后我们都开始怎么用 。 然后另外一点就是练英文 ,因为我需要一个人能在我跟他闲聊的时候帮我纠正我的错误 。

因为你知道闲聊是个很难练习的英文模式 ,是因为你如果你不跟母语者聊 , 你没有机会说这种东西 。

你写文章也好 , 你发推特也好 , 它都不是闲聊 , 闲聊必须和一个人去对话才能练习 ,而我就需要这样的东西 。

然后我 、 我有时候会每天早晨起来跟因为他那个前一天的 session 会关 , 我就会跟他说帮我练习英文 , 然后纠正我的错误 , 然后就可以开始跟他闲聊 。

因为 ChatGPT 的语法是不会错的 , 所以我就跟他闲聊就比较方便 。 但这里面其实就有一个刚才 Lawrence 说那个很有意思的点 , 就是在这个时候我始终有一个东西我没有办法通过它得到 , 就是在某个语境下某些词的细微差别 , 它完全可能是合乎文法的 ,但是大家就是不这么用 。

比如昨天有一个例子 , 就是我 、 我一个我一个朋友 ,他写了段英文让我帮忙看 ,是 ChatGPT 翻译的 , 然后他说 the recent meeting, 然后那个是个当天的会议 。

我们都知道正常你说最近的会议的时候没问题 , 当天的会议可以是最近的会议 ,但是正常我们说话的时候那就是当天的会议 ,不会用最近来形容这个词 。

但 ChatGPT 在翻译的过程中其实它文法是完全没有翻译错的 。 那这种细微的差别反而是你可能有人说你不需要懂英文了 , 你不需要学这些东西了 ,其实不是的 , 反而恰恰是你会英文的时候你拿它你再改会更方便 。

但当你真的什么都不会的时候 , 你是意识不到它这些细微微妙的东西会可能会出现一些问题 。 所以我也在想 , 比如像 Lawrence, 就是你的这个朋友在他做这件事情的时候 ,他是不是也并不追求 100% 的精确呢 ?

他只追求够用就可以了 。

重轻11:53

嗯 , 这个当然当然是如此了 。 这其实就是就是我刚才想想 communicate 的一个地方 , 就是说它现在在完成某些具体的 、 呃 , 实际的可以很准确的定义的一些小的一些功能或者一些任务的时候 , 它是非常非常有效而且非常好的 。

我 、 我这里再举一个例子 , 我不知道前两天有没有跟你们讲 , 我就有在一个群里有讲 , 就是 macOS 已经出现这么久了 ,但是现在大部分人仍然不知道如何在 Finder 里面方便的批量改文件名。

比如说你有一堆导出的这个旅游时候拍的照片 ,有 200 张照片 , 然后它都叫 DSC 什么什么什么点 JPG, 你可能我想在其中 100 张后面加一个 dash, 然后比如说 Tokyo Tower 表示这些都是在在 Tokyo Tower 拍的 。

这件事情我敢说大部分正在听这个节目的人没有办法马上给我答案 。 而这点是很奇怪的 , 你们不觉得吗 ?

就是我认为这是一个很基本的需求 。 我跟你们说过这件事情 , 你们还当时说可以用那个 automator 来做 。

李如一12:53

对 ,但我们忘了免费 。

重轻12:54

Automator 就根本不是一个一般人会用的一个一个什么 ,但是这件事情用 ChatGPT 做就很简单 。 所以像这样的一种应用场景 , 我觉得是它的是它的强项了 。

但是我还是回应一下就是刚才汉洋说的两点 。 第一点 , 我 、 我作为一个补充哈 , 就是我前两天也发给你们看了 , 就是汉洋也见过的 , 呃 , 这个我们的在日本创业的朋友徐乐乐 , 她发了两条 tweet, 我读一下吧 。

最近几天一直在尝试使用 ChatGPT 来提高代码效率 , 目前感觉是能用好 AI 的五人小团队 , 至少能做以前十人团队的活 , 甚至更多 。

而且随着相关工具的成熟 , 这个比例会继续放大 。 简单来说 , 经验同样重要 ,但是经验的用途会有变化 , 需要关注的内容会更高阶 。

更重要呢 , 她说是指这个对完成工作需要的技术栈能有基本的掌握 , 然后呢 , 能清晰地描述需求 , 同时能快速评价 AI 所产生的代码的可用性 。

然后她说呢 , 这都说对于活人哈 , 就是一部分靠记忆的细节变得不再重要 , 比如某个类库的用法 , 比如呃 SQL 的细节语法 。

引用完毕 , 这是徐乐乐说的 。 因为我认识徐乐乐 , 她是一个非常稳 、 非常实际的人, 就是她不会说虚话或者空话或者大话 。

所以我 、 我很信任她说的这两段 , 就是我可以看到 , 我 、 我觉得这个就是现在对话式 AI 能够带给我们的很重要的东西 。

而回应汉洋你刚才说学英语那一点哈 , 我 、 我当时听到我首先第一个感受是这样的 , 就是它进一步的让学习外语这件事对你来说变得去身体化了 。

这是什么意思 ? 就是说因为你跟它的对话不是以语言进行的 ,不是用嘴进行的 , 你是打字进行的嘛 。

所以你说语法正确也好 , 语法错误也好 , 或者某一个词在什么场景用或者不用也好 , 你这里面没有涉及到这个词听起来是什么样 。

我觉得这是一个嗯很大也很重要的区别 , 就是因为语言是第一性的 , 文字是作为记录语言的工具 。 所以你比如说如果你说你要它帮你学一种外语的话 , 我认为理想的状况就是说你 、 你是一定需要听到这个词被什么样的人以什么方式读出来 。

如果你缺了这点 , 那我们刚才说老说这个语言里有微妙的部分 , 我觉得这个就是一个其实是在可能被中国的很多语言学习者特别忽略的一点 。

因为我们知道中国的外语学者说错请纠正啊 ,但我觉得似乎是有这种比头要胜过那个嘴巴和耳朵这样的一个一个名声在外的 。

李如一15:22

我要补充一下啊 , 就是我 、 我是怎么学英语的 。 我现在同时用几个方法 。 第一 , 每天大量阅读英文的文章 。

第二 , 我会周期性的和 Cambly 上的就是一个外教的软件 , 我会选那个外国人跟我聊天 , 每周两次 。 但是我发现这里面现在差了一个点 , 就是在于我现在认识的很多人是从网上先认识他们的 , 我需要先从网上跟他们聊天 。

所以我需要有一个闲聊的这个这个学习 , 所以我才用了 ChatGPT 这个东西 。 所以它对我来说是个补充 ,因为我的语言和对话是可以和真人去交流的 。

对 , 这这个是我 、 我的一个补充 ,但这个和本期主题没关系 。

学英语15:55

重轻15:55

就我想象了一下, 就是因为我因为我我不拿 ChatGPT 学英语 ,但是我想象了一下, 拿 ChatGPT 学英语应该是个相当相当糟糕的 。

就这里面有有一些东西是很糟糕的 。 就是你就是你品品 , 就是首先那个就是 ChatGPT 的英语 ,因为我只用它英语的交互 ,因为它那个中文很明显是因为缺少训练材料而导致的一些的问题 。

我想要获获得完整它使用体验 , 我不可能去使用它那个它语料偏少的那个语种 。

李如一16:21

对 。

重轻16:21

所以我都一直在拿英文去跟它去交互 。 它那个英文是完全 generic, 就是跟刚才 Lawrence 说的那种就是正确而无聊的那个感觉是完全就是完全 generic, 就是它显然知道所有单词 ,但是我没有办法谈论 ChatGPT 知道或者不知道任何东西 ,因为它不是那个 , 它是一个神经网络的一个什么 , 就是就是它显然它能够运用所有的词汇 ,但是它不运用 。

就是你在 ChatGPT 使用的过程中, 你能够看到的单词量是非常少的 ,而这个也不是问题 。 问题是它是一个完全由它那训练材料投票而形成的 。

就是我说投票是一很不规很不规范的说法 , 就是它训练这过程是因为它的神经网络这个通路是最强烈的 , 所以它会给你使用这个词 。

它那个 predict the next word 的这个过程中, 给你的是整个英文互联网的汇总出来 , 就是像一个一个还反倒是一个挺民主的过程出来的那个结果 。

那个那个结果是一个毫无任何就除了准确以外没有任何其他的追求的 ,而且它也不可能产生什么有意思的偏差跟错误 。

李如一17:22

啊 , 这个不对 , 这个这个我得我得我得纠正一下 。 因为这个刚才我们录音前我问了你们有没有看那个 Stephen Wolfram 的那个文章 , 你们没有 。

它其实提到了这点 , 就是我是假设我们听众会知道 Stephen Wolfram 是谁啊 , 反正是一个就是在在在无论是电脑界还是科学界都是很受尊崇的一个人了 。

放到那个 show notes 里吧 , 把链接 。他最近写了两篇文章 , 都很长 , 然后呢 , 第一篇文章就是他去等于是深度的解析了 ChatGPT 的工作原理 , 然后他其实讲了说确实它是一个统计模型 , 就像刚才那个重轻说的那样 , 就是一个词出现了 , 然后它通过自己对数十亿甚至上百亿的文章的这种学习 , 然后来预测下面会出现哪个词嘛 。

但是呢 , 它不是一个民主投票过程 ,因为就是说啊 , 这个它背后的工程师其实意识到了刚才重轻和我说的那个问题 , 就是它不想让文章显得很平 。

这点 Wolfram 在文章里是有明确写到的 。他就讲他说 , 所以他们他们引入了一些软性的一些规则 , 这具体是什么我当然是不知道的 ,但我也没有办法复述 ,但总之是他们有考虑到这个问题 。

所以呢 ,他不是说真的说只看啊 , 这个词后面最有可能出现的另外那个词 , 然后我就选这个词 , 肯定不是这么简单的 。

它有一些相对的不可量化的柔性的一些规则 。 但是就是说即便如此 , 它出来的结果至少在我和重轻看来依然是很平的 。

呃 , 当然了 , 这这是一个不停的在进化的一个产品 , 所以我们现在只是说在这个现在 3 月底这个时间点我们看到的 , 包括重轻用了 4.0 版嘛 , 我没有用过 4.0 版 , 就是说 4.0 版吐出的文章你看着仍然觉得 generic, 仍然觉得很平 。

如果是这样的话 , 那就是这是我们到目前为止到录音为止我们的感受 。

重轻19:01

对 , 我顺着刚才的那个情况说 , 就是昨天下午给我的那个很很震动的感受是我连着使用了四五个小时 ChatGPT, 就 4.0 那 25 个 quota 被我用完了之后就 fall back 到 3.5, 就我连着用了四五个小时, 然后我在这过程中偶尔的打开一篇那个我想看的真人写的文章 , 然后我就是那种这个对比才会显得特别的强烈 , 就是在你使用 ChatGPT 以前 。

李如一19:26

啊 , 没错没错 。

重轻19:27

就是你不会有那个特别就是人写文章的那个感觉 , 没有没有对比没那么明显 , 就是那种就没法形容 , 就是同样的一个哪怕这个话题是一个特别主流特别那个 , 比如说我就是在看比如说美国对于毒品的公共政策的变化的这个事 , 真人写的那个文章的那个人 ,他在谈论这个事情的时候就是是有一定的不准确的成分在里面的 ,但是他主要是那个不

准确背后有一个他的动机和他的一种意识 , 就是那个人他有一种很在意的东西 , 所以他在说话的时候他说不了 , 就真人说不出 ChatGPT 那么客观和就是中正的 。

李如一20:05

中正平和的话 。

重轻20:06

的那个话 , 甚至它有一些的 paragraph 我就做实验性质 , 我把那个书里面的的这段话我就粘给 ChatGPT, 我说你给我不带 sarcasm 和这个 euphemism 的 , 就是用特别 plain English 的方式去给我再 rewrite 一遍 。

它 rewrite 出来的就是 ChatGPT 的那个样子 , 然后就感觉到我们在拥抱这个东西进入到我们的那个生活世界和我们的工作的过程中, 就就我怀疑我们不知道自己在拿什么交换或者在失去什么 。

我甚至不是在批评它 , 我只是说我们失去的东西跟我们跟我们开始用它之前以为的不太一样 。

李如一20:40

这个点我有一个能直接补充的 , 就是昨天也是昨天下午发生的例子 ,但我并不是为了录这期节目而特意找的那个例子 ,而就是正好发生了 , 就我那个就写 recent meeting 的那个那个朋友 ,他说其实是我同事 ,也是我非常好的朋友 ,他给了我段英文 ,是拿 ChatGPT 改的 , 然后我我就感觉那段英文怎么看怎么别扭 , 就是那个英文的所有的句子都合乎文法 ,但你

就是感觉正常人不那么说话 , 然后我说你那句话是不是中文翻译过来的 , 你不是直接写那英文 。他说对 , 我说你中文给我看看 , 然后我就发现一点 , 它的中文都是有问题的 , 然后问他为什么你你不难道你没有觉得你的中文正常不会这么说话吗 ?

他说对 ,他说他这么说是为了方便 ChatGPT 去理解 。

重轻21:19

啊 , 对啊 , 这就是人和交互界面之间的关系嘛 。

李如一21:21

对 。

重轻21:22

就我们在用搜搜索引擎的时候也是一样啊 , 就是就这个事特别搞笑 , 就是我们原来会嘲笑长辈或者是就是不那么 tax IV 的人对着百度或者是 Google 输入什么那个就是洋葱炒鸡蛋怎么炒最好吃 , 就是他会说一个人的句子嘛 , 然后就是我们会会说你这这是这是因为你不理解什么是搜索引擎 , 搜索引擎是用 keywords 去匹配 , 所以那个你给的你给

的输入一个句子是没有用的 。 然后到了今天就是就 jokes on us, 就是因为接下来正确的使用方法就是这样的使用方法了 , 就特别的就是交互界面和我们的关系就是这样的 , 就是它在训练我们的程度比我们训练它还大 。

李如一21:59

对 ,但这里面跟搜索引擎就是有一个很大的不同是 ChatGPT 更长 , 就是它影响的不光是短句了 ,是影响的像我昨天说这种它是一段一段的大长话 , 就虽然还是有影响 。

重轻22:10

啊 , 对 , 这个就涉及到就是说你你对它究竟有多信任嘛 。 我也会在跟 ChatGPT 聊天的时候 , 我会简化自己的语言 ,因为我我就是就像刚才讲的 , 我作为自己经常做翻译 ,而且在两种语言之间走来走去的人, 我本身我很难完全相信 , 无论是它或者是各种 Google Translate 还有这个微软的 Translate, 所以我总是会去去简化 , 就是我当它当它比较弱智是这样的一个一个看法

。 但重轻刚才说的那点我印象很深 , 我记得至少是六七年前 , 呃 ,John Syracuse 在有一期节目里他就讲 , 好像就是 ATP 吧 ,ATP 反正他们聊到搜索引擎 , 然后他们就呃 Syracuse 就说你现在你搜的时候你就用句子来搜 , 基本上你就按自然语言的句子那样写一句话 , 然后它都能吐出正确的这个搜索结果给你 。

所以这件事情是应该是早于 ChatGPT 的 。

李如一22:59

是 。

重轻22:59

还有关于说这个文章评不评的问题啊 , 就是其实其实有很多很多例子 , 那个比如说你把维基百科和那个 Britannica 就是就是大英百科去比的话 , 就有人就讲过 , 然后你看一下真的是这样的 , 就是其实这个是说白了就是你你有没有自己的风格 ,有没有自己的 voice, 这个跟我刚才讲的说这个声音对于语言很重要 , 这点不能忽略 , 这个这个是完全是相

关的 ,因为恰恰因为就是中国的大部分的语言学外语学习者 ,他长期处在一个纯文本的一个状态 , 就是他他对于声音对于语音的 voice voice 是一个是一个身体性的东西嘛 。

所以我刚才讲说你你不能去身体化学语言 , 对这个东西完全忽略 , 所以他会觉得说语言的学习是一种抽取信息抽取意义的一个过程 。

那么一旦我抽取到了这个信息和意义 , 我的目的就达成了 。 我认为这个这样的一种认知和思考 , 它对国民的这个影响其实是非常根深蒂固的 ,因为语言不是这样的 。

我觉得还有一点要强调的就是我们得有一定的 humility 啊 , 就是因为我们三个都不是英语母语者 , 所以我们在讨论说 ChatGPT 的英语怎么样的时候 , 我们是是需要有一点谦卑的 ,因为就是比如说你我们没有在中学的时候被语文课要求我们读呃 《 河马史诗 》, 读英文版的 《 河马史诗 》,也没有读这个可能别人是这个初中就读这个 《 马克吐温 》 什么的 ,

我们可能是二三十岁之后自己去去读了 , 这都是有极大的影响的 。 我跟汉洋之前已经说应该是说过 , 我是不相信有所谓的能够把外语学到 native 水准这样这么一回事的 ,因为最简单的比如说加减乘除最基本的算术你是怎么用哪种语言学的呢 ?

你一般你不可能用两种语言学嘛 , 你在日本上学你就是用日文学的 , 你在美国上学你就是用英文学的 。 那么你到了 20 岁以后你去跟别人聊到这个问题的时候 , 你你你没有那套词汇来谈这个问题 , 你在日本学的 OK, 你就没有那套英文词汇来谈这个问题 , 哪怕你的英文是很好的 , 哪怕比如你爸你妈都是美国人, 然后你住在日本 , 从小在日本长大 ,但是你学算

术你就是用日文学的呀 。 诸如此类的细节实在太多了 , 就是我发现很多人在谈论语言的时候 ,他们的标准其实非常非常的低 , 就像我刚才说的 , 就是把抽取意义抽取信息当成唯一的事情 。

那在这个程度上, 这种程度的任务确实对于对话式 AI 我觉得是很适合的 ,但是语言比这个要要宽广的多 。

而且可能很多因为因为在谈论对话式 AI 的很很多人 ,他是科技圈的人, 坦白说哈 , 就是这当然不能说一棒子打死 ,但是有大量的人其实比如说并没有读过什么英语的文学 , 所以他其实不知道语言还可以是怎么样 。他可能读过的东西就限于像我们刚才提到像像汉洋一开始提到像 Ben Thompson, 像 Paul Graham 这些人, 这些人都写的很好 ,但是他只是就是这个英语写作

中的很小的一一小部分而已 。 你也没有见过这个呃美国的街头混子 ,他们平时怎么说话的是吧 ? 所以 。

词不达意25:51

李如一25:51

是啊 , 这感触是很深的 , 就是就是你刚说的这些我都都都感触很深 , 就是就恰恰是因为它这个里面的那个丰富性和和那个暧昧的东西 , 所以它是一个你你可以就是你一辈子一直在接近和感受的过程 ,不光是那个文化 , 还是它这个语言本身 , 它的文字本身 , 甚至在你说一个人和另外一个人在聊天对话的时候 , 所有的词不达意都是在达某种

意 , 就是你回忆你和一个人在聊天的时候 ,他他说错话了 , 或者你自己口误说了一个东西 , 那个错误是有一点信息在里面的 , 就是你然后你你在修正它的时候 , 或者你指指出我刚才有一个东西我说错了 , 然后你再回想我刚才说的那个错误 ,其实是因为我想要说一个什么东西 , 就是我把它给说错了 。

比如我们在谈论资产阶级革命的时候 , 然后我把比如法国的首首都给说成了我也不知道巴士底或者什么之类的 , 就是我没有说是巴黎 , 就是它的错误背后是有一个 intention 在后面的 , 然后这些东西其实构成了特别大的比例的信息 , 就是但是那个在 ChatGPT 里面 , 它的那个错误是没有规律的 , 就是它是它错误 ,因为它的那个机理跟咱们人说话的时

候是不一样的 , 所以它产生的那个错误是 , 比如它会把它引用的话杂揉在一起 , 或者是怎么样 , 就我不是说我没有现在在对一个语言模型去苛求它事实的正确性 , 我只是说它那个出错和那个脱轨的那个的方式和真人犯错误是完全不一样的 。

所以它是一个非常封闭和确定的一个东西 , 就是这两者的区别让我感到很就是就感到很神奇 , 就是尤尤其是当你连着用很长时间的那个 GPT 去生成文字 , 完了你你再去看真人写的东西的时候 , 你会发现那个真人写的那个东西可能不那么的 comprehensive, 它可能不是那么的全面而周密 ,但是它自己那个背后它自己都不愿意承认它有一些情绪在后面 , 比如它

觉得美国的这个政策的背后的问题 ,在它词不达意和说不太好的那个过程中带出来了 , 它就是最让它明就在这个事的这五个方面里面 , 最有一方面就是就让它最敏感 , 它明显是有侧重的 , 就这个信息是是就是语言模型不能去囊括的东西 。

重轻27:58

对 , 这个就让我想到我经常说 ,但是好像就是没有人理会的 , 就是我我我最近经常跟别人说的一个看法了 , 就是说重轻你刚才讲到说什么东西呃它这里面有错的 , 或者说人说话里有错的 ,但是重要的部分 , 或者说哪些东西是事实 , 哪些东西不是 。

那有时候我们会说 , 比如说 OK, 你现在让这个 ChatGPT 写首诗 , 然后呢我们会说啊这首诗写的不错 , 所有这些东西都是判断 , 对吧 ?

你写的是不是对 ,是不是美 , 对吧 ? 你说这首诗写的不错 ,其实是在进行这个美美学上的判断嘛 。 判断这件事呢 ,其实说白了就是说我们是在作为读者 , 就无论对话式 AI 也好 , 或者现在不是还有很多这种比如说可以帮你画画的 AI, 还有可以作曲的 AI, 这些都出来了嘛 。

所有这些 AI 你可以把它统称为作者 , 就是它们是在人类的要求下产出一些东西 ,而目前为止它们没有能够成为读者 。

目前为止所有的读者仍然是活人 ,是我们在谈论它画的这个东西好不好 ,是不是能满足我们这个游戏里某一个场景的需求 , 或者说 OK, 它可能有差强人意的地方 ,但是我觉得足够好 ,而且成本降了好多啊 , 等等等等 , 所有这些都是判断 , 就我们是读者 ,而 AI 是作者 。

我认为只有当 AI 能够成为读者 , 就它能够来判断的时候 , 才会有真正的 paradigm shift, 就是当它来说它可以跟你进行这样的对话 , 说为什么这首诗写的好 , 我觉得这首诗写的不好 , 或者说为什么这是错的 , 或者说我认为你刚才的这个口误其实透露了你内心的什么什么什么什么想法 , 或者比如说甚至比如说嗯 , 不同的 AI 系统之间可以互相的进行判

断 。 我觉得这个读者的身份是非常重要的 , 就是在在它能够成为读者之前 , 它所能够做到的是 , 就是我们刚才之前提到的 , 可以充分定义的简单的小的封装好的一个个的任务 。

它能够做到这些事情 , 这绝对不是在 diss 它 , 绝对不是在说它 , 它就是在鄙视它 ,而是能够做到这些 ,而且我们可以想象这样的应用场景会非常非常的多 , 这足够形成对于业界的一个很大的一个冲击 ,也的确真的会有人下岗 , 就像人们喜欢说的那样 。

但是呢 , 这个和这种末日式的这种这种恐慌之事是差的是非常远的 。 我认为一个关键点就是在于这个读者的身份能不能出现 。

如果它一直是作者的话 , 我觉得就是这个情况 , 它其实仍然是工业革命以来的人类的各种技术演进的延长线上的一个自然的结果 。

李如一30:24

对 , 就是 ChatGPT 最常说的那个标标准的话术 , 就是它不能给出 opinion, 它也没有 preference。

重轻30:31

我是一个大型语言训练集合 , 我相当讨厌这句话 , 这个 。

李如一30:35

他说那个就是请你意识到我不能 inherently understand anything, 就是他反复在跟你强调这个事 , 就是作为一种公共服务的那个的一个安全和那个撇清责任的一个的一步骤 , 就是一个读者和评论者是它最不适的东西 。

信息与偏见30:50

重轻30:50

嗯 , 就是说到这个 , 我昨天刚好遇到一个情况 , 就是我哎 , 我问了一圈没有人遇到我 , 就是我的我的那个 Mac 在连某一些 Wi-Fi 的时候呢 , 它经常会出现一个就用 DHCP 嘛 , 然后它会被它会被分配到一个叫叫 self-assigned IP address, 然后这个时候它的那个子网掩码会变成 255.255.0.0。

一般来说你正常连上用 DHCP 正常连上 Wi-Fi 的时候 , 它的子网掩码是 255.255.255.0 嘛 , 反正出现之前那个情况的时候呢 , 就是你就是上不了网的 。

然后我问了一圈没有人知道 , 然后我就去问 ChatGPT 嘛 , 然后它呢 , 它给出的答案其实就没有什么意义 ,因为它给出的是一个是个 last resort, 就是它叫你把那个我当时因为我是连到那个 iPhone 的那个 personal hotspot 上面 , 等于把 iPhone 的路由器 , 所以它要我把那个 iPhone 的网络重置一下 。

那那这种就是就对吧 , 一般的这种网管都会告诉你 。 但是呢 , 它最后有提出说它叫我把那个 DNS, 就是 Mac 上面 DNS 换成 Google DNS, 就是 8.8.8.8 和 8.8.4.4。

然后呢 , 它在说这个的时候啊 ,因为我们知道这种公共 DNS 有很多家嘛 ,Google 可能是最有名的一家 , 然后什么 Cloudflare 也有 , 然后有很多别的嘛 ,但它不提的 。

我就本来我会期待它会说哦 , 这个世界上有很多公共 DNS,不如你试一下 。 然后它说比如说像 Google 的这个 DNS, 它就直接说它按照那个 1234 列下来 , 说第一步做什么 , 第二步做什么 , 然后第三步就是请填入 Google 的 DNS。

这个当然就是可能很多人看了第一感受就会说你是不是拿了 Google 的钱 , 我不至于那么认为 ,但仍然它这个答案让我觉得有一点有点困惑 , 就为什么会这样 。

那么我就问它了 , 我说你为什么直接就给 Google 了 ,而你你甚至都不提还有其他的不同的 options。 它说哎呀 ,不好意思 , 就是不好意思让你困惑了 ,但它说那个我就是说了一些套话 , 就是我还是希望能够帮到你 。

那么呃的确有其他的选择 , 你也可以去试 , 然后 Google 你也可以去试 , 就最终就给这样的套话 。 这个就就是我我不知道该怎么理解这件事情 ,但是我我问了一些朋友 ,他们会觉得没有什么 ,他们会觉得可能因为就是 Google DNS 是用的人最多的 , 所以它自然就给 ,因为它的目的是在为了帮助我解决问题 。

但是就这一点以我个人而言哈 , 我也是不满意的 ,因为这个技术故障我问了很多人没有 , 好像没有人遇到过 , 所以我本来就期待说你可以告诉我原因的 , 我不是仅仅想解决这个问题 ,因为毕竟我我遇到它的情况不多嘛 , 我是更想知道为什么会出现这样的情况 。

但是呢 , 它只是说哦 , 出现这种情况可能有几种不同的可能 , 然后它不说什么 , 然后接下来就直接告诉你 , 你可以尝试以下步骤或许可以解决 。

这本身也代表了一种东西吧 , 就是它可能认为问这些问题的人你是期待解决问题 , 就它把自己作为一个服务的提供方 , 它认为自己做的很好 , 它认为向我解释原因过于复杂 , 它认为我是 client, 我是我是甲方 , 我不想知道那么多复杂的 。

但这个时候我刚好想知道那么多复杂的 , 我知道在这里我绝对是少数派 , 可能大部分人确实不想知道那么多复杂的 。

那么又回到了一个可能我们接下来可以讨论的问题 , 就是少数派的权利又被忽视了 。 就是很多时候在过去 , 这不是从 ChatGPT 开始的 , 就过去的过去 5 年到 10 年的各种和 AI 和深度学习相关的产品 , 都有人会涉及到这个类似身份政治的问题嘛 , 就是说 OK, 可能大部分的工程师是白人男性 , 那么非白人非男性他们的权益怎么受到保障 , 你会不会有 bias, 至

少在刚才这个问题里不涉及身份政治 ,但我觉得像我这样一个可能有时候不太重视解决方解决方案 ,而更重视想搞清楚它是怎么回事的人, 我的权益有被牺牲到 。

李如一34:28

对 , 就顺着这个我就想想说我最近对这事的一个一个感觉 ,因为 Lawrence 你你现在在日本嘛 , 你没有在国内的语境下, 就我我和重轻其实相当于活在中文汉语世界的这个聊 ChatGPT 这个语境下面更多一些 , 然后我就会发现有特别多的人在庆祝一个事情 ,不能说庆祝吧 , 就是他们在感叹说哦 ,有 ChatGPT 之后学习新东西变简单了 , 就是我可以直接问它得到很多回答 , 然

后它可以帮助我快速了解一个我不知道的事情 。 然后但这里面让我有一点很警惕的点 , 就是咱们刚才聊的这个东西 ,但我可以把它说的更明白一点 , 就是它给了你什么和它不给你什么本质上是一样重要的 , 甚至它不给你什么那个事可能更重要一些 。

而 ChatGPT 在这里面有个很大的哦 ,不不能说是问题吧 , 就可能说是你作为一个渴望了解知识或者了解信息的人应该警惕的点 , 就是它在给你东西的时候 , 它会省略非常非常多的信息 ,而很多时候那些被省略的信息才是重要的 。

我可以举个具体的例子 , 就是我最近在看那个之前推特上有一哥们说美国正在从它的主流媒体上从觉醒主义转向国家主义 , 然后我就在想这个觉醒主义我总看这个词 , 我不知道怎么理解它 , 我就去了解这个去了解这个事嘛 。

然后你问 ChatGPT 已经得到很多很好的回答 ,但这里面有一个很重要的问题 , 就是就是刚才重轻说的那个点 , 就是这些非常客观的知识没有办法有助于帮助你理解美国人作为一个普通人, 或者作为他们的舆论对这东西的整体看法是什么样 ,是因为它里面是没有意图的 , 它没有任何说我想支持这个或者我想反对这个 , 除非你引导它这么说 , 它当然会听你的

,但如果你不引导它 , 它给你的那个东西你能了解这东西的全部意思 ,但你依然还是无法理解具体到某件事上某些美国人他们为什么如此看待这个问题 ,因为那些隐藏在文章背后的语气 , 比如你看 《 纽约时报 》 写你是能读出来这个作者他大概是什么倾向的 , 那你看的足够多了 , 你自然会有一种感觉哦 , 原来这个东西对于美国的不同人

它是什么样的一个感觉 。 而这种所谓的信息或者知识的获取是不能单纯的靠你让它喂你信息去得到的 , 你必须自己去主动的去要求更多 。

重轻36:27

对啊 ,vocism 这个东西你就是任何稍微接触过一点的人都能有直观的感受 ,但是它就是它显然不是那个 ,因为这你你问的这个问题我也输入过 , 所以我也看到过它那回答给的特别准确 。

李如一36:39

对 。

重轻36:40

就是那个一种什么 collectivism and 什么什么 , 就是它有一些定义 , 大概有大概有四五个点 , 就是但就这就是一个典型的 , 就是如果你拿 ChatGPT 作为你的一个主要的学习来源 , 你想要学习或者是想要了解一个事情的时候 ,因为它没有任何的 preference, 就是它没有任何的 assumption, 就它不假设你 , 就比如说刚才 Lawrence 问的那个问题 , 就是那个就是一个 preference, 就是我更倾向于知道什么 , 或者

是就是我有一个隐隐特别特别基本的对待事物的看法 , 就是我倾向于力所能及的知道一下这个事是怎么回事 ,而不是说稀里糊涂就把这事给 master 过去 , 把这事给办了就完事了 。

就是但是那个语言模模型是没有任何这种东西的 , 它它也没有任何 bias, 然后所以它就是会给你把这个话给给顺出来 , 它其实就是在在说话 , 就是它甚至不是 thinking out loud, 它就是 out loud 本身 。

李如一37:27

对 , 就顺顺着这个说 , 就是我也顺着说 , 就是在在汉语的讨论下, 我我对有个事情很不满意 , 我照我自己从我个人角度说话 , 我不是特别喜欢的一点是我们总认为我们对所有知识的获取是只要获取到这个东西最客观最正确的那东西就可以了 , 我们忽略了刚才重轻说那个 preference 或者说偏好或者你的情感在这里面的重要程度 , 就这个事对于人

类的重要程度是被远远低估的 。

重轻37:50

就是对我来说就很很难受 , 就是当我想要了了解一个小的 topic 的时候 , 我就作为就是一种实验性质的 , 我就先以 ChatGPT 为主轴 , 先就是先把 ChatGPT 能给我东西我全看了 , 然后我再去用我传统的方式去 Google 里面看 , 就看文章和一些书和一些书评什么的 , 然后后者的那个那个效率之低下的那个就是对比那太明显了 。

就是说我咱俩在出租车上我不是跟你讲过吗 , 就是说传统的方式 , 当我想知道一个事的时候 , 我找到了一篇长文章 , 完了我看了半天 , 扛着解读看半天 , 那个人就是反正写的就是最后我用了两个小时, 然后发发现这个文章的那个关注点跟我关注的不太一样 ,但我没有办法在我的谷歌使用技巧或者是信息检索这个事上进一步的去区分这

个事 , 所以这两个小时我就浪费了 。 但是这两这这两个小时浪费的过程中, 我得到了那个人的问题意识 , 就是他让他感到紧迫和让他感到难受的那个 , 让他促使他写这个文章的那些东西 , 那个东西不一定是我在意的 ,但是我得到了那个 。

实际上就是你反过头来想 ,在你浪费的前半生里面 , 就这就是你得到的大部分东西都是这样来的 , 它就是一个 serendipity, 就是你赶上了 。

李如一38:59

对 。

重轻38:59

就是我们大部分的值得去 cherish 的知识和感受和 insight 都是你赶上了 , 就是那个人说的东西文不对题 ,但 ChatGPT 太对题了 , 就是你用 ChatGPT 试图去了解一个你没有基础认识的话题的时候 , 它那个效率会让你感到害怕 , 就它给你总结的太太 concise 了 , 就是太周密 , 太那个就你看了这个你就大概知道了 。

对 , 特别可怕 , 就是我只是说其中的差别 , 我没有在批判什么 , 就但是这个差别特别的巨大 。

李如一39:29

嗯 , 还有就是刚才讲说那个 AI 成为读者这一点啊 , 就是可以举个例子 , 就比如说翻案这件事情对于对话式 AI 重要吗 ?

因为知识是流动性的 , 知识它不是一成不变的嘛 。 就比如说我还是拿我比较熟的音乐领域来讲 , 像那个像大龙永一这个人 ,他是有是有在被翻案的 , 你知道吗 ?

而且这个翻案其实是一方面他的歌迷在帮他翻案 , 就另一方面呢 ,他的这个生前留下的那个唱片公司的人也在试图翻案 ,因为他有 1981 年, 他有商业上非常成功的作品 , 叫叫 Along Vacation, 然后所以唱片公司自然他有足够的动力去强推这张唱片 。他不只是说要强推让他卖的更多 ,而是要让他在日本的流行音乐史上能够有一个这个这个这个经典的地位 , 让以后人们能够

想起他 。 就就其实有点像有很多像 Beatles 他做那个这这去年吧 , 还是前年做那个 Get Back 那个纪录片 ,Peter Jackson 拍的 ,其实也有这方面的考虑 , 就是所以你可以看到一方面作者的后人在试图建立一种 narrative, 然后呢 ,但是我们歌迷呢 , 可能又在试图建立另外一种 narrative, 我们会认为他在呃这种在商业上我取得突破的专辑之前的那段时期 , 很穷的那段时期 ,他的作品其实甚

至比后来的更好 , 对吧 ? 这是一种说法 , 就没有说谁一定对 , 两方肯定都有对的部分 ,但是对于这种问题 AI 怎么处理呢 ?

就比如你现在去问大龙永一这个音乐家的这个 , 然后给你一个这个生涯的回顾的话 ,他一定会给出一个最稳最如白开水 ,而且我可以说是让他的这个后人, 就是现在代他管理他的公司的人最开心的一个版本 ,因为他肯定会照着官方的这种叙述去讲 。

那么这本身难道不是问题吗 ? 是吧 ? 因为很多时候一件作品 ,不管是音乐美术也好 , 它成为经典其实都是通过这种论述之间的角力 , 不同人之间的试图角力嘛 , 角力啊 , 这种角力来来来实现的 。

有有很多我们知道在当年是不受待见的 ,不叫好也不叫做的产品 , 后来成为了经典 。AI 怎么参与这样的过程呢 ?

我觉得能不能成为读者真的是一个关键 。 如果不能成为读者的话 , 就是它无非就是一个可以看一切 , 可以听一切 , 然后来进行总结这个总结中心思想的这么一个角色 , 就是它的支持者们可能不甘于用这样的寡淡的文字来描述它吧 。

还有我刚才提到说关于这个它有没有有没有偏见 ,有没有 bias,其实我想说的是 , 嗯 , 我们刚才讲了这么多呃 , 就是语言在这个承载意义 、 传递意义以外的功能 ,其实我想说的是这个偏见很多时候是重要的 ,是必要的 ,因为这些偏见其实它它承载了的一些微妙的难以言说的不可量化的意义 。

而而这个其实就是涉及一个更大范畴的关于就今天这个政治正确无处不在的世界的一个讨论了 , 就是就是世界的在往这个方向走 , 走到最后会是一个什么样的状态 ?

其实世界的这种位移对于 AI 是非常利好的 , 你们不觉得吗 ? 就是这样这样的一种所有人的权益要无条件的被尊重 , 这个和我是一个大型语言训练集合 , 我没有我自己的立场 , 这两者难道不是这个天然的是非常吻合的一个东西吗 ?

重轻42:39

就是刚才 Lawrence 说到那个偏见的的那个问题 , 就是我不是说偏见里面有有 facts,但是里面有一些 truth, 它它里边有一些知识 ,有一些 knowledge 在里面 , 就是人们没有办法特别清晰的把自己所谓的立场啊 , 我的偏见和我我说的事实的东西特别好的切割开 。

如果要能切割开的话 , 那这世界可太简单了 。 但是 ChatGPT 现在就是它就是必然 , 它作为一个产品 , 它必须要做一个切割 ,因为它不能 , 它就是它没有办法具备任何的的立场 , 所以它就必然是这样的呈现 , 它没有办法兼容那那些东西 。

它实际上它是它是怎么兼容所谓的 bias 和和 opinion 的 ? 就是你问它 , 你说你说这个事对这个事的批评 , 就是 what are the criticism on this subject, 然后它就会给你把批评这个东东西的那一堆列成 1234567, 然后支持它的这个的观点 , 然后又列出一堆 , 然后再加上一个它说就是对那个文艺作品的看法是不断动动态和变化的 , 怎么怎么样的 , 就是 。

李如一43:38

免责类似 。

重轻43:39

对对对 , 它它就是它只能把 opinion 给它重组为就这种事实性的叙述来叙述出来 ,但是它甚至也没有事实 。

李如一43:47

它很它很像一个律师在这个意义上, 或者说像一个公司里在 CEO 下面的那些 C 某 O。

重轻43:54

对对对 , 就是他们都要听 CEO 的话 ,但是他们是是说话是要保证滴水不漏这样的 。

李如一43:59

对 , 然后它就它更不可能有任何自己的看法 , 就是我甚至我好奇过这个事 , 这个其实可能有点幼稚啊 , 就是因为我老觉得你作为一个掌握了几十个 TB 的语料的模型 , 你总是能多多少少的发现一些东西吧 , 就是我我的意思是产生一点知一点额外的知识 ,因为因为不可能这个万事万物所有的相关性都被人类研究 ,并且在互互联网上用英文都谈及过

,不可能 , 你总会能发现一一点额外的知识 ,但是没有 , 它就只能去叙述它这个语料给它产生的这个已有的知识 。

重轻44:35

那这个应该是 feature, 我觉得这个应该是就是涉及它的人的这个有意为之吧 。

李如一44:40

不知道 , 就挺神奇的 ,而且恰恰是在在在它 quote 任何的那个其他人写的东西的时候 , 它没有办法给出原始的出出处 ,而且它一定要把它给魔改成 , 就是给它 rephrase 成它的语言 , 所以更额外的显示出它的高级 ,因为它特别特别像人, 感觉就仿佛它理解了这个事一样 ,但是这个系统里不可能有有任何实际的知识 ,因为它不是那么存储的 , 你问它 3+5, 它能说

等等于 8, 就首首先它有一定的概率会说等于 7 或者 9,因为就是这个里边就是 ChatGPT 做算术是错特别特别多 , 就完全完全是数越大越容易错 , 没法用出现的更少 。

重轻45:14

对对对 , 就是就我想说就 3+5, 它说等于 8, 它能说出来是因为说等于 8 很溜 , 就是比如说法国首都是巴黎 , 为什么是巴黎呢 ?

因为这样说的很溜 , 就是有一种很顺的那个 , 我只能这么去试图去理解它 , 就是它唯一拥有的就是那个 distribution of words, 就是用他们那个的人都那个说法 , 就是字词的分布 , 这就是它唯一所拥有的东西 , 然后它再拿这个去硬破或硬刚所有的这个需求和挑战 , 就是拿话往下顺 , 就是这样 。

李如一45:43

关于刚才说那个读写读者 , 就是呃读者和作者的关系 , 我想再补充一个 , 就是因为它是一个就是大型语言训练集合嘛 , 按它自己的定义 , 它是不停的在进行深度学习的 , 它不停在学 , 对吧 ?

然后它那个算法也在不停的演化 ,但是呢 , 它是一个不停的在等 , 这个学其实就是一个读的过程嘛 ,但是它是不会主动写的 , 就是你一定要给它一个提示 , 它才会写嘛 , 就是你得问它问题 , 或者你让它做一件事情 , 它才会去写 。

这个就像什么呢 ? 就像那种在中国被某一些人非常推崇的某一种人格 , 就是心里什么都明白 ,但是嘴上什么都不说的孩子 。

我想说的是 , 这种孩子真的是极权主义者的好朋友啊 , 这种孩子是最被极权欢迎的 , 就是他自己的所有的判断他全部悬置的 ,但他明白对这些人一定是聪明的 ,但是他不说 , 这个不说其实我这是真的是相当糟糕的一种特点 。

但是在中国 , 我知道这样的孩子是被不少人推崇的啊 , 聪明不惹事 , 知道说什么样的话对自己有利 ,而且只说那样的话 , 就是这这种对话式 AI 让我想到这个 , 当然他们这个动机可能完全不一样了 ,但是最终的结果我觉得其实是就是我当当我看到的这种 , 它作为一个我的对话的对象 , 给我的感受是非常类似的 。

哎 , 我觉得我们刚才其实谈论了很多 , 就是对这个产品的具体的使用时的感受啊 ,其实有另外的话题可以讨论 , 这也是最近老看到人谈的 。

OpenAI47:05

李如一47:12

第一就是说这个 OpenAI, 它在成立的时候 , 所以它名字里有 open 这个词嘛 ,而且它一直是讲说我这个东西是开源的 ,而且这个这东西它是像一个基金会一样在那运运作 ,而且这个东西最终代码是应该是有普世的价值 , 所以它会共享 ,但是现在它变得越来越不 open 了 , 就是因为现在已经慢慢的看到了商机了嘛 。

最近是哪一个 , 回头把链接放到 show notes 里 , 反正哪一个网站 , 反正有篇文章讲这个被挺多人转的 , 这是一点 。

还有一点就是说它背后的人就是是那个现在主导 Y Combinator 的那个人, 叫什么来着 ?

重轻47:49

哦 , 那 Sam,但他已经出来了 。 现在那个 Y Combinator 的那个主导的人是是谭家兴 , 另外一个人。

李如一47:55

啊 , 对 ,他是上一任 。他不是说为了微软要收购 , 所以把那个非营利给给转成一普通公司了吗 ?

重轻48:00

Sam Altman 是主导那个 OpenAI 嘛 , 对吧 ?

李如一48:03

对 。

重轻48:04

我我自己的感受就他是一个很糟糕的写作者 ,因为我看到他写的这个 , 就是因为尤其为什么 ,因为他的前任就是我我是讲 Y Combinator,他的前任 Paul Graham 刚好是一个很不错很优秀的写作者 , 所以他选了 Sam Altman 作为接班人之后, 我发现这一点就是这个差别是非常明显 ,而且非常我觉得非常惊惊人的 。

这个写作的差我要我要说明一下是什么意思啊 。他的这个差跟 Twitter 作为一家公司 ,Twitter 这家公司的所有的面向这个用户 , 还有开发者 , 还有面向公众的所有这些文案的这个差是同一种差 , 就是他很啰嗦 ,他没有办法简明清晰的去 communicate 自己的意思 。他写的文本就是你会觉得是一个 , 就如果是语文老师要改作文的话 ,是会可能是打不及格的一种文本 。

我想很少人会觉得这个会是一个多么严重的问题 ,但我觉得这是一个问题 , 就是他我看不出他对于 OpenAI 的未来究竟是怎么想的 , 就除了一些就日文叫大言壮语 , 我觉得这个词挺适合引入中文的 。

李如一49:07

嗯 。

重轻49:07

就是一些大话 、 空话 、 套话以外, 嗯 ,由于就是他的文字给人感觉这个人在想这件事情的时候很混乱 , 要么没想好 , 要么就是说他认为想好了 ,但是在在我看来我觉得很混乱 。

所以这点也是让我对 OpenAI 会有一点点不太看好的一个一个因素吧 。 当然可能不是根本性的因素 ,但我不认为这是一个可以忽略的一个因素 。

就是我不知道二位对此有什么看法 , 就是关于首先可能是关于他已经不再 open 这一点 。

李如一49:39

我等我我先理解一下, 就我理解中你的不太看好 ,其实并不是说认为他商业上无法成功 ,而是指的就是不太看好这个事情对于我们人类或者对于我们社会的一个一个一个价值 。

我这么理解是对的吗 ?

重轻49:52

啊 , 这个当然了啊 ,因为有无数很糟糕的东西在商业上都获得了巨大的成功 , 所以肯定是肯定不是说他在商业上无法成功 , 这属于日常了 , 就是属于习惯了 。

事实上现在为 OpenAI 激动的人 ,他也不是从商业角度在激动 ,但但有的人是了 ,但是更多人是觉得说 , 比如说有的人说啊 , 我们终于可以以后我们可以做这个叫什么硅基生物了 , 就是这种层面的激动 。

这我一开始讲其实可能或许不应该提这个 ,因为这个纯粹在纯粹是噪音 。在我们今天谈论 AI 的时候 , 谈论这些东西纯粹是噪音 ,但我只是说有很多人 ,而且这些人多少都是掌握了一定资源的人 ,他们有这种层面的激动 。

但是这种层面的激动就是我我觉得就我们以呃比较宽容的态度看 , 就假设我们说 OK, 我也希望有这种层面的激动 , 那我会希望是另一个人在掌管 OpenAI,而不是 Sam Altman。

我想说的大概是这个意思 。

李如一50:43

对 , 就顺着这个我觉得我还有有些想说的 , 就是第一点就是它 open 这个事情 , 我我觉得就这甚至是一个你感觉它一定会发生的事 , 就是从它诞生的时候开始 , 我就从来没有相信过这东西它能真正的 open。

不是可能是我的 , 我在这方面比较悲观 ,但是就是说的开放 , 尤其我做了这么多年开源 , 说的开放到最后变成偏封闭或者说不拉不拉怎么样 , 就这是个很常见的事情 ,因为实际的公司掌管者 , 就他们会面临比他们想的多的压力 ,而这些压力是他们在创建公司时候绝对没想过的 。

我就不举例子了 ,有很多很优秀的开源公司到最后很多人会骂他们背叛了开源社区 。他背不背叛是一个事 ,但是我敢赌的是这些公司创始人一定在刚最开始立下这些豪言壮语的时候 , 没有想到自己日后会面临的很多自己从来没想过的压力 。

这点是我对这个事我自己的亲身感觉 。 但另外一方面就咱们就说到这个好这个事 , 就是对于社会好这个事 , 就是包括对它欢呼或者说喜欢 , 认为这个技术是代表人类未来这个事情 , 就它让我感觉到一点这个东西我我也我也总总说可能我有点偏见 , 就是我觉得它突出了很多 , 尤其现在聊这事的科技行业的从业者特别多嘛 , 就是它突出

了很多我们这个圈子的人, 尤其是创业圈 ,不光是科科技圈的人, 对于人文知识的欠缺 , 就是他们不太知道什么是好东西 。

就这个不是说 Sam Altman 这个人, 我就是说广义上的这个群体有一个特别大的问题 , 就是就是不读书 , 就这个不读书不是说他读书少 , 这些人很多人会标搒自己一年读 500 本书或者多多快读一本书 ,而是单纯的就是他们不会对人类的创造和人类的好东西有一个非常更直观的理解 ,因为他们对于人类很多很细微的事情是是无视的 ,因为他们的人生

中他们打交道那些东西都是特别大的一些事 , 比如创业 、 技术 , 然后推动人类前进 ,而那种美好的东西对于他们的生活来说是不必须的 。

所以我跟这类群体我因为我自己就是其中的人, 我们那个高尚知识可达也经常这么批评我 , 我的一大感觉就是我们很多时候就是没文化 , 读书少 , 这个是最标准意义上的这个词的用法 , 就是我们对于很多事情的了解比我们想的少 ,而我们特别愿意说评论这些事 , 就导致我们在看这些评论的时候感觉很荒谬 , 就是我们对 ChatGPT 的歌颂和对很

多事情的看法恰恰说明了我们对很多东西是不了解的 , 所以我们才在如此激动 。

重轻52:57

我对这个事的看法还跟其他公司是还略有不同 , 就是 Lawrence 刚刚才的这个视角是我对绝大多数的互联网公司的上来的 , 就是我第一个要这么看 , 我要先看他的那个 founder 和那个 founding investor 的那个的观念和他们的就是对对事物的看法 , 对这个公司的那个就是发展和他的产品的的设计的影响 。

但是这次还真有点例外, 就这次反正至至少我看到的很有很有限的资料都指向一个很奇怪的另外一个状态 , 就是他们这个模型 ,他们对于这个模型的干涉程度是很有限的 , 就是他我没有感觉到他们这些 founder 和他们的投资人能够把自己的意志非常 arbitrary 的用来去影响和干涉他这个模模这模型的那个 output 的呈现 。

就他当然有了 ,但是就是我在他们所有的那些发布会和那些那个访谈什么的 , 别人问你这个 ChatGPT 的设计什么这那个的时候 ,他们谈的全都是一些特别周而遍明 , 就挺可笑 ,他就会说我们就是做了一个特别极简的 , 就比那个 Discord 还要简单特别多的一个对话界面什么之类的 , 就是好像那个模型本身就是一个资本密集型的一个事 , 就是我开了一大金矿 ,

然后用了 100 个亿的机器 , 只不过在这个事上不是矿车是那个显卡 , 然后去去去挖出我挖出这么一个怪兽 , 然后我然后我自己做了一点点就是 instruct AI, 就让让它去克服一些 bias 和和一些那个不好的言论什么之类的 , 然后就上线了 。

就是他们对他们自己产品的控制是跟之前的所有的那个互联网产品相比就是前所未有的低的 ,而这个低的程度是他们反倒还挺骄傲的 。

这是我看到的 , 就让就让我觉得挺不可思议的一点 , 就是他们非常喜欢去取笑 20 年前曾经占上风的那个 , 就是咱刚才讨论过的那个就符号派 ,因为他们是这个所谓的 connectionist, 就是这个连接派 , 就是符号派背后的那个的理念 , 就是说我们要用就是借助逻辑学和哲学和这这些人类的思想把它给就是把事物的就是概念作为一个一个的单元 , 然

力大砖飞54:32

重轻54:57

后去一层一层的像像人类的理性一样去建构起一个智能 , 然后他们就是说你们这个想太多了 , 就是你就是最就 194 几年的模型就是好用的 , 你就用 194 几年的的那个神经元的构造 , 然后你就怼进去无数多的电 , 无数多的显卡和前所未有的数据量 , 它就能出来一个好用的东西 。

所以你们都想多了 , 就是他们那个首席科学家叫那个 Ilya 什么那个那个姓我不会念 , 那个 Ilya 他就是在推特上发那种就现在底下全都是那种信徒 ,他说一些特别抽象的话 , 底底就是底下的人就在跪拜说哎呦说太有道理了 , 就他最近说了一条话 , 就是说他说这个互联网产品就是有的时候大伙太注重 innovation 了 ,他说我们做的事其实就是 minimal innovation 和

max impact, 就其实是一个特别空洞的话 ,但是你能感受到他那种得意 , 就是说你们对于产品的设计和什么那个构造和这些想法想太多了 ,其实真正重要的事就是怼特别多的资源 , 然后力大砖飞 , 就是 ChatGPT 就给我一种力大砖飞的鲁莽和沉重 , 就这么一个感觉 。

李如一55:59

我作为我替重情解释一下, 力大砖飞就是力气足够大 , 板砖飞上天的缩写 。

重轻56:03

对对对 , 嗯 , 这个其实如果你说这个 minimum innovation 和 maximum impact, 那我想问去刺杀一个国家的元首算不算这种事情呢 ?

没有创新 ,但是有最大的 impact。 所以这种话其实跟当时 Facebook 说的那个那个 move fast and break things, 我就是我是很反感这种口号的 。

然后刚才重情提到的说 OK, 我按照神经元的模型去做 , 然后我喂给它足够多的数据哈 , 那确实因为我们知道人脑 , 虽然现在对人脑的这个机理没有完全理解 ,但至少是神经元的连接这一点是我们是是都是已经这是有共识的嘛 , 大家都知道的 , 那你照这个去做就没有什么 。

但是我觉得问题是出在你说给它喂食足够多的数据这一点啊 , 这其实是一个你在跟时间作战啊 , 人类它喂食这些数据是经过了几千年时间 , 对吧 ?

不止几千啊 , 我我是说有这种可以书写的历史 , 那你要再往回做 , 你那些之前的历史是不是都要算上的 ?

你现在你说 OK, 我用 10 年的时间 , 我把之前的所有这些东西 , 这些数据喂食给它 , 这显然会我认为啊 , 就是如果你按照同样的跟人脑类似的构造去设计这样一个系统 , 然后你喂喂食这样的数据 , 当你缺少了这个如此长的时间维度之后, 这显然这个结果不可能是一样的 。

而且我不相信他们不知道这一点 , 我不相信就我说的这段话对他们来说是什么新知 ,他们一定是知道的 。

所以他们仍然选择这么说 , 这个纯粹是一个营销上的考虑吧 , 或者这样说会比较容易理解 ,因为现在是数据时代 , 大家知道数据值钱 , 大家知道贩卖倒卖数据的公司都很值钱啊 , 那些人的工资也很高 , 所以大家会觉得说哦 , 数据值钱 , 然后你喂这么多数据哦 , 很有道理 , 所以我会相信你 。

这个其实是没有在思考了 , 我觉得如果你对这样的说法照单全收 ,是没有在思考 。

李如一57:48

对 ,而且这对于他们来说也是一个最优的防御策略 , 就是你老在质问我在做这个这个产品 , 然后你在质问我承担社会责任和没有做正确的事或者什么的 , 然后我对我来说最优的就是就是最自我保护的最好的位置 , 就是我站在一个不败之地 , 就是说我这个产品它就只能是这样 , 你们说的那些主动去设计和干涉的东西都不好使 , 你们不

都试过了吗 ? 各种各样的模型什么的 , 我们这个就是拿资源去生怼出来的 , 所以就不用我负责 , 就相当于没有人负任何责任 , 没有人承担任何的到时候说这个东西出了问题或者怎么样 ,他他就是 that's like the only way that works, 然后我们只是只是我们融了足够多的钱 , 我们我们把这事给做了 , 对他来说也是一个很很舒服的撇清责任的一个位置 ,他就是这

样 。 然后你作为一个评论者更没有立场去指摘和跟我去 argue 怎么做是对的和怎么做是 decent, 就因为他根本就谈不上这些东西 , 这就是那个这个连接派的一个特别有的时候我想说就是挺混账 ,但我又觉得就是挺奇特的一个的一个位置 , 这个位置原来我没有意识到科技界里还有这种位置 。

就假设咱们顺着这个逻辑说 , 你力大砖飞 , 你件数多大 , 板砖能飞上天 , 你有足够多的语料库 , 这个事就能变得更好 。

知识缺口58:57

李如一59:04

但我们经常忽略一个事情 , 就是人类大部分有相当多的知识是完全没有在互联网上的 , 这个事情其实是我最近这段特别特别深的感触 , 就是我猛然的发现 , 大部分人从来没有意识到互联网是多么的贫瘠在很多方面 。

就我去年写过一个文章 , 我也是晚点聊去年年底那个两个半故事讲的 , 就是我找一篇日本论文 ,是日本战后最重要的十篇论文之一 , 然后我花了半年才读到这篇论文的一个故事 。

但除此之外有很多类似的点 , 比如今天我们想知道故宫有什么文物在展出 , 你有任何方法通过网上获得这个信息吗 ?

你没有 ,因为我试过 。 然后或者说你想知道比尔 · 盖茨是看待某一个具体事情的最新的一个事情 , 你没有办法通过网上知道信息 , 你还得听他去自己去讲 。

就是有一类客观知识 , 还有包括比如像我们前一段做聊茶的调的调查 , 包括美国的很多很多这个文物 , 它的很多客观信息也没有被放到互联网上, 这个比我们想的量要大的多的多 。

所以当我们在感叹一个全知全能的大模型的通用的大模型出来的时候 , 我觉得我们自己一定要意识到一点 , 就是这个大模型它所包含的语料不管多么多 ,不管我们认为它多么的天文数字 , 它依然还有更天文数字的东西是从来就没有被放到网上, 甚至从来没有数字化的东西在线下世界依然存在的 。

但我最近比较难受的发现 , 很多人没有想到这一点 ,他们仿佛认为人类的所有信息已经全部都在网上了 ,而新东西也只会在网上出现 , 所以线下已经没有什么我们不知道的事了 。

这点我觉得还是挺挺需要我们自己注意的 。

重轻1:00:28

比这个更恐怖的是有一派人会觉得说 , 如果它没有出现在网上, 如果搜索引擎给不到你 , 说明这个信息是不重要的 。

李如一1:00:36

对对对对 , 这更恐怖 。

重轻1:00:37

这样有这种认知的人不在少数 。

李如一1:00:40

对 , 我甚至很难说以前我不是这样的人, 我也是这几年逐渐反应过来以前自己挺傻逼的 , 就是我不是一个不现实的人, 我不是不接受有 sacrifice 和这个就是 trade off,因为凡事都是妥协跟权衡 ,但是就是你扔下车的东西太多了 , 知道吧 ?

重轻1:00:54

对 , 甚至你没有意识到你自己扔下车这么多东西 。

李如一1:00:56

对 , 就是它整个这是一个特别特别成王败寇的东西 , 就 ChatGPT 是一个特别成王败寇的产品 , 就是一个非常狠的东西 , 就是劲儿最大 。

重轻1:01:05

而且刚才汉洋说的那个现象呢 , 可能有的人听了会觉得是某些特别冷门 , 就是藏在深闺里的知识 ,其实不一定 。

我最近刚好有有一个例子 , 就是有朋友写关于古代艺术的文章 , 然后他找到我 , 让我在日本这边的图书馆帮他复印文章嘛 , 那些是这可能是 20 世纪初日本人去中国考察某种东西 , 然后写出来的文章 , 确实网上没有 。

然后呢 , 呃 , 日本有些这个学校的图书馆里有 ,但有些甚至就是说你没有办法直接从学校图书馆下载 , 你得去写一封邮件去某个图书馆请求复印 , 然后他帮你复印了再直接寄给你 , 这个寄不是 email 寄给你啊 ,是寄到你的邮筒里 , 实体的打印出来寄到邮筒里 , 然后我再把它给我国内的朋友 , 那这是一种情况 。OK, 那你会觉得说 OK, 这是很小众的

情况 , 那么这是很专门的话题 , 那么会对这个话题感兴趣的人 ,他可能是在本身就在学术圈 ,他可以获得到这些东西 , 这不不成问题 。OK, 我假设我认同你说的这个 , 我想到另外一个例子 , 就是 20 世纪的古典音乐的非常有名的评论家 , 这个是在乐评人这三个字的光环远比今天大多 , 今天就乐评人你听这啊 , 还有这种职业吗 ?

有人能靠这个过活吗 ? 对吧 ? 但是以前不是这样的 , 就是 20 世纪中期肯定不是这样的 。 这个人 Harold Schoenberg, 这就是相当有名的古典音乐评论家 ,他写过很多 , 写过这个伟大指挥家 , 伟大钢琴家 , 写过很多这样的书 , 然后呢 ,他就他的书啊 , 今天是能见度是非常低的 。

我是前两年就是买 , 就是在美国的亚马逊两三美元只要买了他写的那个 Horowitz 的传记嘛 ,Horowitz 就是 20 世纪就是最有名 ,也是被很多人认为是最伟大的钢琴家之一 ,他的传记 , 然后又是这么有名的 , 这个这么重要的乐评人写的 , 虽然在亚马逊上很便宜就可以买到 ,但它没有电子版 , 然后也没有被再版 ,也就是说很多人你是没有办法知道有这样一本书存在的 , 甚

至就是说 Harold Schoenberg 是谁 , 就是我我为什么要知道它存在 , 就亚马逊上没有 , 然后你平时你看的各种意见领袖可能也不会提到这个人了 ,但是你真的去读这本书 , 你会发现那个写作水平跟现在的乐评就就啊 , 就为什么那个时候乐评可以成为一个行当 , 当然这个不是这么简单了 ,但就是说确实是写得很好 , 你会觉得这样的书居然在今天没有能够浮

出水面 , 这不是冷门的话题吧 ? 我觉得今天的中产阶级都一掷千金 , 让自己的孩子学各种古典古典艺术 , 油画 、 国画 、 呃 , 西洋古典音乐 , 这很常见吧 ?

那我说我认为你应该去读这本 Harold Schoenberg 写的 Horowitz 的传记 , 我觉得这个不是什么跟刚才说的什么古古代艺术 , 这这还是不太一样的 。

所以就是说有很多啊 , 日本有一个好处 , 就是你经常能够在书店里见到新的呃 , 翻译过来的 , 就翻译成日文的书 , 然后你去查它的原书啊 , 往往是很早以前写的 , 就比如说 70 年代有人写的关于当时的 soul 和 funk music 的一本书 , 这些书你在今天 , 比如你在美国是不太容易见到的 , 你除了去二手书店里去去翻 ,因为没有人会去推它 , 亚马逊上你

也不太容易 , 一时不太容易找到 ,也没有电子版 , 没有 Kindle 版 ,因为可能原来出版社已经倒闭了 , 对吧 ? 然后或者没倒闭的话 , 它觉得这个书你现在出了也没有人, 没有人有兴趣 , 就是你会发现像像这样的 , 哪怕是几十年前写的书 ,在今天被人遗忘了 。

那么这些书为什么被人遗忘 ,以及为什么它不应该被遗忘 , 这种问题都不是现在的对话式 AI 可以回答的 , 就是这个 , 这个是需要活人来回答的一个地方 。

而且就无论是唱片还是书籍 , 都有这种做再版的人嘛 , 尤其是唱片业 , 近年有很多有那种专门做再版的厂牌 , 就他把 70 年代的 《 沧海一珠 》 拿出来重新发啊 , 就是这样 。

那你你你这其实是一个累活苦活 , 你得去那种简价唱片的那种那个区域里找很多你根本没听说过的名字 , 然后你一张张去试听 , 然后你来判断啊 , 它的艺术价值怎么样 ,以及它出来之后它的这个市场价值怎么样 , 对吧 ?

这个这不是一个简单的活 。 对 , 一般来说我们会觉得像这种脏活累活 , 好像是应该是由机器来做 , 我也是同意的 , 比如说像清洁高楼大厦的那个外立面 , 对吧 ?

你如果是纯粹靠机器来做 , 我觉得没有什么理由反对啊 , 对吧 ? 人人去做很危险嘛 。 那像这样的脏活累活还不是机器能够做的 , 所以我觉得这这整个问题 , 我我觉得对于 ChatGPT 也好 , 或者对话式 AI 也好 , 或者说 AI in general 也好 , 只要我们把期待调低 , 它就是一个很好的东西 。

就像我一开始在节目一开始读的徐乐乐的话 , 还有汉洋你自己说的 ,他帮你们找 bug 什么这这这种应用 , 还有很多当然肯定是我不知道的 ,但是有很多人已经在用的这种 , 我我相信一定是有的 , 这这是非常好的事情 。

但是只不过现在就是关于 AI 的论述里面 , 这个噪音太多 , 浑水太多 , 就是就是有时候会觉得很难讨论 。

重要工作1:05:53

李如一1:05:53

对 , 顺着这个说 , 我还意识到就是我们聊的时候 , 包括在现在的这个所谓的噪音中, 有有有一种观点是我觉得我想聊一聊的 , 就是我们会说 ChatGPT 可以把我们解放出来 , 让我们做那些真正重要的工作 , 就比如说这些不重要的工作交给机器去做 , 然后人去做那种真正重要的 、 有创造性的 ,是人才能做的工作 。

这个其实你怎样是一种有点危险的论述 , 首先一这个东西的历史非常非常长了 , 你你从人类从进入农业社会开始 , 就是我不用打猎了 , 我可以有剩余的生产力干点别的事了 , 可以制陶 , 可以可以做青铜器了 ,但你得到的是什么 ?

你你得到的是那个所谓真正重要的工作吗 ? 一直到现在 , 或者是你说工业革命之后, 人类不用就是耕地 ,有更方便的事情了 , 人可以做真正重要的工作了 , 人得到了吗 ?

包括有了电脑之后, 我们说人可以做真正重要的工作 ,不重要的工作交给电脑去做 , 得到了吗 ? 那这一次我们又说了一样的话 , 就是让人去做真正重要的工作 , 就是没有真正重要的工作 , 这个事的存在在很多程度上, 我们所谓的说让什么人做什么工作 , 本本质上是一种对人的三六九等的一种非常有点达尔文主义 , 甚至是有点法西斯的分类 , 就是说我们认为有些工作是

是是我们所谓的上等人, 我们这种有创意的人不应该做的 , 应该交给现在是交给别人去做 , 然后但我们因为我们认为所有人都不应该做这个工作 , 我们要交给机器去做 , 就这个其实本质上是对很多东西的一种分类 ,而这种分类里面有一种隐含的傲慢 , 甚至有一些的危险性在在这个事上 。

重轻1:07:13

对 , 我甚至还想不到 , 就是这个问题出的是在比较微观的层面 , 就是对于我来说 , 就是我比较让我感到 , 就是我就觉得这会未来会变成什么样 , 让我感到非常的好奇和警惕 。

就刚才那个徐乐乐的那个推特里面写的这个 , 就是说对于一个工程师来说 ,他可以做更宏观的工作 , 就是更高阶的方式去把握他的工作 , 然后把这些脏活累活去交给这个就是语言的模型来来做 , 这我觉得在就在代码的世界里 , 我感觉是其实还挺 make sense 的 , 就是因为它节约了你很多很痛苦的调 bug 的的时间 , 或者怎么样 。

但是代码的世界 , 但我不是程程序员 , 所以我我没有办法很负责任的说这个 , 这是我说的是我的感觉和想象啊 , 就是代码的世界就是我们要达到 , 我们要做的事情 , 就是具体这个过程中间 messy 一点 , 或者是就不那么的雅观 , 或者怎么样也好 , 反正就是我只要我能做到就可以 。

事实上我也知道有很多评论者和这个创作者 , 比如像那个 Johnson Blow 这样的人 ,他们就是对于这种你这个代码本身不简洁 、 不优雅 , 你自己不会写自己的引擎和渲染器 , 本身他就觉得这是非常非常糟糕的 , 然后现在这个世界就是显然是冲着他认为的更糟糕的那个世界去了 。

但是就是工程跟文字工工作和和人的思想思考的工作还就是还是很不一样的 , 就是你刚才说的这种说法是是最常见 , 就是说 ChatGPT 这样的东西帮助我们淘汰了很多枯燥重复的劳动 , 剩下的那部分才是真正的工作 , 这个说法我觉得非常非常有问题 。

首先就是他们的 founder 自己在接受采访的时候 , 人家自己就是这么说的 ,他说就是大家都以为 AI 可以淘汰枯燥重复的劳动 ,但事实上 AI 一次又一次的淘汰的是有创造性的工作 ,是有一定创造性的工作 , 就不是特别创造性 ,但是有一定的创造性 ,不管是生生成式的艺术啊 , 还是这种语言的模型 , 这是第一 , 就是人家自己都不这么看 , 这是这是第一 。

第二呢 , 就是说你在把你的工作里切开成就是有一半是枯燥无聊的 , 就这我觉得太意想情愿了 , 就说这部分你 ChatGPT 帮我给做了 , 然后我把那好的那部分给做了 , 就事实上就是你实际你仔细审视一下你做的文字的工作 , 根本它根本就不是 , 就不是这么回事 , 就不敢想 。

就比如说我要写一篇文章 , 或者我想要做一期播客讲一个事情 , 然后我让 ChatGPT 替我写了 , 然后我去调它 , 就跟其实挺像程序员在调参数的的那过程 , 这个过程你 train 的掉的东西比你以为的要多多了 。

就如果你实际去试一下, 你让它写一个清汤寡水的一个特别 generic 的东西出来 , 然后你再去调它 , 这个就让我想到就是因为整个 ChatGPT 对于我来说就是一个 auto spell, 就是一个超级无敌强大的自动补全 ,autocomplete, 就那种你你写半句话 , 它把后半句给你补上 。

但是你让我把我的工作方式 , 把我的吸收知识和内化和再输出的这个过程转变成以它为主的 workflow 的话 , 我我仿佛是在给一个自动补全的工具做补全 , 我在把我的一点点的人的味儿像洒芝麻一样洒到一个那个就是 ChatGPT 生成的特别 concise, 特别 logical 的一个东西上面 , 这是一个非常非常就是非常奇怪的一个过程 ,而且我觉得这是一个非常非常不体面 ,而且非常不正常的一个事

李如一1:10:19

呃 , 据我所知 , 翻译这个行业在几年前已经有人就是说先机翻一遍 , 然后再改 , 好像是有这样的实践的 , 就是指一整本书啊 。

重轻1:10:28

对 , 甚至不是好像是有 , 现在就是这样 ,因为我们平时找翻译 , 我发现他们都是这么做的 。

李如一1:10:33

对 ,不是 , 就是我对网上另说 , 网上我知道有一些新闻站 , 或者说它不是一个站 ,而是一个号 , 那么它其实它它的 , 比如从 Bloomberg 或者无论哪里拿过来的文章 , 它其实就是一看就是机翻的嘛 , 这其实挺说明问题的 , 就是说对于它的读者来说 , 真的就像我刚才说的 , 它只是从中抽取意义 , 我知道发生了什么 , 那就够了 。

那这个时候就是他们可能原本他们也不是说特别在意文字的韵味 , 或者说感觉气质这些东西 , 然后我是觉得如果说你一整本书用这种方式去作业 , 就做翻译的时候啊 , 那前提就是这么做真的能够节省时间 , 我们我们假设你是有追求的 , 你对于最终的这个译稿 , 你你你是你还是认为你是你在译 ,而不是机器在译 , 那我是挺难想

象这样会更快 。 这个这这个这个当然也涉及可能每个人的思考方式 、 工作方式了 , 我觉得还是我自己从头译会更快 , 就是这样 。

而且这又涉及一个问题 , 就是刚才说的语料的问题 , 就是尤其是中文 ,有这个两岸三地这么一个事情存在 , 呃 , 加上汉字文化圈嘛 ,有这么一个概念嘛 , 那对吧 , 你翻译本身就是涉及到从不同的词汇和语言使用习惯在不同的文化场域里的游走 , 那就是你你说机翻一遍 , 我用的是台湾的中文呢 , 还是香港的中文呢 , 还是大陆的中文呢 ?

啊 , 那比如说其实现在我我就一直讲嘛 , 就是哪怕到了 21 世纪 , 还是有很多日文的说法和单词不断的进入中文 , 那这一部分 AI 怎么想呢 ?

就是 。

重轻1:12:05

对 , 我这个可以给 Laurence 补充一个特别具体的例子 , 就是我们在其他节目里总推荐有本书叫 《 东北游记 》, 英文是 Inventory, 那本书的简体中文版翻译跟繁体中文版的翻译的对比 , 恰恰就是我不繁体中文版 , 我不认为它是机翻的 ,但它很像机翻翻译出来的东西 ,是因为那个翻译者完全没有试图理解这个作者写的语境和它的那个上下文关系是什么 ,

比如它里面有那个 《 小燕子窗花衣 》, 原文是英文写的 , 简体中文版的译者就知道那个句话是 《 小燕子窗花衣 》, 这是一个约定俗成 , 我们这么说的话 ,但是繁体中文版的译者他小时候没听过那句话 , 所以他就把那句话直译出来了 。

但你想 , 你作为一个中文的读者 , 尤其你作为一个中国大陆的读者 , 你在读 《 小燕子窗花衣 》 这句话 , 它没有直接给你翻译过来 ,而是用了直译的时候 , 你你的那个感觉 , 恰恰其实就是今天我们对于很多就是这种翻译的这种感觉 , 就是它丢失了很多原本应该存在的丰富的信息 ,但是因为某种原因 , 或者因为就泰德江那个比喻嘛 , 就是 。

李如一1:13:00

但是但这个例子我觉得这个错误过于低级了 ,因为这个其实就是最基本的一个所谓还原原文的一个问题嘛 , 这个是一个任何一个配称作翻译的人都必须知道的 , 所以这就涉及到刚才那个仲卿提到调参嘛 , 这个工程界应该常很常用的词 , 就是其实是这样 , 就是说你你 OK, 我先机翻再用手改 , 可以 , 你可以把它理解为一个调参的过程 ,但问题就是说你

做这种调参工作 , 你拿到的收入是远远低于在技术公司做那种调参工作的人, 那这个最终反映的是市场选择了什么 , 就是说市场对于语言的微妙性是认为价值是很低的 ,而对于吐出来的像这种清汤寡水的那种文字 , 一个大型语言训练集合 , 貌似中立的吐出来那种文字 , 我们认为就是这个市场认为它值得我们花这么多钱去不断的给它

调参 , 这个本身也是一个让人觉得很不对劲的事吧 。

重轻1:13:52

对啊 ,但是就是它感觉特别 magical, 那你怎么办 ? 就是它这事就是就是这样的 , 我不知道人对于像自己的东西太着迷了 , 就是我们就是没 , 就我不知道 ChatGPT 是一个有史以来最有魅力的电子宠物 , 就是它是没有任何的人设和性格 ,但是它就是它就像人一样 , 所以你就是没办法抵抗这种诱惑啊 ,而且在工作里面效率 。

李如一1:14:14

这一点我觉得现在可能为时尚早吧 ,因为现在毕竟才不到半年时间嘛 , 所以我们不知道现在的这种这种性质 , 就是人类集体对于它性质能够持续到什么时候 ,因为因为有一些人, 包括像投资界的一些人, 可能是刚刚开始强烈的关注这个领域啊 。

创造与苦活1:14:31

李如一1:14:31

我还想补充一下刚才关于这个 , 就是让机器去做有这个杂活累活 , 然后我们来做这种有创造性的活 , 就刚才我觉得二位说的我都很同意 ,其实最基本的一点就是说这种话的人其实没有做过什么创造性的事情 ,因为就是如果你做过的话 , 你都知道创造性的事情本身里面就包含了杂活和累活 。

重轻1:14:50

对啊 。

李如一1:14:50

这个我我想我在别的地方也有讲过 。

重轻1:14:52

对 , 我刚才想说这个杂活累活其实是很难 。

李如一1:14:54

就你怎么能把它切开呢 ? 这不可思议 , 简直 。

重轻1:14:57

对对 , 你很难切割开 , 确实是这样 。 而且就是怎么说呢 , 像我刚才说给批量改文件名 , 没有人会享受做这样的事情 ,但是你无论你是画画 、 作曲还是什么 ,其实里面都涉及这样的 。

你老实说 , 如果你是一个乐思全有的作曲家 , 写五线谱本身就是一件杂活累活 , 就是你会觉得很烦 ,但是你说把这件事情交给机器做是不是一定好 ?

我觉得这个确实要看具体的例子了 ,但只不过呃 , 一言以蔽之的去说 OK, 我们可以像仲卿说的切割杂活累活和创造性工作 , 这个是说明就是你没有你对什么是创造你不了解嘛 , 就没有经历过 , 就是你在谈论你自己不了解的事情 , 就是这样 。

李如一1:15:38

就其实另外一点就是换句话说 , 就假设 ChatGPT, 我可能我先加加一个条件 , 就是刚才我在说这些事情的时候 , 我不认为这些人在说这些话是有什么恶意 , 就我也不认为他们真的是把人在分三六九等什么的 , 可能有些人是这么想 , 我能感觉到 ,但是我觉得大部分人不是这么想的 。

但是其实主要点还是 Laurence 说的那点 。

重轻1:15:56

他只是无知啦 。

李如一1:15:57

对 , 就是他不知道这个事怎么做的 ,而且包括创造这个事情本身 , 就我不认为有单纯的创造存在 , 就是你生活中的那些傻逼事和你那些脏活累活以及苦活 , 你不愿意干的事情 , 本质上就是你创造力的某种来源之一 。

就我们说那个有句很经常说的话嘛 , 国家不幸 , 世家幸 。OK, 我们今天做一个赛博杜甫 ,有人写过一篇这样的文章 , 我到时候放 show notes, 写的还挺好的 , 这个赛博杜甫没经历过任何痛苦 ,他就只需要负责创造 , 那他真的是杜甫吗 ?

当我们在夸赞杜甫的诗的时候 , 我们可不是光夸他诗的文笔写得好啊 , 我们还有很多其他的东西 ,而那些其他的被我们后人记住的东西 , 恰恰是杜甫人生中痛苦的部分 , 对吧 ?

但你今天说咱这蛋糕把那部分切掉只吃奶油 , 好像不不存在这样的事了 。

重轻1:16:43

对 ,而且就是创造是有机的 , 切割不开是因为它不是工作步骤 , 它俩的关系 , 那个脏活累活和什么有创造性的部分 , 它俩不是步骤和步骤的关系 , 它是有机交织在一起的 。

就是我就这两天就在想这个事的时候 , 我老是在回到一个电影的画面 , 就是那个 《 雪国列车 》 的那个电影 ,在结尾的时候你看到那个 , 这稍有有剧透啊 , 没看过的朋友可以调一下, 就是那个大反派是那个列车的司机 , 相当于他就是救所有人的命 ,在这个寒冬里面开着一辆列车在就在世界上跑 , 然后但是他那个车坏了 , 里边有一个零部件没有了 , 就

需要一个 5 岁以下的小孩在里面去拧那个齿轮 , 那相当于有一个小孩在齿轮堆里面去拧齿轮 ,但是他长大以后他就得出来被杀掉或者怎么样 ,因为他只有特别小的小孩才能够钻进去 。ChatGPT 不知道为什么老是让我想到这个小孩 , 我我觉得我就是那个小孩 , 就是如果你把我做内容的过程 , 比如说我写东西的过程 , 或者我做播客 , 或者 whatever, 我的

创造过程给它再造成用 ChatGPT 作为其中的一个步骤 , 然后我再把我的 humanity 像撒就是撒调料一样的撒进去 , 我这个我就是那个小孩 , 我在给齿轮当当一个比齿轮更加低阶的一个东西 , 它是高阶的反面 。

就是这个里边问题可相当相当之大 , 就是你没法想象你你比如说你要写一本书 , 然后 ChatGPT 可以帮你提 , 就是提高这个文献综述这部分的效率或者怎么样 , 这个真的是你去改写去 rephrase 这个我天呐 。

李如一1:18:11

我必须说啊 , 这个这个讨论跟现在的政治气候真的是密不可分的 ,因为刚才那个汉洋提到这个浮控流域杜甫 ,cyber 杜甫啊 , 意思就是说你不需要吃杜甫那些苦 , 然后你呢 ,但是你有他的才华 , 你能不能写这个说法呢 ?

今天在某些圈子马上会被标记为你是在歌颂苦难 ,他们会跟你讲说歌颂苦难大可不必 。 今天是什么世界呢 ?

今天就是说真的是身份政治的世界 , 就是说所有的人, 无论你长什么样 , 你有什么样的缺陷 , 或者什么样 , 就是无论你你有各种各样的怎么样的不同也好 , 都要被尊重 。

但是这问题老实说我没有答案 ,但是我以我 1980 年出生 , 一直比较关注文化和艺术的人, 我是很难接受这样的说法 。

就说对于我来说 , 为艺术牺牲是很正常的一件事情 , 当然我理解这个牺牲得是你自己主动选择的 。

那个最近不是 BBC 又放了那个关于那个 Johnny 喜多川 , 就是日本的那个 Johnny 事务所的那个人, 就他的性侵的那个事情嘛 , 那当然包括当时那个 Michael Jackson 的性侵也是这样 , 就是你可以说那些人啊 , 为了能够跟 Michael Jackson 演出 ,他做了牺牲 ,但这个牺牲完你很难说他是主动 ,他是自愿的 , 对吧 ?

而且他上次还是未成年人。 但是就我有我经常觉得今天有一个很大的敌人是教条主义 , 就是你 OK, 我们说任何人, 无论你是什么出身 , 什么肤色 , 你你都要被尊重 , 没问题 ,但是我我如果我主动选择为艺术牺牲 , 为什么不可以 ?

那这个时候有些人会说我怎么来证明我是主动选择的 , 对吧 ? 那对 , 当然是有这种情况 ,有有一些 edge cases, 我我很难说到底是主动还是不主动 ,但是就是现在的政治气候是让你觉得说你就根本就就像你就像刚才汉洋说的 , 我马上想到 ,因为我在一些群里看过这样的说法 ,他们会说表面上说的很客气 , 说歌颂苦难大可不必 ,但对于这种话我真

的不知道该如何回应 , 我只能说就是说他有有很多东西他根本就没有见过 , 说白了 。 还有比如说就像比如还有另外一个常见的说法 , 爹味 , 没有人喜欢爹味 , 对吧 ?

但是呢 , 难道这些反感爹味的人他想否认经验的作用吗 ? 就是他认为比如说难道一个 15 年的有 15 年经验的程序员就没有任何地方可以胜过两年经验的程序员吗 ?

任何人都不会这么说的 。 但是呢 ,他就会觉得说任何一个人由于年龄的差距来给你经验或告诉你这样是不对的 , 这样是不对的 , 这都一切所有都马上被归类为爹味 。

这就是我说的教条啊 , 我觉得教条是今天一个一个非常严重的问题 。

重轻1:20:38

我刚才说我前天看了张图 , 那图上就是两句话 , 就是一群男性主播在互相爹味说教 , 这个东西 so called 播客 。

李如一1:20:45

对 , 我当然这个问题我自己是我肯定是有反省的 , 我我的反省我相信是比很多人多的 。 我经常反省我有没有爹味 ,但是另一方面呢 , 我我绝对不否认否认经验的价值 , 我恰恰觉得经验的价值在今天是需要强调的 ,在今天这样的一个一个一个环境下 ,因为经验是一种难以言说不可量化的东西 。

重轻1:21:05

对 , 我就我想替 Laurence 补充一个事 , 就是我我有一次在一个群里 , 就是 ChatGPT 刚火的时候看到一句话 , 就是那个人忘了是谁了 ,他说 ChatGPT 是一个没有爹味说教的科普的工具 。

就这个这个我觉得刚他这句话其实影射了我们今天聊的大部分话题 , 就是没有爹味说教的科普工具 , 本质上其实也是在说 ChatGPT 这个东西 , 它的风格和它的这个东西的局限性在哪里 。

就当然爹味我们没有人可能大部分人都不喜欢它 ,但是就像 Laurence 说的 , 爹味包括我们刚才说的偏见 , 或者说你的 preference 本身都是人的组成部分 。

那么这个情况下面 , 如果你认为你的所有的信息的来源获取 , 或者你对一个事情大部分的了解都来自于一个完全平淡客观的绝对中立的一个一个叙述的话 , 那其实你会失去很多很多关于人的部分的信息的 ,而这个可能是你生活中很重要的一部分 。

李如一1:21:54

所以你就是知识只有一部分是以事实的形式存在的 , 还有很大一部分是以味道的形式存在的 ,但是它有一部分是爹的味道 。

重轻1:22:02

哈哈哈 , 对 。

李如一1:22:04

有一个我觉得必须要聊的 , 我想听听两位的看法 , 就是这个也是经常听到的关于 AI 的叙述 , 就是 AI 让很多人会有的人是刚刚发现了 ,有的人是以前就有这种想法 ,但现在更加坚定了这种想法 , 就是太阳底下无心事 , 所有的人类都是复读机 。

复读机1:22:04

李如一1:22:20

就是就是这这一点 , 就是说在 YouTube 上有一个说有一个系列的录像 , 现在好像终结了 , 叫 Everything is Remix, 就是这个也是因为过去几十年来这个有互联网之后, 就是那个各种媒介能够被收集并且很容易的获取 , 然后大家就看出了以前我们听过看过的一些作品 , 会发现里面的各种梗 , 对吧 ?

然后会发现哦 ,他的这个灵感的源头是这里 , 然后他或者他某些桥段根本就是从那里来的 。 呃 ,有一些创作者呢 , 对此是直言不讳的 , 比如说这个塔伦蒂诺 , 大家知道他的 Kill Bill, 就根本就是从那个修罗血机这部日本电影那个结构直接拿过来用的 ,而且他他完全并不想掩饰这点 。

那个大龙永一 , 我自己以前在一天世界这个节目里有专门做过节目 ,他整个这就是他的这个作业方式 , 这是他的创作方式 。

那现在就是感觉说很多人可能当发现 AI 可以通过一个统计模型做出这种让人感觉像魔术一般的 , 可以像人这样说话了 , 会让人觉得说哦 , 那其实没有什么嘛 , 对吧 ?

甚其实 Stephen Wolfram 在他文章里有讲了 ,他说其实让我们意识到人类并没有自己想象的那么特别 。他说他也说了在历史上有好多次技术演化都让人意识到了这一点 ,但这是又一次出现 , 就会我们会发现其实很多时候我们想的东西 , 这个这个下面这部分并不是 Wolfram 的原话 ,是我的我的阐释了 。

就是说我们的思考 , 我们的学习确实有大量的部分是在模仿这个 ,因为我有孩子嘛 , 那么这孩子比较小 , 这点会看得有非常切身的体会 , 就是他学你说话或者学你做什么事情 , 甚至他在外面看到另外一个同龄的小孩被爸爸抱着 ,他也要你你抱他 , 或者说另外一个小孩蹲在地上 ,他也要蹲着 , 这种是纯粹的无来由的模仿 。

我相信这种过程哪怕在成年人身上, 当一个人进入了职场 , 对吧 ? 从学校里进入职场 , 都是在同样的过程是反复的在进行的 。

那么这个时候大家看到像 ChatGPT 这样的东西 , 就会想说哦 , 这种东西模仿嘛 , 那难道机器不是比我们做的好吗 ?

那可以说是啊 , 那机器的模仿是 1:1 的 ,是绝对是高仿的模仿 ,而我们的模仿是对吧 ? 所以就大家怎么看这个问题 , 这个我我还真有自己的想法 。

首先你说人类模仿这个这个没错 , 对吧 ? 人我们就是通过模仿学习的 , 这个这个没有问题 ,但是这个其中就像基因也在不断变异一样 , 它它会有新的东西出来 , 它是有彻底的新东西的 。

但是我我我刚才说的有点迷糊 ,其实我我这样我重新组织一下语言 , 这边不用剪 。 就是就如果我们回看人类历史 , 当我说人类历史的时候 ,不是说从什么什么古希腊罗马 , 然后尧舜禹开始回看 , 我只是从人类本身开始回看 , 从人类新石器时代 、 旧石器时代 、 新石器时代 , 然后青铜时代 , 然后再用铁器 , 从这些时代开始回看 。

如果我们把这些历史足够足够多 , 你你比如你从上世纪的柴尔德开始读这个世纪 , 比如读陈胜前 , 非常好的一个教授 , 就你读他们写的东西 , 你会知道认为人类本质上就是在重复 , 这是一个非常大而无当的叙述 ,因为我们在过去的几千上万年里面创造了无数的新东西 。

所以从本质上来说 , 我是一个乐观主义者 ,是因为我通过我对人类历史的学习 ,有一让我们总是创造出来一些我们原本完全想不到的好东西 ,也当然其中带来很多傻逼的事 ,但是好东西从来就不少 ,而且很多东西是全新的 。

它会让人意识到从现在此刻开始 , 人类再也和以前不一样了 。 比如说有人会说人类抬头看星空那一刻开始 , 人类和猿人产生了区别 , 这有点诗意 ,但我觉得从人类开始意识到小麦是可以种的开始 , 那就是不一样的事情 。

再到我们发现原来什么什么和什么在什么什么情况下能产生一种容器 , 这东西可以装水 , 人类是不一样的 。

然后你有了青铜的时候 , 我们发现是不一样的 , 铁的时候是不一样的 , 包括有蒸汽机之后是不一样的 。

就是有如此之多人类历史的重大瞬间 , 这是技术上的 , 还有如此之多的思想上的重大瞬间 。 比如如果你看神学历史 , 会发现几次那种大的神学争论都诞生了非常非常新的思想 ,而且非常富有魅力 , 包括几个不同的宗教 , 伊斯兰教 、 佛教 、 基督教 、 道教 , 还有当然我们儒家 , 它它那几种大的争论带来的新的想法 , 包括像我们自己历史上, 你看那

个春秋战国 , 再看魏晋南北朝之间那些玄谈 ,他们带来的那些新的想法 , 你就会知道这个太阳底下怎么可能没有新事呢 ?

就是这我们得多么自大 , 我们能认为我们这一代人已经把人类所有东西都穷尽了 , 人类未来就这样了就得了 。

就像之前那个彼得蒂尔 ,他有一次说发达国家这个词特别有意思 , 发达国家这个词的意思就仿佛是说我们这个已经到头了 , 就是人类最好就这样了 , 剩下的其他所有的国家的目标就是发展并且赶上我们 , 这事就结束了 。

就是也某种程度上算是历史的终结嘛 。 就我我觉得这是一种非常非常自大的这说法 , 你只要稍微谦卑的一点 , 看一看你的前辈们都创造出过什么样的东西 , 我们就意识到重复固然是重要的 ,也是人类经常出现的事情 ,但是其中是能诞生出来很多新的东西的 。

我我觉得这个是毋庸置疑的 ,在我在我的视角中看来 。

重轻1:27:08

嗯 , 对 , 确实就确实 , 就人类本本质是复读机 , 这个观念现在是到了它的最顶上 ,因为 ChatGPT 太有力的证明了这个事了 。

对 , 就是因为它是一个语言模型 , 它就是它只有一个机制 , 就是就是预测下一个词嘛 。 对 , 就它就是在 run 这个事 , 就是就是在让话说自己 , 让话就是继续它自己 , 然后就能够极其夸张的通过图灵测试的程度 , 就是完全真假莫莫变 , 甚至把人类的知识和见解也都很有机的结合在一起了 。

至至少看上去是这样 , 这种观念它的企图就是想要取消 humanity, 就是取消人性 , 取消理性和取消自由意志 , 所有的这些的东西因为都是不存在的 ,因为人就是复读机 , 人就是在 predict the next word。

你不需要具备任何实质上的 , 就是你所谓的那个理性王国里面 , 你们所构造的那个试图把自己抬高的任何的东西都不用有 , 你只需要有一个神经网络 , 它在试图预测下一个词就可以 。

所以它真是字面意义上的 , 就这个产品在字面意义上在试图证明这句话 , 人类本质就是复读机 ,因为没有别的东西 , 没有 humanity, 就没有更多的让你值得向往的东西 。

所以就是作为一个工程奇迹 , 它确实在往这块走 。 对 ,但是就是就就像你刚才说的一样 , 我们讨论就是任何的创造 , 就是说一种趣味 , 一种美 , 一种诗意 , 它就是在事物之间建立一种非常 , 就是你要不这么 , 它就如果你不用这种不恰当的 、 词不达意的和很勉很牵强的方式 , 或者很生硬的方式去接近它的话 , 你就没有别的方法再接近它了 。

就是小到一个冷笑话 , 大大到一首诗 , 就是就是大漠孤烟直长河罗惹园 , 就是这两个东西之间的关系 , 你没有办法用特别 concise, 特别 logical 的方式再接近它了 。

就这就是你能离它最近的方式了 , 就这十个字 。 对吧 ?

李如一1:28:53

就是刚才重庆举那个大漠孤烟直长河落日园 , 这个恰恰是个特别好的例子来来说这个事 , 就是大漠孤烟直和长河落日园 , 这个是唐朝的诗 ,而且它是唐朝中早期的诗 。

所以你对于比如说中后期的唐朝诗人来看 , 这句话的诗不是最好的 ,是因为它前后两句说的是一件事 。

但那 OK, 今天如果你训练一个足够好的模型 , 它应该是能 , 它应该是要避免这这句话出现的 , 就是它不应该在前后两句话说一样的事 。

这个我记得这个有个术语 , 我不我不太懂 , 如果我错说错 , 大家可以指正我 , 叫合掌 , 就这个术语说这个事 。

那 OK,但为什么我还会不断的认为大漠孤烟直长河落日园 , 这是一句非常非常好 、 非常美丽的诗 ?

那不就也是恰恰因为它一它它它可能是在复读自己两句话是一样的意思 ,但是从某种意义上来说 , 这样的错误 , 这样的不会被程序所允许的事情 , 它也是有一种独特的魅力在嘛 , 对吧 ?

重轻1:29:40

对 ,而且我突然又想到一个特别傻的一个东东西 , 就是我在看他们这个材料的过程中, 我就我发现 AI 管自己的这个训练集合 , 就是英文里它说自己输入的这几十个 T 的 , 就是人类所有的文字被称为 text corpus, 就是 corpus 是全集的意思 ,但是我们平时使用这个词是尸体的意思 , 就非常有意思 , 就是文本尸体 。

就是我就突然有一个小联想 , 就是这个东西可以是被活用的东西 , 它也可以就是一个老老实实的规规范范的尸体 。

那么就是当我们把它作为尸体变成腐殖质 , 然后去滋养出一个东西 , 它就是 ChatGPT, 就它就是这样 。

李如一1:30:16

我但我觉得如果是这个这个比喻下, 我觉得 ChatGPT 在我的观众中, 它可以是那个腐殖质 , 我们从里面可以滋养出一些生命 , 对吧 ?

但是你不能把腐殖质本身当成生命来来看待 , 然后认为人类的一切本质上就是腐殖质的 ,不断的越来越多的腐殖质的出现 , 人类 produce 了更多的腐殖质 , 那这个我是不太同意的 。

重轻1:30:32

我的看法就是我我觉得那个说法应该改一下, 就不是人类本质是复读机 ,而人类本质是很不精确的复读机 。

我觉得这个差别是很大的 。 对 , 就是就像刚才我在提问的时候说的 , 就是你机器去复制是肯定是高保真的复制 ,但是人类的复制它一定是有差别 ,而这个差别其实就是艺术本身 。

我在很多地方引用过那个荆棘下雁的在小说里的那句话 , 它是借一个 19 世纪末的一个开书店的人的说法的口中说出的 。他就说如果是日本人在思考儒学 , 那就是日本的学问 ,因为他他当时他跟一个人在进行对话嘛 , 就是他说这个我们 ,他说日本我日本有儒学 , 然后他的对手说他说儒学 , 儒学不是本国的学问啊 , 然后他就说他说如果是日本人在思考儒学 , 那

就是日本的学问 。 我想以这句话作为今天的终结吧 , 就是就是你没错 , 你可以去读孔子 , 读什么都好 ,但是芬兰人 、 莫桑比克人和日本人读 , 那就是不一样的东西 。

这个就是所谓这个不精确的复读机 , 就是这个意思 。

李如一1:31:36

感觉我这期节目标题有了 , 那本期节目我看了我们原始的素材录了多长 , 录了一个小时 56 分钟 , 我不知道剪出来多长 ,但但我我觉得应该不会说特别多的内容 ,因为我们上期内容 ,因为我我有些问题没问好 , 所以说特别多 。

我也向各位听众道个歉 , 上期我感觉其实录的不是对我自己而言 , 我不是特别满意 , 我问了很多不合适的问题 。

对 , 然后那也感谢重庆和 Lawrence 做客我们的节目 , 这么聊挺麻烦的 , 你要两个人在场 , 一个人在远程 ,而且聊了挺久 。

刚才聊的内容都会放到 show notes 里面 , 大家可以看 。 我是推荐你把我们说的东西都看一遍 , 就你不要相信我们对于这些材料的总结 , 就是当我们劝你别信 ChatGPT 的总结的时候 , 你也不应该信我们的 , 你自己最好都看一遍 。

那我们下期再见 , 各位拜拜 。

重轻1:32:19

拜拜 。

李如一1:32:19

拜拜