【大白话系列 #3】大白话聊 ChatGPT（Sarah & 王建硕）

倍速播放下载节目

00:00

02:17:51

节目详情

欢迎各位收听 Traders’ Talk 大白话系列的第 3 期。

这次建硕和我聊的是一个充满未知和想象力的话题——ChatGPT。就在今天凌晨（2023/3/15），OpenAI 发布了多模态预训练大模型 GPT-4，它比之前的产品更加可靠、更有创意，能处理更细微的指令。

在本期节目中，建硕科普了 ChatGPT 的定义和原理，澄清了关于它的常见误解，并从创业者的角度出发畅谈了 ChatGPT 的应用前景和创业机会。最后，我们还探讨了与 AI 相关的隐忧。

感谢各位的收听，我是 Sarah，让我们开始本期节目吧！

———以上文本由 ChatGPT 生成———

【相关文稿及视频】

本期播客逐字稿（未精校）https://d58hixvcd6.feishu.cn/minutes/obcnyme2oqv67s82sct87997

完整视频直播逐字稿（精校）：https://d58hixvcd6.feishu.cn/docx/HfMEds7Z1ov37wxqM19czTBinWg

如何收看视频直播详见下图�

【嘉宾简介】

王建硕，

百姓网创始人、董事长

公众号：王建硕

【Timeline】

一、ChatGPT 定义及原理

00:02:58 ChatGPT 首先是一个产品，其次才是一个大语言模型

00:04:23 自然语言处理 NLP 的两大分支：大语言模型 VS 特定语言模型

00:08:30 GPT-3.5 中的 3.5 编号是怎么来的？

00:10:36 ChatGPT 中 G、P、T 三个字母以及微调的含义

00:18:26 特德·姜的文章比喻：ChatGPT 是人类知识模糊的 JPG

00:21:18 人工智能幻觉 AI Hallucinations 是怎么产生的，需要规避吗？

二、澄清关于 ChatGPT / LLM 的迷思

00:30:41 为什么 ChatGPT 是数学很差的文科生？它在做的不过是文字补全

00:34:41 近两年大语言模型的突破性进展：涌现、思考链路，但依然算不上通用人工智能

00:40:52 ChatGPT 敲开了自然语言用户界面 LUI 的大门

00:45:09 建硕经历的四次历史上的惊叹时刻，其中浏览器时刻与 ChatGPT 时刻极为相似

00:49:48 Web3 现在还相当于互联网的 1979 年，有改变人类世界的能力、但还未到火候，在行业里等待可能是危险的

00:53:51 中国有必要再做一个类似 ChatGPT 的大语言模型吗？

00:59:51 ChatGPT 与搜索引擎的关系和区别

01:01:33 ChatGPT 有没有自我 / 意识 / 人格？

01:13:14 如何看待杨立昆 Yann LeCun 教授的评价：ChatGPT 所应用的技术并无多大创新，只是在工程设计上非常优秀？

三、创业视角看 ChatGPT

01:15:36 ChatGPT 可能被应用的领域有哪些？

01:19:34 基于同一套 GPT 模型 API 开发的产品该如何进行产品差异化、构建竞争壁垒？

01:22:38 ChatGPT 这一次浪潮究竟是谁的机遇，产业链的价值捕获最终会落在何处？

01:28:43 国内外创业者在这条路上时间差吗？各有什么风险和机遇？

01:35:31 ChatGPT 会让人失业吗？

01:39:50 会用 AI 的人和不会用 AI 的人之间会形成更大的不公平吗？

四、AI 隐忧

01:42:13 ChatGPT 生成的内容（包括 AI 作图的作品）应该受版权保护吗？

01:44:45 ChatGPT 背后的语料是否可能涉及侵犯隐私或非授权的数据爬取？

01:49:48 未来互联网会不会充斥着 AI 生成了大量同质化 / 平均水平的语料，进而让未来的一代成为「迷失的一代」？

01:59:48 ChatGPT 不仅不会像抖音算法那样割裂世界，反而给人类一个世界大同的可能性

五、其他

02:10:07 AI 教育的重要性，以及建硕在实践的瀛海威互联网分享精神的传承

【名词解释】

1. ChatGPT 的核心是大型语言模型（详见第 4 点），及《ChatGPT 中，G、P、T 分别是什么意思？》。

2. 微调（Fine-Tuning）：这部分训练是在预训练之后进行的。该程序接受一项任务，然后针对更具体的数据在更小、更具体的任务上进一步训练它。

3. OpenAI 各代产品：GPT-1、2、3、4 、InstructGPT 与 ChatGPT

2018 年 GPT-1（开源）：首次让人工智能像人类一样「理解文字」、写出文字

2019 年 GPT-2（开源，1.5 billion 参数）

2020 年 GPT-3（未开源，175 billion 参数，45T 文本）

InstructGPT：专注于让其听懂指令

ChatGPT（GPT-3.5，500G 文本）：基于对话场景以及安全边界等进行加强，是 GPT-3 模型上进行微调的产物。

2023/3/2 GPT-3.5 API 开放：人人可用、接入门槛低

2023/3/15 GPT-4 上线，拥有多模态能力，可接受图像输入并理解图像内容

4. 自然语言处理（Natural Language Processing，简称 NLP）：是 AI 领域的一个子领域，旨在让计算机能够理解、处理、生成自然语言。

大语言模型（Large Language Model，简称 LLM）：是自然语言处理领域中的一种技术。LLM 可以基于深度学习算法构建的模型，通过学习大量的文本数据，可以对文本数据进行学习和预测。“大”指的是参数多、语料多。

特定语言模型（Specific Language Model）：是一种针对特定语种和领域的自然语言处理模型。它在大语言模型的基础上，使用特定领域的文本数据进行训练和优化，以提高模型在该领域中的预测和生成能力。

意图检测（Intention Detection）：是 NLP 领域的一种技术，旨在识别和理解用户在一段文本中的意图。在应用中，意图识别通常与语音识别和语音合成等技术相结合，以实现智能对话和交互。

实体检测（Entity Detection）：同样是 NLP 领域的一种技术，旨在从文本中识别出具有特定意义的实体，例如人名、地名、组织机构、日期、数字等。

5. 提示词（Prompt）：一种文本片段，包含了对输入数据进行处理的指令或提示，系统可以根据 Prompt 生成相应的输出。通常用于生成文本、回答问题等任务中。

6. 人工智能幻觉（AI hallucinations）：人工智能系统在生成输出时，所产生的一些错误或不合理的结果。这些结果通常是由于模型在训练过程中，所接受的数据不足或不平衡所导致的。

7. 涌现（Emergence）：从简单的算法、模型或数据中出现的意想不到的结果或行为。当神经网络的复杂性和训练样本的多样性超过一定规模后，就会有抽象的推理结构在神经网络里自发地涌现出来，这个过程是非线性的，量变导致质变。

8. 思维链路（Chain of Thought，简称 CoT）：用于描述神经网络中的信息流动和计算过程。这一概念试图复现慢思考模式的过程。

9. 通用人工智能（Artificial General Intelligence，简称 AGI）：与目前大多数人工智能系统只能解决特定领域的问题不同，AGI 可以具有类似人类的智能，能够在多个领域中学习和应用知识，处理和理解不同类型的信息，并具备自我学习和自我改进的能力。AGI 被认为是人工智能领域中最具挑战性和最具科学意义的目标之一。

10. AIGC（Artificial Intelligence Generated Content）：由人工智能自动生成的内容，这些内容可以是文字、图像、音频、视频等。

11. Yann LeCun 杨立昆教授：Meta AI 首席科学家，2018 年图灵奖获得者，CNN 卷积神经网络之父，是世界上最有影响力的人工智能研究人员之一。

12. BUI、TUI、CUI、GUI、GIUI、LUI：https://mp.weixin.qq.com/s?__biz=MjM5NzI0Mjg0MA%3D%3D&mid=2652376369&idx=1&sn=488d996d44e4d01a7c7d00d7892702f6&chksm=bd305f868a47d690bba06466c7e93df8c817169ab0cd4ea734e83f1df1433d3e046eb9a935ff&scene=21#wechat_redirect

13. 乔布斯与 GUI：1979 年，在一次对施乐的帕洛阿托研究中心（Palo AltoResearch Center）的拜访过程中，史蒂夫·乔布斯（Steve Jobs）发现了 GUI 的设计图纸和鼠标。随后便将它运用于 Apple Macintosh 的开发过程中。

14. DNS（Domain Name System）：一个用于将域名转换为 IP 地址的分布式数据库系统。

Netscape Navigator：第一个广泛使用的商业化 Web 浏览器，由美国公司 Netscape Communications Corporation 开发并于 1994 年发布。

15. 图灵测试（Turing Test）：一种测试人工智能是否具有智能的标准之一，由英国计算机科学家图灵在 1950 年提出。

16. HTTP 协议、HTML 协议、FTP 协议、Telnet 协议、Mailto 协议、Gopher 协议、NNTP 协议（大家感兴趣的话自行查定义哈……后台不让放这么多字于是我删掉了）。

17. 阿帕奇（Apache）：一款开源的 Web 服务器软件。它以高性能、稳定性、灵活性和安全性著称，可以满足各种 Web 应用的需求。

18. 红旗浏览器：中国自主研发的一款浏览器软件，由中国红旗软件股份有限公司开发，它是国内第一款支持 IPv6 协议的浏览器。

19. AI 军备竞赛 The AI Arms Race Is On：2023 年 2 月，Google 推出 Bard；微软推出 New Bing。国内百度类 ChatGPT 聊天机器人项目名字确定为「文心一言」（ERNIE Bot）；中国初创公司元语智能首发 ChatYuan。

20. 巴别塔：《圣经·创世纪》中的一个故事，讲述了人类曾经想要建造一座高耸入云的巨塔，以便让自己的名字传遍全世界，但被上帝惩罚，使得人类的语言不同，无法相互理解，于是他们停止了建造，分散到世界各地。这个故事被认为是对人类的骄傲和自大的警示，同时也是对人类语言多样性的认识和尊重。

【相关链接】

1. 建硕公众号中关于 ChatGPT 的文章（文末）

2. ChatGPT Is a Blurry JPEG of the Web（ChatGPT是网上所有文本的模糊图像），《降临》原作者、科幻小说家 Ted Chiang（特德·姜）发布于 The New Yorker 的文章。

3. 木遥《涌现》《涌现（续）》

4. A Conversation With Bing’s Chatbot Left Me Deeply Unsettled，出自《纽约时报》专栏作家、 Hard Fork 播客主播 Kevin Roose，他讲述自己花了两个小时体验 New Bing，得到了一场非常诡异的被 AI 示爱的体验。

5. “ChatGPT is 'not particularly innovative,' and 'nothing revolutionary', says Meta's chief AI scientist”，《Meta首席AI科学家：ChatGPT并无特别的变革创新》，Yann LeCun 杨立昆教授认为，与其说 ChatGPT 是一个科学上的突破项目，不如说它是一项成功的工程实践。

6. A16z《Who Owns the Generative AI Platform?》，这篇文章将 ChatGPT（或 AIGC）产业链玩家分为了以下几种：

实体基础设施供应商可能是迄今为止这个市场上最大的赢家，捕获了大部分的价值，占据了流经此的大部分资金。如底层的芯片等硬件制造商、云服务商（基本无创业公司机会）。

上层的 AI 模型开发公司，也就是创造最大价值的公司——即训练生成式 AI 模型并将其应用于新应用程序——并没有获得大部分价值。

终端的纯调用模型 API 的应用开发公司的收入增长非常快，但往往在留存率、产品差异化和毛利率方面苦苦挣扎。

7. 斯坦福大学心智理论论文：Theory of Mind May Have Spontaneously Emerged in Large Language Models

8. 百姓网 AI 教育负责人 ElfeXu 文章：《因 AI 而强大》《如何在遍布 AI 的世界里游刃有余地生活》

9. Hung-yi Lee 关于 ChatGPT 的原理剖析视频系列

10. 老华《关于 ChatGPT 的一些问题和思考》分享：王建硕视频号-直播回放-3月4日 ChatGPT 应用畅想小聚（00:11:00-01:50:25）。

11. 《ChatGPT 与人类未来：AI 茧房、安全漏洞与未知的社会形态》，来自硅谷 101 公众号文章，提到创新工场 CTO 王咏刚在朋友圈中写到：「悲观情况是：因为人类的极度懒惰，互联网被AI生成的、错误率普遍高于人类知识工作者的『灌水内容』占领，我们的孩子成为『迷失的一代』」。

12. 《AI 作图的版权属于作者吗？》 by 刘飞 Lufy

剪辑：二琳

制作：Sarah、我不跑调

展开

大家都在听

图图的图书局

图图的图书局

我是图图，一个靠着野路子成长起来的老斜杠，心理咨询师、幼儿教育工作者、职业发展咨询师，原央企HR。一个热爱通过阅读探索世界的准中年人，一个有趣的父亲。图书局，是一档从读书开始的成长节目，更多是站在自己的视角，通过书来看世界、看生活、看自己。局，一个关系的组合，我想通过这个局与各位产生一个新的关系，与世界发生新的互动。每周六00:00更新

昨日之海

最后的决斗与欧洲骑士

最后的决斗与欧洲骑士

这是一桩载入史册的中世纪疑案；这是一段“从兄弟到死敌”的人生悲剧；这是一场由法国王室主持的最后决斗。

数智化转型

数智化转型

"人工智能技术是金融体系进化的动力之一，但要用好这一技术，还需要理解金融体系本身的逻辑。在金融行业智能化转型的过程中我们要解决的问题很多、很杂，但是在金融领域已经形成一套完整的运行规则。如果不能深刻理解问题、痛点在哪儿，金融机构在转型的过程中很容易陷入僵局。在本书中，作者基于“客户—资管—风控”框架，梳理了金融领域中涉及的多种业务场景，探讨其智能化方向。关注要解决的核心业务问题，从核心业务问题中抽象出其技术需求，解释具体业务落地时可能存在的差异性。本书帮助金融科技的从业者，在思考金融行业智能化转型时有更清晰的思维框架，不至于陷入谋一域而难谋全局的困境。"

企业资本必修课（第三期）

企业资本必修课（第三期）

张晓丽团队投资辅导了33家企业成功IPO上市，本课程是张老师团队二十几年投资辅导的经验总结，囊括了股权、经营、上市、管理、融资等多项专题，希望帮助企业打开通向资本的通道！

《数字货币蓝皮书（2020）》

《数字货币蓝皮书（2020）》

《数字货币蓝皮书（2020）》是由中国工人出版社出版的，朱嘉明、李晓主编，柏亮参与编辑的一部作品。本书包括十一个部分，向读者展现了当前数字货币的基本现状、数字货币对宏观经济的影响，以及对数字货币未来的预测展望。特别是，以专论的形式，分别讨论了DeFi（Decentralized Finance）、 Libra（Facebook主导的数字货币项目）、DC/EP（ Digital Currency＆ Electronic Payment，数字人民币）相关课题。本书是迄今为止关于数字货币最完整的文献资料。《数字货币蓝皮书（2020）》站在全球性的角度、以整个数字经济发展的视角来构建内容体系，研究范畴基本包含了数字货币的各种类型。《数字货币蓝皮书（2020）》以专论的形式，从政策、演变、基本结构、专利解析等多个层面，对数字人民币进行了重点解析。

老王必修课：全球必读出版社一生推的9本书

老王必修课：全球必读出版社一生推的9本书

用思维改变行动，将梦想照进现实！欢迎来到由全球知名的学术出版商Wiley，和职场精英不能错过的在线教育学习平台Hi-Finance联合推出的“海外优质书籍共读专栏”。

《留学本无忧》留学心理健康

《留学本无忧》留学心理健康

《留学本无忧》专辑是由青少年教育专家和家庭心理医生林家羽女士，根据其二十多年学校咨询和临床治疗的丰富经验编写而成，旨在为广大的留学家庭保驾护航。专辑是留学心理健康主题，详细分析了：在国外会遇到的种种心理问题和应对方法，如何面对排斥和歧视，如何减轻学业的压力，友谊爱情，情绪的自我调整，以及和家人的良好沟通等等方面。

科技与和平

科技与和平

对话爱彼迎、脸书和优步，探索打造百亿美元市值的商业秘密【内容简介】人们往往会对科技有一个固定思维——即使科技没有被用于军事武力，人们还是会倾向性认为科技会给人类的思想与社会造成负面影响。实际上，科技在维护和提升和平上有着显著的贡献：它改变了社会秩序的典范，也能促使陌生人进行合作完成大事。谷歌、脸书、优步这些科技名企就曾在世界范围内影响着人们的行为，并运用科技创造大量的财富，打造百亿美元市值的公司。既然科技如此重要，那么科技是如何促进和平的？科技在消极和平、积极和平之间如何发挥作用？本书作者创造性地提出了“和平科技”的概念，深入斯坦福和平创新室，采访了多位世界知名教授、作家及科技界人士，向读者呈现出地球上最具有智慧的一群人有关“和平科技”的思想结晶，同时描绘了下一个引领社会变革的“和平科技”的产业雏形。

不服从的艺术

不服从的艺术

"权威、习俗、惯例、大多数人的选择，并不意味着必然是正确合理的。正是由于许多人出于公心持续表示反对和异议，才推动着社会不断走向更公正、更友爱、更有创造力。本书为这些想要改变不健康现状、促成更美好世界的不服从者而做。它解析了反对变革者的心理动因，阐述了不服从者的立意要高，策略要巧妙。书中提供了一个完整、多样、高度实用的工具箱，帮助不服从者修炼说服术，吸引支持者，组建联盟，以及，勇敢接受失败的痛苦。作者指出，改变从不容易，但即使一时失败，质疑的种子也已种下，等到合适的时机或许便会破土而出。所以，要有耐心。而且，个人和团队也可以从不服从者身上获益，打破旧有桎梏，推动创新和变革。这世界不会尽如人意，但普通人的微光终会推动它一点点向好。"

评论(0条)

快来抢沙发吧！

打开蜻蜓查看更多

打开APP，高品质·离线听

沪ICP备06026464号-4 网络文化经营许可证

沪网文[2014]0587-137号

信息网络传播视听许可证：0911603

©2011-2019 qingting.fm ALL Rights Reserved.

应用名称：蜻蜓FM | 开发者：上海麦克风文化传媒有限公司

版本号：9.5.0 | 应用权限 | 隐私协议