在《最容易懂的 ChatGPT 介绍与使用教学》那篇文章里,我们聊了 ChatGPT 是什么、怎么用。ChatGPT 这个名字,拆开就是 Chat 和 GPT 两部分。Chat 大家都熟悉,聊天的意思——毕竟它就是个聊天机器人,名字里带个 Chat 合情合理。
那 GPT 呢?如果你之前没接触过 AI 领域,这三个字母确实容易让人摸不着头脑。为什么 ChatGPT 非要加上 GPT?这三个字母到底代表了什么?咱们今天就来拆解一下。

为什么叫 GPT?
GPT 是 Generative Pre-trained Transformer 的缩写,中文意思是“生成式预训练 Transformer 模型”(Transformer 是专有名词,不翻译)。接下来我们逐一看看每个词的含义。
先说 G,Generative,生成式。这指的是这个 AI 模型是用来生成新资料的。AI 有很多种类型,早些年我们见得更多的是辨识型 AI,比如手机人脸解锁——靠的就是识别。而生成式 AI 比辨识难得多,它能生成文字、图片这类全新的内容。
接着是 P,Pre-trained,预训练。意思是这个模型在正式使用之前已经提前训练过了。GPT 的训练,最开始靠的是无监督式学习(unsupervised),换句话说,没有人介入,也没有专门的数据标注,直接把海量网络数据喂给模型。等无监督训练完成后,再结合人类介入的微调(fine-tuning),让模型输出的结果更符合人类的偏好。
最后是 T,Transformer。这是个专有名词,所以没翻译成中文。Transformer 是 Google 在 2017 年提出的深度学习模型,核心机制是注意力(attention),用来做预测。而 GPT 正是在这个 Transformer 模型的基础上进一步发展出来的。
把 Chat 和 GPT 拆开理解之后,就很清楚了:ChatGPT 这个聊天机器人,本质上是一种生成式 AI,所以它能生成新内容;又因为它是预训练过的,所以能产生符合人类偏好的回答,让人感觉它好像真有智慧一样。
