OpenAI 的科学家 Hyung Won Chung 在首尔国立大学的一次演讲中,释放了一个重要信号:GPT-4 即将迎来一次真正意义上的关键跨越,其性能将实现质的飞跃。

他直言,新一代大语言模型正处在剧变的前夜,整个社会都必须尽快调整对 AI 的认知框架。尽管当前市面上的大模型在部分场景下的表现仍不尽如人意,但随着模型规模持续扩张,许多过去形成的结论很可能会被彻底推翻——模型规模本身就是改变一切的关键变量。
那人们一直担忧的安全问题呢?比如信息滥用、虚假新闻、深度伪造?根据 Chung 的说法,新一代 GPT 具备了快速自我纠正的能力,完全可以有效对冲这些风险。换句话说,模型不再是“生成即定型”,而是能够边运行边修正。
Chung 在分享自己的工作方法时提到一个细节:他习惯将每次实验的失败记录下来。每当有新模型出现,他都会重新跑一遍旧实验,观察哪些问题得到了解决、哪些依然存在。这种持续迭代的认知更新方式,恰好反映了整个领域的技术节奏——变化太快,旧经验可能很快就会过时。
从目前来看,GPT-3 与 GPT-4 之间的差距依然显著,试图依靠“补丁”来缩小这一鸿沟基本上不现实。真正的瓶颈究竟卡在哪里?Chung 将矛头指向了最大似然估计的目标函数——这恰恰是达到 GPT-4 一万倍规模的关键障碍。下一步更可扩展的范式,是让神经网络自主学习目标函数本身,从而赋予模型更强的表达能力。随着计算成本呈指数级下降,那些可扩展的方法终将成为最终的赢家。
