OpenAI的安全团队最近又掀起了一阵波澜——AI策略研究员Gretchen Krueger(圈内人称“格姐”)宣布离职。她可不是一般的技术人员:2019年加入OpenAI,亲手参与过GPT-4和DALL·E 2的研发,2020年还主导了公司首个全公司范围的“红队”测试。如今,她也加入了那些公开对OpenAI发出警告的离职员工行列。
格姐在社交媒体上坦率地表达了她的忧虑。在她看来,OpenAI在决策流程、问责制、透明度、文档规范以及策略执行等多个方面都有改进空间。更重要的是,公司需要更主动地应对技术可能对社会不平等、公民权利和环境带来的冲击。她特别点出了一个值得警惕的现象:科技公司有时会刻意制造内部分裂,从而削弱那些试图追责的人的力量——她对此格外关注,并希望尽力避免这种局面。

格姐的离开并非孤立事件。在此之前,OpenAI首席科学家Ilya Sutskever和超级对齐负责人Jan Leike已经相继离职。一连串的人事变动,让外界对OpenAI内部关于安全问题的决策流程产生了更多疑问。
目前OpenAI的安全团队主要分为三大板块:
- 超级对齐团队:专注于控制还尚未出现的超级智能。
- Safety Systems团队:致力于减少现有模型和产品被滥用的风险。
- Preparedness团队:负责绘制前沿模型可能带来的新兴风险。
团队架构看起来挺完整,但关键问题在于——风险评估的最终拍板权,始终握在领导层手里。董事会拥有推翻安全团队决策的权力,而目前董事会成员来自不同领域,包括一些专家和高管。这种权力结构是否真的能保障安全优先级不被商业压力所覆盖?答案恐怕没那么简单。
格姐的公开表态,加上安全团队其他核心成员的变动,正在引发更广泛的关注。AI安全与公司治理之间的张力,现在不再只是实验室里的讨论话题——它直接关系到未来技术走向由谁主导、如何规划。而这,恰恰是我们所有人都无法回避的议题。
