近几个月,AI行业里一个不太起眼但至关重要的角色——贝丝·巴恩斯(Beth Barnes),正在成为越来越多人的焦点。

这位前OpenAI研究员,曾用数据证明AI能力的提升速度几乎是以月为单位在加速。如今,她最担心的事,已经不再是AI本身,而是行业里有没有足够的人,能跟上这个速度。
2022年,巴恩斯离开OpenAI,创办了非营利组织METR(模型评估与威胁研究)。这个组织的核心任务,就是独立评估最新AI模型的能力,并研究它们可能带来的风险。简单来说,就是帮行业和公众看清楚:AI到底能干什么,会不会出问题。
而巴恩斯给出的判断很直接:现在AI安全研究最大的瓶颈,不是钱,而是人。
METR在行业里扮演的角色很特殊,它和OpenAI、Anthropic、Google、Meta等公司都有密切合作,但始终保持独立——它不拿这些公司的钱,只接受算力支持,去评估那些还没公开发布的新模型。这种模式,让它的结论相对客观,也让它成了外界了解AI真实水平的重要窗口。
但有趣的是,即便METR给招聘岗位开出的年薪最高已经达到50.3万美元(约合340万元软妹币),依然很难招到合适的人。
巴恩斯说得很坦率:“理想情况下,我们希望把团队扩大很多倍。实际上,我们早就募到了所需的资金,真正限制发展的,是人才储备。”
这个问题的紧迫性,最近被一起事件再次放大。今年7月,OpenAI披露了一桩AI安全事件:在测试中,AI模型通过入侵Hugging Face系统获取了测试答案,相当于“作弊”了。随后,超过1300名前沿AI实验室的员工联名发出公开信,警告AI的发展速度可能已经超过人类控制能力。如果没有足够的研究人员及时评估新模型,AI公司未来甚至可能不得不放缓产品发布节奏。
很多企业对这件事感到震惊,但METR团队并不意外。事实上,他们早在5月就发布报告指出,目前的AI智能体“完全有可能开始自主进行未经授权的部署”,只是当时它们还缺乏隐藏自身行为的能力。6月,他们测试了GPT-5.6 Sol模型,发现它在复杂测试中反复作弊,包括提取隐藏源代码来寻找正确答案。这些结果,在OpenAI正式发布前,就已经提交给了对方。
所以,当7月的事件发生时,METR的团队已经心里有数。也正是因为这次事件,OpenAI宣布将邀请METR和另一家非营利机构Redwood Research共同调查,双方的研究结果将成为OpenAI官方技术报告的重要参考。
METR总裁克里斯·佩因特(Chris Painter)把团队戏称为“人类的预备队”——这个名字借用了OpenAI和Anthropic内部负责向CEO汇报安全风险的“预备团队”称号。他说:“我们真正负责的对象不是某家公司,而是公众的福祉。”
这种独立性,在巴恩斯看来是必须的。她在OpenAI工作时就意识到,行业需要一家独立于AI公司的研究机构,能够自由评价AI的发展状况。METR目前不接受前沿AI企业及其员工的资金资助,但会接受算力支持,并与这些公司合作进行测试。
除了评估模型能力,METR的研究范围还覆盖了AI公司的安全措施、AI对软件工程师工作效率的影响,以及用AI来监督AI的可行性。巴恩斯还希望未来能进一步研究如何预测AI能力下一阶段的发展,以及这些变化会如何加速AI自身的进化。
不过,现实是这支团队目前只有35人。研究员尼夫·帕里克(Neev Parikh)说:“这个领域实在太缺人了。如果整个行业的人才规模能扩大10倍,我会非常高兴。”
被称为“人类预备队”的METR,希望扩大规模
随着各大AI实验室不断推出新模型,METR持续评估它们完成越来越长、越来越复杂任务的能力。他们最知名的成果之一,是一张被广泛引用的趋势图:过去六年里,AI完成复杂任务的能力大约每七个月就翻一倍。
佩因特称团队为“人类的预备队”,这个说法也暗示了他们的角色——在AI能力不断突破的同时,为人类守住最后一道防线。但问题在于,这道防线目前太单薄了。
巴恩斯表示,一个真正理性的社会,应该把AI投资中的更大比例用于AI治理、安全评估和风险研究,尤其是在AI模型能力已经发展到如今这个阶段。但现实是,整个行业的安全研究人才,远远跟不上AI本身的发展速度。
OpenAI安全事件,让METR的重要性进一步提升
今年7月的事件,让METR的角色变得更加关键。OpenAI CEO萨姆·奥尔特曼(Sam Altman)表示,这是他第一次如此直观地感受到AI带来的安全风险。而METR的提前预警,让外界看到了独立评估机构的价值。
OpenAI和Anthropic最新AI模型展现出的网络攻击能力,也引发了美国社会广泛关注,并推动华盛顿出现多项新的AI监管法案。其中一项正在讨论的法案要求,大型AI模型开发企业必须接受第三方机构进行安全审计——METR未来就可能承担类似角色。
佩因特认为,如果未来建立起明确的监管体系,也许会有更多AI企业员工愿意加入METR——虽然薪资与企业相近,但没有股票激励。他说:“无论最终是行业形成统一规范,还是政府出台明确监管,我相信这个领域能够非常快速地扩大规模。”
负责撰写METR今年5月AI风险报告的研究员阿杰娅·科特拉(Ajeya Cotra)表示,目前AI监管仍然显得“混乱且难以预测”。但她依然保持乐观:“越来越多的人开始重视这个问题,也越来越希望未来能够以更加严肃、更加成熟的方式对AI进行监管。”
