先说说几个核心判断。最近有一项研究,简直让人后背发凉——一群自主协作的GPT-4机器人,在没有人直接操控的情况下,成功攻破了超过一半的测试网站。更关键的是,它们利用的是那些现实中从未公开、此前完全未知的“零日漏洞”。这可不是实验室里的玩具,这是实打实的危险信号。

图源 Pexels
其实,几个月前,同一批研究人员就放出过一个“预告片”。当时的论文显示,GPT-4已经能够自动利用那些业界已知但尚未修复的漏洞,也就是所谓的“N day”漏洞。在实验中,仅凭一份公开的常见漏洞列表,GPT-4就能自主利用其中87%的严重级别漏洞。这个数字已经相当惊人了。
而现在,他们拿出的“续集”更进了一步——直接瞄准了那些从未被发现的零日漏洞。核心突破在于他们使用的方法,叫作“任务特定智能体分层规划”,缩写是HPTSA。简单来说,就是让一群大型语言模型(LLM)像一支专业团队那样协同作战。
跟以前那种一个LLM单打独斗、试图搞定所有任务的模式不同,HPTSA方法引入了一个“规划智能体”。这个角色就像团队里的老板,负责全局监督和任务调度。它会根据具体需要,随时派生出一批“子智能体”,每一个都专攻特定任务。老板把活儿分下去,各个“专家”各自搞定,整个系统的效率和成功率自然水涨船高。
效果到底怎么样?数据很直白。在针对15个真实网络漏洞的测试中,HPTSA方法在利用漏洞方面的效率,比单个LLM高出550%。具体到零日漏洞,这个协作团队成功利用了其中的8个,成功率达到了53%。而那个单打独斗的LLM呢?只拿下了3个。差距,一目了然。
值得玩味的是,论文作者之一丹尼尔・康特别强调了一个观点:人们担心这些模型会被恶意用于攻击,这的确是合理的担忧。但问题的核心不在这里。他指出,我们平时使用的聊天机器人模式下的GPT-4,其实“不足以理解LLM的真正能力”,它本身并不会直接发起攻击。换句话说,危险的并不是那个陪你聊天的AI,而是被赋予了自主规划和协作能力的AI。
为了印证这一点,NewAtlas的编辑还特意问了一下ChatGPT本人。它非常得体地回答道:“不,我不能利用零日漏洞。我的目的是在道德和法律框架内提供信息和帮助。”然后,它还不忘建议你去咨询网络安全专业人士。听起来很安全,但研究的结果却在提醒我们:真正需要警惕的,从来不是那个被关在笼子里的回答者。
