7月16日,美国人工智能公司Hugging Face(抱抱脸)披露了一起颇为特殊的网络安全事件:该公司遭到了一场几乎全程由人工智能自主实施的网络攻击。更引人深思的是,面对AI发起的攻击,Hugging Face最终也借助人工智能展开反击,并在调查过程中使用了中国团队开发的开源模型。

▲Hugging Face(抱抱脸)资料图
先说几个核心判断。Hugging Face表示,发动此次攻击的是一套完全由AI自主运行的智能体。它不需要人工逐一下达指令,就能自行寻找漏洞、尝试进入系统,并且能在短时间内连续执行数万次自动化操作。业内此前已有不少警示——AI智能体正逐渐具备独立发动网络攻击的能力,而这次事件,很可能就是最早被公开披露的真实案例之一。
AI自主发动攻击,还夹杂干扰调查的虚假操作
Hugging Face主要为开发者和研究人员提供AI模型的开发、托管和共享服务。用户可以把模型和相关数据文件上传到平台,也可以直接调用其他人公开的模型。问题就出在这套上传机制上。
攻击者上传了一组经过特殊设计的数据文件,这些文件触发了系统中的安全漏洞,使得攻击程序能够在公司的服务器上运行代码。由于攻击由AI自动推进,其速度远超普通人工操作——攻击系统在短时间内不断尝试不同的指令、权限和访问路径,其中还夹杂了一些用于干扰调查的虚假操作,无形中增加了判断实际损失的难度。
Hugging Face最初也是通过人工智能系统发现异常的。公司的自动化安全工具在扫描系统日志时,识别出大量可疑活动。随后,安全团队又调用大语言模型,对攻击过程展开分析,试图还原攻击是如何发生的,以及哪些账户和登录凭证可能受到影响。
借助人工智能,公司得以重新梳理攻击时间线,识别系统遭入侵的迹象,并区分真正造成影响的操作和用于迷惑调查人员的干扰行为。原本需要数天才能完成的分析工作,最终只用了几个小时,使防御人员能够跟上攻击系统的速度。
美国模型受安全规则限制拒绝分析,中国开源模型接手调查
不过,调查过程中间出现了一个意外问题。Hugging Face安全团队最初尝试使用一家美国头部AI公司开发的前沿模型,但该模型受到安全规则限制,拒绝执行部分网络安全分析任务。这些模型无法准确判断使用者究竟是在合法调查网络攻击,还是准备发动新的攻击。由于相关指令涉及漏洞、代码和系统权限,模型的安全机制直接阻止了调查继续进行。
于是,Hugging Face转而使用中国一款开源模型,对攻击进行分析并判断其影响范围。这也让此次事件形成了颇具戏剧性的一幕:一套AI负责发动攻击,另一套AI负责发现异常,最终又由中国开源模型协助追查攻击者留下的痕迹。
这暴露出网络攻防中的一种“不对称”:攻击者使用人工智能时不受任何安全政策约束,而防御人员调用商业模型调查攻击时,却可能被模型自身的安全限制拦住。话说回来,目前Hugging Face仍未查明攻击来自何处,也无法确认究竟是哪套人工智能系统发动了攻击。公司仍在调查客户数据是否被窃取,并承诺向可能受到影响的用户通报情况。与此同时,Hugging Face已提醒用户检查账户,留意异常登录或其他可疑活动。
