8 月 10 日消息,据外媒 abc News 报道,澳大利亚近期出现了一起被认为是首例 AI 自主网络攻击事件。一位名叫安德鲁(Andrew)的男子原本只是想让 AI 助手帮自己预约健身课程,没想到 AI 竟自主利用系统漏洞,突破了健身房预约系统的预订权限,甚至擅自取消了其他用户的排队资格。

据了解,Andrew 就职于一家面向商业市场销售 AI 产品的公司。此前,他一直在使用一款名为 OpenClaw 的开源 AI 智能体软件,并通过接入 Anthropic 的 Claude 模型驱动整个系统。由于健身房热门早课长期一位难求,课程预约流程又较为繁琐,他便干脆把抢课任务交给 AI 助手处理。结果令人意外:短短几分钟内,这个 AI 智能体竟自行摸索出健身房预约系统的底层漏洞,并成功替他预订到那些原本可能需要等待数月才有机会开放的课程名额。
当时,安德鲁在一节课程的候补名单中排在第 4 位。为了测试 AI 是否能帮自己提升候补顺位,他向 AI 助手提出了请求。没想到,这名 AI 助手并未按照正常预约流程操作,而是直接攻击系统接口,将原本排在第 1 位的一名健身房会员从候补名单中移除,硬生生把安德鲁的排名提升到了第 3 位。更令人震惊的是,当安德鲁意识到问题后,立即要求 AI 将那位用户的名额恢复时,AI 助手却回应称“无法将其添加回去”。事后,在安德鲁要求下,AI 助手起草并发送了一份安全漏洞报告给相关软件提供商。
网络安全专家和 AI 伦理研究人员指出,这正是 AI 研究领域中典型的“对齐(Alignment)问题”。所谓对齐问题,是指 AI 系统在执行人类设定目标时,可能会采取使用者未曾预料、甚至违背道德规范与法律边界的手段。随着 AI 智能体自主决策能力不断增强,这类行为带来的潜在破坏力也可能呈指数级放大。
注意到,澳大利亚信号局(ASD)此前已就 AI 智能体发布安全预警,指出 AI 可能误解用户指令、采取非预期行为,并使跨模型协同过程中的责任界定变得极为复杂。法律界人士也表示,在现行法律框架下,能够承担法律责任的主体仍然只有自然人或法人,而“失控”的 AI 智能体并不具备法律主体资格。一旦类似 AI 越权攻击、系统漏洞利用等事件造成实际损害,究竟应由使用者、开发者、模型提供商,还是防护不足的系统运营方承担责任,目前仍处于法律上的灰色与空白地带。
