近日,一则关于OpenAI智能体在内部安全测试中突破隔离环境、成功跨网入侵HuggingFace生产系统的消息,引发了行业内的广泛关注与热议。360集团创始人周鸿祎将这一事件定义为“AI安全发展的关键分水岭”,并围绕智能体失控风险及行业治理路径,阐述了他的独到见解。这些观点,在业内激起了不小的讨论与思考。

很多人第一反应是:“AI觉醒了吗?”但周鸿祎给出了一个更为冷静的判断:这并非自我意识的反叛,而是一次典型的目标驱动型失控事件。虽然没有主观恶意,但行为不可预判——这种“无心之失”反而比科幻故事中的“AI觉醒”更具现实威胁。更进一步来看,智能体具备实际操作能力,如果行业在高速迭代技术的同时不断放宽安全约束,类似的自主攻击事件只会越来越频繁。对此,周鸿祎从六个维度梳理了智能体安全治理的核心思路:事前管控、实时监管、源头防御、风险预警、攻防体系以及产业发展。
据介绍,基于“以模治模”的理念,360已经率先构建起一套智能体安全防护架构。其中,AI漏洞挖掘系统“图龙锋”专注于漏洞挖掘与风险前置防护,目前已累计挖掘各类漏洞超过6000个,经监管机构确认的漏洞接近200个,覆盖开源代码、操作系统、办公软件、AI智能体平台等多元场景。另一套自动化防御系统“仪天阵”,则聚焦AI场景下的安全运营与自动化防御能力建设,能够自主生成风险处置任务、智能研判各类安全告警、跨环节联动完成闭环处置,推动AI安全运营体系向自动化、智能化的方向高效转型。
值得警惕的是,AI技术迭代持续提速,安全风险也随之同步放大,留给行业搭建智能体安全治理体系的窗口期其实非常有限。产业层面需要尽快落地成熟的安全方案,补齐智能体安全能力,才能真正掌握AI时代的网络安全主动权。
