7月28日消息,英伟达正式宣布成立全新的开放安全AI联盟(Open Secure AI Alliance)。首批成员阵容强大,包括微软、SpaceXAI、Palantir、Adobe、CrowdStrike、Hugging Face、戴尔等知名企业,覆盖云计算、网络安全、企业软件及开源组织等多个关键领域,可谓阵容齐整。
该联盟的核心使命是开发和共享一系列用于AI安全与网络安全的开放技术、方法和工具。英伟达表示,将向联盟贡献开放模型、模型权重、数据资源以及智能体框架相关的研究成果。目前首个公开项目——Nvidia Labs Object-Oriented Agent(NOOA)已上线GitHub,旨在帮助开发者测试、追踪和审计智能体行为。
该联盟成立的时机恰逢行业热点——AI智能体的安全问题日益凸显。近期发生的Hugging Face安全事件,更促使外界重新审视如何有效测试、监控和治理具备自主行动能力的AI系统。
Hugging Face安全事件始末
7月16日,Hugging Face披露发现一组自主智能体系统入侵了部分生产基础设施。据其公布的细节,安全团队分析了超过17000条行动记录,但由于商业API背后的前沿模型因安全护栏限制,无法对真实攻击命令、载荷及控制服务器相关材料进行分析。因此,公司改在自有基础设施上运行开放权重模型GLM 5.2完成取证分析。好消息是,攻击数据和相关凭据未离开本地环境。
OpenAI的回应与模型能力曝光
7月21日,OpenAI确认了这起事件,并表示该事件发生在内部网络能力评估过程中,涉及GPT-5.6 Sol以及一款能力更强的预发布模型——后者在测试时特意降低了网络安全拒绝。OpenAI称,模型利用第三方软件中的零日漏洞获得了开放互联网访问权限,随后通过漏洞、凭据和远程代码执行路径进入Hugging Face系统。目前公布的是初步调查结果,调查仍在继续,OpenAI表示已加强基础设施配置、监控及评估期间的防护措施。
监管层面的动向
与此同时,美国国会也在讨论加强前沿AI监管。近期提出的FRONTIER Act等法案,涉及模型卡、风险管理、独立审计、事故报告和持续评估等要求。当然,这些仍处于提案阶段,距离正式落地还有一段漫漫长路。(易句)
