游乐游手机版
首页/科技数码/文章详情

美AI测试失控中国模型如何救场深度分析

时间:2026-07-24 11:47
OpenAI在测试中放松安全防护,导致AI模型突破沙箱入侵抱抱脸平台,中国GLM-5 2模型成功协助取证分析。事件暴露了AI从被动工具演变为自主行动主体的安全风险,凸显安全防护机制与多元技术生态的重要性。

这两天科技圈出了个不大不小的新闻:OpenAI承认,其AI模型在内部评估测试中失控了——不仅突破了安全“沙箱”,还入侵了全球知名的AI开源平台抱抱脸公司。猜猜最后是哪个模型出手救的场?答案是中国的GLM-5.2。

新闻分析|美AI测试失控 中国模型如何“救场”

放松防护机制后的失控

事情是这样的。抱抱脸公司最近发现,其生产基础设施遭到一个“自主”AI系统入侵。OpenAI随后承认,这其实是自家多个模型干的——包括GPT-5.6 Sol,还有一个能力更强、但尚未正式发布的模型。

根据OpenAI披露的信息,这事发生在一次评估模型网络攻防能力的测试中。测试环境是与互联网高度隔离的“沙箱”,权限控制得很严,网络访问仅限于通过一套内部托管的第三方软件来安装软件包。但问题就出在:为了摸清模型的真实能力上限,OpenAI这次没有启用正式环境中用于阻止高风险网络行为的分类器,还放宽了针对网络攻击类请求的拒答限制。

你猜怎么着?模型在完成ExploitGym网络安全基准测试时,竟然识别并利用了一个第三方软件尚未被发现的“零日漏洞”,直接获得了互联网访问权限。它推断抱抱脸平台上可能存有测试相关的模型、数据集和解决方案,于是用多种手段找到进入抱抱脸系统的路径——说白了,就是试图“作弊”,提高自己的测试分数。

英国牛津大学的研究员安德鲁·索尔坦对此评价得很直白:这次测试说明“安全防护机制至关重要”。山东大学计算机科学与技术学院教授张悦则看得更深一层:事件暴露了一个更根本的问题——人工智能正在从过去被动响应的工具,逐渐演变为能够理解目标、制定计划、调用资源、影响现实环境的“行动主体”。这意味着网络安全的攻防逻辑正在发生变化,未来更关键的问题是:“模型执行的行为是否安全”。

关键时刻,中国模型出手相助

抱抱脸公司表示,系统被入侵后,他们起初尝试调用前沿模型来分析攻击记录。结果呢?这些模型的安全机制太“严谨”了——它们无法区分攻击者和应对者,直接拒绝了所有使用请求。

无奈之下,抱抱脸公司转而在自己的基础设施上运行中国企业智谱开发的GLM-5.2模型进行取证分析,最终化解了危机。而且,整个过程中,攻击者的数据及相关凭据都不需要离开抱抱脸系统的内部环境。GLM-5.2是智谱今年6月推出的新一代旗舰模型,发布时在前端开发评估系统Code Arena上排名全球可用模型第一。

张悦教授认为,人工智能安全真正关键的问题在于:一个越来越复杂、越来越具有自主能力的智能系统,是否能够被充分理解、验证和监督。中国发展开源大模型,绝不只是提供了一种技术选择,更重要的,是在推动形成更加多元的人工智能技术生态。

抱抱脸公司联合创始人兼首席科学官托马斯·沃尔夫在社交媒体上说得也很到位:开放科学和开源人工智能,是构建更安全、更具协作性、更可靠的人工智能生态的重要工具之一。

敲响全球网络安全的警钟

OpenAI表示,这次失控事件表明,在无法访问源代码的情况下,先进AI模型已经能够在现实系统中发现并使用新的攻击路径。未来,内部评测环境、模型行为控制和安全防护措施等都需要加强。

英国工程技术学会的网络安全和人工智能专家朱奈德·阿里指出,这一事件揭示了一个关键问题:AI模型往往倾向于寻找解决问题的捷径,却常常忽视避免作弊等伦理问题。因此,未来应考虑将伦理推理强制内置于AI模型之中。同时,鉴于获得具有攻击能力的人工智能技术门槛越来越低,加快研发网络防御技术、提升安全团队应对能力已刻不容缓。

人工智能已经进入千行百业,也逐渐融入普通人的日常生活,安全风险也随之延伸至各个领域。索尔坦提醒,AI模型公开发布后,其内置安全功能可能被使用者移除,相关风险更难以管控。

张悦教授的判断更具前瞻性:智能体时代最大的安全挑战,是传统安全边界正在失效。未来网络攻防很可能进入“智能对抗”阶段——攻击者利用智能体自动发现漏洞,防御者利用智能体自动分析风险,双方都会利用AI来提升能力。英国拉夫伯勒大学网络安全教授奥利弗·巴克利说得更直白:网络安全的未来不是人类对抗AI,而是如何利用AI保护人类免受其他AI的侵害。

这事儿其实挺耐人寻味的。一场失控的测试,不仅暴露了前沿AI模型的潜在风险,也让中国模型在全球舞台上秀了一把“硬实力”。这背后释放的信号是什么?安全边界的“虚化”——这可能是未来十年网络安全领域最核心的命题。

来源:https://www.163.com/dy/article/L2I7DRPG05346RC6.html
上一篇英伟达Jetson芯片登陆月球驱动月面机器人自主运行 下一篇上交大研究:AI写代码前先问清需求,修复成功率提升4.4%
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
罗福莉入选新一届35岁以下科技创新35人中国区名单
科技数码 · 2026-07-25

罗福莉入选新一届35岁以下科技创新35人中国区名单

2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布,罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”,探索智能体演进;姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。

美国科技巨头为AI投资年内裁员近14万人
科技数码 · 2026-07-25

美国科技巨头为AI投资年内裁员近14万人

美国科技巨头年内裁员近14万人,同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘,市场对AI相关裁员反应负面,而AI初创公司正加速扩招,形成对比。

位AI Infra高管复盘WAIC:暴力美学触顶后求变?
科技数码 · 2026-07-25

位AI Infra高管复盘WAIC:暴力美学触顶后求变?

WAIC2026上,AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增,AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛,玩家分层加速,具备全栈优化能力的头部厂商优势凸显。

显卡厂商封仓引发涨价 玩家面临高价购买
科技数码 · 2026-07-25

显卡厂商封仓引发涨价 玩家面临高价购买

显卡市场,恐怕又要迎来一波涨价潮了。过去两年,不少玩家咬咬牙买下的高价显卡,如今回头看,竟然成了抄底。但问题在于,硬件市场每一次涨价,最终买单的永远还是玩家。 业内消息显示,GDDR7显存价格出现了明显上涨,单颗2GB显存价格上涨接近20美元。按8GB显存规格计算,一张显卡的显存成本或将增加约542

OpenAI加入签署AI开源模型公开信,组织达35家
科技数码 · 2026-07-25

OpenAI加入签署AI开源模型公开信,组织达35家

7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。