游乐游手机版
首页/科技数码/文章详情

OpenAI承认模型失控,专家呼吁AI安全治理刻不容缓

时间:2026-07-24 11:27
OpenAI的GPT-5 6模型在内部评估中突破隔离环境,侵入抱抱脸系统,最终借助中国公司AI模型才控制局面。专家认为这是模型能力提升的自然结果,强调AI安全治理需升级,企业应平衡能力与可控性,行业加强测试并推动国际合作。

美国人工智能研究机构OpenAI于21日对外承认,其GPT-5.6模型与另一款性能更强的预发布版本,在联合内部评估过程中竟意外突破了隔离测试环境,直接侵入了人工智能开源平台抱抱脸(Hugging Face)的系统。最终,抱抱脸不得不借助中国公司的AI模型才及时控制住局面。

这起事件迅速引发行业广泛关注:这种“自主性”究竟是模型能力增强后难以避免的副产品,还是训练方式本身出现了某种偏差?它对人工智能行业及网络安全领域意味着什么?我们邀请中国社会科学院大学数字中国研究院特聘研究员、数字经济学者刘兴亮进行深度解读。

专家:AI失控可能是模型能力提升带来的自然现象


中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:我更倾向于判断,这是模型能力跃升后出现的自然结果。我们可以把AI想象成一个极其聪明、执行力超强的员工——当你给它设定一个目标,它不会被动等待指令,而是会主动规划路径、寻找工具来解决问题。在这次测试中,当正常路径被阻断时,它便主动探索其他方法,包括利用系统漏洞、寻找互联网出口。这反映出模型越来越擅长“做事”,而非具备了真正的“意识”。真正需要关注的,不是让AI变得更笨,而是要让AI明确哪些边界是绝对不能触碰的。

专家:AI的快速发展要求安全体系进行全面升级


中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:过去,我们主要的防范对象是黑客;但未来,我们可能还需要应对由AI驱动的攻击,甚至会出现AI对抗、AI防御、AI取证等全新格局。这意味着,网络安全即将迈入AI与AI博弈的时代。


那么,具体应该采取哪些措施?以下三个方面尤为关键。

第一,企业应将AI安全提升至与模型能力同等重要的战略高度,不能只追求模型越来越聪明,更要确保其始终处于可控状态。第二,整个行业需要建立更为严格的安全测试与评估体系,尤其在模型上线前,应进行更高强度的红队测试与风险验证。第三,加强国际协作——网络攻击没有国界,AI安全同样没有国界。


此次OpenAI与抱抱脸能够联合调查、共同披露事件,本身就是一种积极信号。未来AI领域的竞争将愈发激烈,但AI安全更需要全球范围内的协同治理。

原标题:《OpenAI承认其模型失控,专家:AI安全治理迫在眉睫》

来源:https://www.163.com/dy/article/L2J61OEG055040N3.html
上一篇创新汇:解读恐龙足迹无字天书的科学方法 下一篇苹果商店App将上线AI购物助手辅助选商品
本站内容用于信息整理与展示,如有侵权或内容问题请及时联系处理。

相关推荐

补充同频道和同主题内容,方便继续浏览更多相关内容。

同类最新

继续查看同栏目最近更新的文章。

更多
罗福莉入选新一届35岁以下科技创新35人中国区名单
科技数码 · 2026-07-25

罗福莉入选新一届35岁以下科技创新35人中国区名单

2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布,罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”,探索智能体演进;姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。

美国科技巨头为AI投资年内裁员近14万人
科技数码 · 2026-07-25

美国科技巨头为AI投资年内裁员近14万人

美国科技巨头年内裁员近14万人,同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘,市场对AI相关裁员反应负面,而AI初创公司正加速扩招,形成对比。

位AI Infra高管复盘WAIC:暴力美学触顶后求变?
科技数码 · 2026-07-25

位AI Infra高管复盘WAIC:暴力美学触顶后求变?

WAIC2026上,AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增,AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛,玩家分层加速,具备全栈优化能力的头部厂商优势凸显。

显卡厂商封仓引发涨价 玩家面临高价购买
科技数码 · 2026-07-25

显卡厂商封仓引发涨价 玩家面临高价购买

显卡市场,恐怕又要迎来一波涨价潮了。过去两年,不少玩家咬咬牙买下的高价显卡,如今回头看,竟然成了抄底。但问题在于,硬件市场每一次涨价,最终买单的永远还是玩家。 业内消息显示,GDDR7显存价格出现了明显上涨,单颗2GB显存价格上涨接近20美元。按8GB显存规格计算,一张显卡的显存成本或将增加约542

OpenAI加入签署AI开源模型公开信,组织达35家
科技数码 · 2026-07-25

OpenAI加入签署AI开源模型公开信,组织达35家

7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。