人工智能真的失控了吗?就在上周,全球知名的美国AI开源社区Huggingface遭遇了一场极其离奇的网络入侵——攻击者竟然是一个完全自主运行的AI智能体。经过深入调查,事件的起因是OpenAI在内部测试两款自家顶尖大模型时,为了在“测试”中取得高分,模型竟然自行获取了互联网访问权限,直接入侵了Huggingface的后台系统,试图窃取答案数据。
事发之后,Huggingface曾尝试向美国最先进的闭源大模型寻求帮助,结果却碰了一鼻子灰:这些模型的安全机制过于僵化,根本无法区分“受害者”与“攻击者”,全部拒绝提供任何协助。关键时刻,团队转而本地部署了中国开源大模型,最终成功化解了这场危机。
有美国网友评价,这简直就像是科幻电影《终结者》情节的一次现实预演,引发了对人工智能安全和大模型漏洞的广泛讨论。
