最近AI行业有件事很值得关注。估值已超过OpenAI的美国人工智能公司Anthropic,前不久刚推出号称“有史以来最强”的大模型Mythos Preview。可没过多久,他们又主动宣布要把这个“最强模型”暂时“封存”,给出的理由居然是——它太强了。
这件事要从Mythos发布之后说起。当时,Anthropic联合美国多家科技巨头与机构,启动了一项名为“Glasswing”的网络安全合作计划。简单来说,就是将Mythos这件“超级工具”开放给合作伙伴,用来帮助排查和挖掘各自系统中的安全漏洞。
如今,这个项目迎来了新进展。Anthropic公开表示,虽然内部测试已经证明,新一代安全基座模型Claude Mythos Preview在漏洞挖掘、网络安全和攻防测试方面表现惊人,但在研发出更完善、更高效的安全对齐机制之前,公司将无限期禁止向公众和商业市场开放Mythos级别的模型。
那么,它的效果到底有多强?根据官方披露的数据,在向合作伙伴开放的一个多月时间里,Mythos已经在多个行业场景中扫描并发现了至少10000个高危或严重级别漏洞。这样的漏洞挖掘效率,据称达到以往方案的10倍以上。
不过,问题也随之出现。虽然漏洞发现速度大幅提升,但企业和行业修复漏洞的节奏却很难同步跟上。以至于不少公司和组织反过来请求Anthropic,能否让Mythos“找得慢一点”,给他们预留更多安全修补和系统加固的时间。
实际上,Anthropic这段时间已经多次释放信号,暗示正因为Mythos能力过于强大,他们才不敢将其面向公众开放。为此,公司甚至多次强调AI可能带来的“生存风险”与潜在安全威胁。
就在日前伦敦举行的一次会议上,Anthropic联合创始人Jack Clark也公开发出警告,称AI存在“非零概率”导致人类灭绝的可能。他进一步表示,到2028年,AI或许就能实现“自我进化”,也就是在无需人类参与的情况下自行训练和持续提升,这将带来难以预测的变化。
“AI可能威胁人类生存”这样的说法,在美国AI圈其实并不新鲜。即便是OpenAI和Anthropic这两家,再加上马斯克所在阵营,这些目前最受关注、技术实力领先的玩家,也一直热衷于传播类似观点。他们一方面不断警示人工智能可能带来的终极风险,另一方面又持续强调自家大模型的强大能力以及对AI安全的重视。
这种传播策略,也引发过不少质疑和批评。比如英伟达CEO黄仁勋最近就曾表示,有些CEO会产生“上帝情结”,觉得自己无所不能、无所不知。用这句话来评价这类现象,可以说相当贴切。
光环之下:Mythos的真实面貌
抛开宣传与市场话术,单看Mythos大模型本身。在网络安全漏洞检测和漏洞挖掘方面,它的能力确实已经得到一定验证。不过,也有实际体验过的网友提到,这个模型运行速度“太慢”,并不适合高频日常使用,甚至在代码生成和编程辅助方面也不算出色。
此外,Anthropic对Mythos的具体参数规模始终保持高度保密。业界普遍猜测,它可能是一个参数量达到10万亿级别的超大规模模型。如此庞大的AI模型,不仅训练成本非常高,部署与运维难度也极大。从商业化落地和市场应用的角度来看,这样的产品本身就谈不上“亲民”。
因此综合来看,Anthropic此时高调表示因为Mythos“太强”“太危险”而选择将其无限期封存,其中的商业层面考量,或许要多于纯粹的技术恐惧。如果Mythos真是一款既能高效发现漏洞、又能顺畅商用并持续盈利的“完美产品”,那么他们做出这一决定的可能性,恐怕就很值得打上一个大大的问号了。

