网络安全领域,正迎来一场由新型作战单元驱动的深层变革。2025年7月21日,日本人工智能初创企业Sakana AI正式发布Fugu Cyber模型——该模型专为破解当代网络防御中那些复杂度极高、令人棘手的难题而设计。在业内公认最具挑战性的安全评估基准上,这一模型的性能表现,甚至超越了主流闭源竞品,展现出强大的网络安全AI模型实力。

具体表现如何?在CyberGym基准测试中,Fugu Cyber取得了86.9%的任务完成率;在CTI-REALM测试中,准确率也达到72.1%。这两项数据,均领先于OpenAI最新发布的GPT-5.5-Cyber以及Anthropic推出的Claude Mythos-Preview。换言之,在高度拟真、充满对抗性的实战化攻防环境里,这家新兴企业的垂直领域大模型,已经实现了对通用型顶级模型的反超,凸显了其在攻防对抗中的独特优势。
其技术优势,根植于一套独特的系统架构。延续基础版Fugu的设计哲学,Fugu Cyber本质上是一个集成于单一API接口内的多智能体协同系统。当用户发起一次输入请求,系统会实时调度并组合多个具备特定安全专长的智能体,它们分工协作,共同完成那些需要多阶段推理与执行的复杂任务。这彻底摒弃了传统单一大模型“单打独斗”的低效范式。除了标准化API,Sakana AI还提供由企业级安全应用团队全程护航的落地部署服务,确保模型能力能够无缝嵌入客户的真实业务系统与生产网络环境,从而加速网络安全AI的落地应用。
