游乐游手机版
首页/AI热点日报/热点详情

日本Sakana AI发布Fugu Cyber多智能体系统,成功击败顶尖GPT-5.5与Claude大模型

类型:热点整理2026-07-22
日本SakanaAI推出FuguCyber多智能体系统,在CyberGym和CTI-REALM测试中准确率达86 9%和72 1%,超越GPT-5 5-Cyber及ClaudeMythos-Preview。该系统集成多个安全专长智能体,摒弃单一大模型,实现高效协同。

网络安全领域,正迎来一场由新型作战单元驱动的深层变革。2025年7月21日,日本人工智能初创企业Sakana AI正式发布Fugu Cyber模型——该模型专为破解当代网络防御中那些复杂度极高、令人棘手的难题而设计。在业内公认最具挑战性的安全评估基准上,这一模型的性能表现,甚至超越了主流闭源竞品,展现出强大的网络安全AI模型实力。

具体表现如何?在CyberGym基准测试中,Fugu Cyber取得了86.9%的任务完成率;在CTI-REALM测试中,准确率也达到72.1%。这两项数据,均领先于OpenAI最新发布的GPT-5.5-Cyber以及Anthropic推出的Claude Mythos-Preview。换言之,在高度拟真、充满对抗性的实战化攻防环境里,这家新兴企业的垂直领域大模型,已经实现了对通用型顶级模型的反超,凸显了其在攻防对抗中的独特优势。

其技术优势,根植于一套独特的系统架构。延续基础版Fugu的设计哲学,Fugu Cyber本质上是一个集成于单一API接口内的多智能体协同系统。当用户发起一次输入请求,系统会实时调度并组合多个具备特定安全专长的智能体,它们分工协作,共同完成那些需要多阶段推理与执行的复杂任务。这彻底摒弃了传统单一大模型“单打独斗”的低效范式。除了标准化API,Sakana AI还提供由企业级安全应用团队全程护航的落地部署服务,确保模型能力能够无缝嵌入客户的真实业务系统与生产网络环境,从而加速网络安全AI的落地应用。

来源:https://www.php.cn/faq/2865137.html?uid=1246273

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。