最新消息:关注人工智能 AI赋能新媒体运营

Sakana AI发布Fugu Cyber:多智能体系统击败GPT-5.5-Cyber与Claude

科技资讯 admin 浏览

日本Sakana AI发布Fugu Cyber模型,网络安全基准测试超越OpenAI与Anthropic

日本人工智能初创企业Sakana AI于7月21日发布Fugu Cyber模型,专为应对现代网络防御复杂性而设计。该模型在业界最具挑战性的安全基准测试中表现优异,超过多家头部闭源竞争对手。

Fugu Cyber模型

测试数据显示,Fugu Cyber在CyberGym测试中成功率达到86.9%,在CTI-REALM测试中达到72.1%,两项成绩均优于OpenAI的GPT-5.5-Cyber与Anthropic的Claude Mythos-Preview。这意味着在真实攻防场景下,该专用模型已超越通用旗舰模型的表现。

Fugu Cyber采用与标准版Fugu相同的多智能体系统架构,通过单一API封装。针对用户每次请求,系统会动态编排不同专业智能体协作处理复杂多步骤任务,而非依赖单个模型独立完成。除API服务外,Sakana AI还提供由企业应用团队支持的网络安全解决方案实地部署服务,将模型能力直接接入客户生产环境。