Sakana AI发布网络安全模型Fugu Cyber,基准测试超越GPT-5.5-Cyber
Sakana AI发布网络安全模型Fugu Cyber,在基准测试中表现优于GPT-5.5-Cyber。
AI 深度解读
日本 Sakana AI 发布网络安全模型 Fugu Cyber,在多项基准测试中超越 GPT-5.5-Cyber 和 Claude Mythos-Preview。
- Fugu Cyber 是一个多智能体系统,封装为单一 API,可动态编排专业智能体处理复杂多步骤安全任务。
- 在 CyberGym 基准测试中成功率达 86.9%,CTI-REALM 测试成功率达 72.1%,表现优于 OpenAI 和 Anthropic 的专用模型。
- 除 API 外,还提供由企业团队支持的实地部署服务,面向现代网络防御场景。
- 模型专为网络安全设计,可应对威胁检测、漏洞分析等任务。
- 影响/看点:Fugu Cyber 证明了专用小模型在特定领域可以超越通用大模型,为 AI 在网络安全领域的落地提供了高效、精准的解决方案。
本内容由 AI 生成,仅供参考,请注意甄别