微软发布首个AI安全模型MAI-Cyber-1-Flash,跑分超越Claude和GPT

📡 IT之家2026-07-28 08:59

微软发布安全模型MAI-Cyber-1-Flash,在CyberGym测试中成功率95.95%,超越Claude和GPT。

AI 深度解读

微软CEO纳德拉亲自官宣公司首个网络安全专用AI模型MAI-Cyber-1-Flash,称其在CyberGym基准测试中拿下95.95%的成绩,超过Anthropic、OpenAI同类系统,是安全领域一次高调的秀肌肉。

  • 该模型专为网络安全场景训练,接入微软多智能体安全系统MDASH,据称可独立处理约90%的安全任务
  • 剩余约10%的复杂任务转交更大、更贵的模型(官方示例为GPT-5.4)处理,形成「小模型分流+大模型兜底」的成本结构
  • CyberGym测试中,MAI-Cyber-1-Flash与MDASH组合得95.95%,高于Claude Mythos 5(83.8%)、GPT-5.6 Sol(83.6%)、GPT-5.5 Cyber(85.6%)
  • 微软称该组合比此前用GPT-5.4/5.4 Mini/5.3 Codex搭建的MDASH整体成本降低近一半
  • 同时推出多智能体系统Perception,持续监测威胁、修补漏洞、关闭新增攻击面,训练数据来自每日超百万亿条安全信号,并经红队与第三方评估
  • 这是平台厂商首次用专用小模型正面对标Anthropic、OpenAI的安全能力,若跑分可复现,「垂直安全小模型+通用大模型兜底」可能成为企业级AI安全产品的标配架构,值得关注后续第三方复测结果。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com