微软发布首个AI安全模型MAI-Cyber-1-Flash,跑分超越Claude和GPT
微软发布安全模型MAI-Cyber-1-Flash,在CyberGym测试中成功率95.95%,超越Claude和GPT。
AI 深度解读
微软CEO纳德拉亲自官宣公司首个网络安全专用AI模型MAI-Cyber-1-Flash,称其在CyberGym基准测试中拿下95.95%的成绩,超过Anthropic、OpenAI同类系统,是安全领域一次高调的秀肌肉。
- 该模型专为网络安全场景训练,接入微软多智能体安全系统MDASH,据称可独立处理约90%的安全任务
- 剩余约10%的复杂任务转交更大、更贵的模型(官方示例为GPT-5.4)处理,形成「小模型分流+大模型兜底」的成本结构
- CyberGym测试中,MAI-Cyber-1-Flash与MDASH组合得95.95%,高于Claude Mythos 5(83.8%)、GPT-5.6 Sol(83.6%)、GPT-5.5 Cyber(85.6%)
- 微软称该组合比此前用GPT-5.4/5.4 Mini/5.3 Codex搭建的MDASH整体成本降低近一半
- 同时推出多智能体系统Perception,持续监测威胁、修补漏洞、关闭新增攻击面,训练数据来自每日超百万亿条安全信号,并经红队与第三方评估
- 这是平台厂商首次用专用小模型正面对标Anthropic、OpenAI的安全能力,若跑分可复现,「垂直安全小模型+通用大模型兜底」可能成为企业级AI安全产品的标配架构,值得关注后续第三方复测结果。
本内容由 AI 生成,仅供参考,请注意甄别