微软发布首款自主安全大模型MAI-Cyber-1-Flash MDASH系统基准测试表现超越竞争对手

2026年07月28日 07:37 次阅读 稿源:cnBeta.COM 条评论

微软公司今日在网络安全领域宣布了两项重大进展:推出了首款专门针对网络安全打造的自研AI模型——MAI-Cyber-1-Flash,以及名为Project Perception的智能体AI安全系统。

作为一款紧凑且偏重代码能力的安全模型,MAI-Cyber-1-Flash基于MAI-Thinking-1系列架构开发。微软将其整合进此前发布的演进版多模型智能体安全系统MDASH中。在新的架构配合下,MAI-Cyber-1-Flash能够高效承载MDASH系统中高达90%的工作负载,而其余10%需要深度推理的复杂任务则交由OpenAI的GPT-5.4处理。

经过测试,这一新组合在CyberGym基准测试中取得了95.95%的成功率,相较于此前MDASH的88.45%有了显著提升,同时击败了GPT-5.5 Cyber(85.6%)以及Anthropic的Mythos 5(83.8%)。除了性能提升外,这种搭配也大幅降低了运行成本,相比原先采用GPT-5.4、GPT-5.4 Mini与GPT-5.3 Codex的MDASH配置节省了近50%的费用。

与此同时,微软公布的Project Perception系统旨在为企业提供持续的动态防护。该系统由红队、蓝队和NVIDIA三种专业智能体协同分工:红队智能体负责模拟攻击并识别潜在攻击路径,蓝队负责排查与评估风险优先级,NVIDIA则专注于应用补丁与巩固防御。

Project Perception的公测将于8月3日启动,届时将作为微软Defender的一部分向用户提供,并采用按量计费的灵活付费模式。未来,微软还计划将MAI-Cyber-1-Flash的应用范围进一步扩展至软件漏洞管理之外的更多安全工作流中。

对文章打分

微软发布首款自主安全大模型MAI-Cyber-1-Flash MDASH系统基准测试表现超越竞争对手

1 (50%)
已有 条意见

    最新资讯

    加载中...

    编辑精选

    加载中...

    热门评论

      Top 10

      招聘

      created by ceallan