7月27日,微软在旧金山举办了一场分量十足的发布会,正式推出其首款专门面向网络安全的自研AI大模型MAI-Cyber-1-Flash,以及配套的代理式安全防御平台Project Perception。微软CEO萨蒂亚·纳德拉亲自官宣,称该模型在加州大学伯克利分校推出的CyberGym基准测试中取得了95.95%的最高成绩,大幅领先Anthropic的Claude Mythos 5(83.8%)、OpenAI的GPT-5.6 Sol(83.6%)和GPT-5.5 Cyber(85.6%)。
MAI-Cyber-1-Flash并非通用大模型的简单微调版本。据微软AI部门首席执行官穆斯塔法·苏莱曼介绍,该模型由微软AI团队从底层专门针对代码分析与网络安全场景进行训练,核心能力是深入复杂代码库,快速精准地定位深层隐藏的系统漏洞。在实际部署中,它被集成到微软的MDASH框架中,作为底层分析引擎,可独立处理约90%的安全任务,仅少数复杂情况需要调用GPT-5.4等更大规模模型。

成本控制是本次发布的一大亮点。苏莱曼表示,他们以50%的成本实现了世界领先的性能。由于MAI-Cyber-1-Flash采用轻量化、特定任务优化的架构,企业处理同等规模安全任务时,运行成本相比传统通用前沿大模型降低约一半。纳德拉在社交平台上写道,通过把专业模型、数据与合适的智能体、工具、安全环境及运行框架结合起来,微软可以进一步改善成本与产出之间的关系。
同步推出的Project Perception平台则代表了微软在AI安全防御架构上的全新思路。该系统采用多智能体协同架构,部署红队、蓝队、绿队三类AI智能体团队。红队负责模拟攻击场景,持续进行渗透测试寻找潜在暴露面;蓝队专注实时检测和分类安全漏洞;绿队在确认漏洞后自动生成修复代码并实施系统加固。三方协同实现了从发现问题到修复闭环的全自动化流程。

Perception首席工程师戴夫·韦斯顿描述了这套系统的效率提升:过去需要安全组织中多位专业人员耗费大量小时手工完成的工作,现在几分钟内就能获得完整的修复方案。不仅能发现问题、排列优先级,还能完成威胁检测、安全态势修复,甚至直接生成代码修复方案。据悉,Perception平台将于8月3日启动公开预览。
微软此次发布的时机颇为微妙。就在发布前一周,OpenAI承认其AI智能体在内部测试中突破沙箱限制,自主入侵了全球最大AI开源社区Hugging Face的生产系统。这一事件被视为AI安全领域的分水岭,证明了前沿模型已具备在无人类指导下自主发起跨公司网络攻击的能力。

微软安全副总裁海耶特·加洛特对此评论道,这件事充分印证面对手握AI工具的恶意攻击者,我们同样需要依靠AI构建防御体系。她强调,网络安全管理人员正在将AI视为降低从业门槛、扩大人才供给的关键工具。目前企业安全运营中心的专业人才仍然严重不足,借助AI可以让更多人员参与到安全运营工作中。
不过MAI-Cyber-1-Flash仍有较大的提升空间。苏莱曼坦言,微软拥有独家的安全数据集,但目前训练模型仅动用了其中不足1%的数据。这意味着随着更多安全数据的接入,模型的性能还有进一步跃升的空间。网络安全业务本身也是微软不可忽视的收入来源——微软上一次披露该业务规模是在2023年,当时年收入已突破200亿美元。
AI网络安全赛道的竞争正在加速升温。Anthropic此前推出了安全平台Mythos,通过Glasswing计划向少数合作伙伴开放;OpenAI也于5月推出Day Break安全解决方案。随着MAI-Cyber-1-Flash的入局,三大AI巨头在安全防御领域的正面交锋正式拉开帷幕。








