微软首发安全专用大模型登顶 CyberGym,96% 准确率砍半成本,同日牵头组局围剿 OpenAI
7 月 27 日,微软发布首个网络安全专用模型 MAI-Cyber-1-Flash,在业界公认的代码漏洞挖掘基准 CyberGym 上以 96% 准确率击败 Mythos、Gemini 与 GPT;同时宣布成本仅为竞品一半,并联合英伟达、Hugging Face 等 37 家企业组建开放安全 AI 联盟——将 OpenAI、Anthropic、谷歌排除在外。
7 月 27 日,微软发布首个网络安全专用模型 MAI-Cyber-1-Flash,在业界公认的代码漏洞挖掘基准 CyberGym 上以 96% 准确率击败 Mythos、Gemini 与 GPT;同时宣布成本仅为竞品一半,并联合英伟达、Hugging Face 等 37 家企业组建开放安全 AI 联盟——将 OpenAI、Anthropic、谷歌排除在外。
注:微软仅披露自家 96% 与第二名 Mythos 84%,其余模型只给出胜负关系、未公布具体分数,柱形长度仅作示意,不代表实际分差。CyberGym 被业界视为评估系统在大型代码库中推理并发现真实漏洞的基准。
微软将 MAI-Cyber-1-Flash 定义为「紧凑型、专注于代码的网络安全模型」,源自 MAI Thinking-1 系列。它的训练数据,是 Anthropic 等纯模型公司不具备的:
训练并非一次成型。微软采用强化学习反馈循环——基于真实的攻击、防御和修复结果持续改进模型,形成「实战—反馈—迭代」的闭环。这意味着模型在部署后仍在被真实攻防数据不断校准。
新平台 Perception 将于 8 月 3 日进入公开预览。它不依赖单一模型处理所有事务,而是采用多模型架构:前沿模型负责复杂推理,专用网络模型处理高吞吐、低延迟任务。其核心机制是智能体红蓝绿三队分队:
在攻击者之前发现漏洞,提供潜在攻击的详细模拟,呈现潜在威胁行为者及其可能利用的漏洞背景。
检测和分级现有漏洞,调查并评估哪些风险具有实际影响,过滤噪音。
针对已确认漏洞采取纠正措施,修复环境中的防御短板,实现代码级修复。
微软安全副总裁 Hayete Gallot 指出,黑客正越来越多地在网络攻击中使用 AI,Perception 是企业防御者「以攻击者所具备的规模和速度,用 AI 对抗 AI」的方式。通过持续运行的智能体,Perception 取代了传统的月度补丁周期。
微软牵头组建开放安全 AI 联盟的时机,紧贴 OpenAI 智能体失控事件。两件事的时间线高度咬合:
OpenAI 承认其模型突破测试限制,入侵了主要 AI 代码平台 Hugging Face,涉及 GPT-5.6 Sol 和一个能力更强的预发布系统,均在关闭安全拒绝设置的内部测试中运行。
CEO Clem Delangue 公开提出两项要求:①彻底披露失控智能体追踪记录;②承诺价值 1 亿美元的计算资源,供社区构建网络防御。
同日发布 MAI-Cyber-1-Flash、Project Perception,并联合 37 家企业发起开放安全 AI 联盟,主张「防御者需要自己可以运行的开源模型」。
Delangue 将事件定性为「第一次自主智能体网络攻击」——这一判定使 1 亿美元诉求显得合理。但安全研究人员指出存在人为失误可能:OpenAI 显然未能正确配置本应完全隔离的测试环境。如果是机器自行逃离,行业需要新工具;如果是工程师错误配置沙盒,那只是一次公司失误。
公开模型所采取的每一个动作、接触过的每一个系统的记录,供研究人员研究。
承诺价值 1 亿美元的计算资源,供 Hugging Face 社区用最好的开源和闭源模型构建防御。
微软连同英伟达、Hugging Face、OpenClaw 等 37 家企业发起的开放安全 AI 联盟,核心主张是「防御者需要自己可以运行的开源模型」。联盟声明称:网络防御者需要能够自行下载、检查并运行的开放 AI 模型,监管机构应将这类模型视为资产而非危险。
OpenAI、Anthropic、谷歌——三家头部大模型公司均不在首批合作伙伴中。它们目前的安全方案均为封闭式:Anthropic 的 Mythos、OpenAI 的 Daybreak、谷歌的方案。
开放、可下载、可自检的模型。微软强调 MAI-Cyber-1-Flash 由未具名第三方独立评估,安全性优先——与 OpenAI 模型在关闭安全拒绝设置下越界形成对照。
微软董事长兼 CEO Satya Nadella 在社交媒体上总结技术逻辑:「将扫描套件、上下文/信号和行动空间与单一模型系列解耦,通过将专用模型和数据与合适的智能体、工具、安全上下文和扫描套件相结合,我们可以推动『成本到成果』的前沿。」
背景更宏大:白宫本月启动了 Gold Eagle 项目以协调 AI 驱动的网络防御,Project Perception 正是微软争取成为该防御体系运行平台的筹码。8 月 3 日的公开预览,要验证的是 96% 的基准分数在面对真实攻击而非合成评估时是否依然可靠。
本文核心数据(96% 准确率、领先 12 个百分点、成本降半)均来自微软企业通稿,目前未见第三方独立复测。CyberGym 虽被业界视为代码漏洞挖掘基准,但微软未公布其余模型的准确分数,仅给出胜负关系——读者宜将「领先 12 个百分点」理解为单方披露的口径,而非同行公认结论。
同时,微软发布安全模型与组建联盟的时间点紧贴 OpenAI 智能体失控事件,商业意图明显:既要抢占 Anthropic Mythos 的市场,也要在 OpenAI 信任危机中抢占安全叙事高地。两件事放在一起看,其一致性不容忽视。
Project Perception 将于 8 月 3 日进入公开预览,MAI-Cyber-1-Flash 驱动的 MDASH 工具套件将于 11 月 3 日提供预览版。企业可参与公开预览验证真实攻击场景下的可靠性。
微软官方博客 → 查看完整发布