加密新闻

28.07.2026
13:35

微软发布了网络安全AI模型MAI-Cyber-1-Flash,其性能超越了Mythos 5和GPT-5.5-Cyber。

AI-agents ИИ агенты 3

微软在人工智能应用于网络安全领域取得了重大突破,发布了专用模型 MAI-Cyber-1-Flash。该模型已集成到漏洞搜索系统 MDASH 中,据管理层称,其表现优于 Mythos 5 和 GPT-5.5-Cyber 等知名解决方案,同时成本比基于 GPT-5.4、5.4-Mini 和 5.3-Codex 的现有 MDASH 配置低 50%。

关键性能指标来自 CyberGym 基准测试,MAI-Cyber-1-Flash 与 MDASH 的组合取得了令人瞩目的 95.95% 得分。该测试要求 AI 代理在 188 个开源项目中复现 1507 个已知漏洞,评估在受控环境中成功复现错误的比例。相比之下,GPT-5.5 Cyber 得分为 85.6%,Mythos 5 为 83.8%,GPT-5.6 Sol 为 83.6%。值得注意的是,截至发布时,这些数据尚未被纳入公开排名,这凸显了该成就的新颖性和独特性。

image
来源:微软。

MAI-Cyber-1-Flash 的架构基于混合方法:模型自行处理高达 90% 的任务,而最复杂的 10% 则转交给 GPT-5.4。这一方案能显著节省令牌,同时保持高精度。在 MDASH 框架内,部署了超过 100 个专用 AI 代理,每个代理各司其职:从代码审计、验证发现结果的可靠性,到创建概念验证——即一个可运行的示例,用于确认漏洞的存在。

微软首席执行官萨提亚·纳德拉表示,这是该公司优化的 LLM 首次展现出如此高的效率:“与 MDASH 结合使用时,MAI-Cyber-1-Flash 模型以领先模型 50% 的成本提供了世界级的性能。”

在初始阶段,MDASH 通过 Microsoft Security Exposure Management 服务在 Defender 门户上向有限用户开放。客户可以扫描 GitHub 上的代码仓库,分析发现的漏洞(按从“不太可能”到“已确认”进行排序),并使用 Defender CLI 自动生成代码修复方案,随后这些方案将交由开发人员审核。

专家评论:微软此举不仅是技术成就,更是网络安全领域范式转变的信号。比通用模型更便宜、更高效的专用 AI 模型,可能从根本上改变市场,使高质量代码审计对中小企业触手可及。然而,与任何 AI 工具一样,在结果验证阶段保持人工控制至关重要。