新闻股票微软称新网络安全 AI 模型在内部测试中优于 Anthropic

微软称新网络安全 AI 模型在内部测试中优于 Anthropic

作者: Hokanews·

要点速览

  • 微软表示,MDASH 在其内部 CyberGym 网络安全基准测试中获得了 95.95% 的分数。
  • 公司称,MDASH 在同一评估中优于 Anthropic 的 Mythos 5 和 GPT-5.6 Sol。
  • 微软表示,这款新模型的运行成本约为竞争系统的一半。
  • 这些基准结果尚未出现在 CyberGym 的公开排行榜上,也尚未获得独立确认。
  • 这一公告反映出各方在网络安全与企业防御 AI 工具上的竞争正在加剧。
微软称新网络安全 AI 模型在内部测试中优于 Anthropic

微软已宣布推出其首个专用网络安全人工智能模型,称其在内部测试中的表现优于 Anthropic 的 Mythos 模型,同时运行成本约为对方的一半。

公司表示,这款名为 MDASH 的新网络安全模型在 CyberGym 评估基准中取得了 95.95% 的分数,优于据称获得 83.8% 分数的 Anthropic Mythos 5 模型,以及获得 83.6% 分数的 GPT-5.6 Sol。

这一公告凸显出大型科技公司之间日益激烈的竞争,它们都在开发能够抵御越来越复杂网络威胁的 AI 系统,尤其是在企业希望工具能够处理不断增加的告警量、且不显著增加运营负担的背景下。

这一进展受到市场观察人士关注,其中包括经过验证的 X 账号 Coin Bureau。该账号提及了微软关于网络安全 AI 性能的相关说法,以及这一进展对快速扩张的 AI 安全市场可能带来的影响。

不过,据 Decrypt 的报道,这些结果仍基于微软自身的评估,并未出现在 CyberGym 公开可见的排行榜上。该基准结果尚未获得公开的独立验证。

微软将 AI 战略延伸至网络安全

微软进入专门的网络安全 AI 领域,反映出整个行业正转向利用人工智能保护数字基础设施。

随着全球各地组织越来越依赖云计算、联网设备和数字服务,网络攻击也变得愈发复杂。

传统网络安全工具通常依赖预设规则、特征签名和人工分析。尽管这些方法仍然重要,但企业正越来越多地转向能够识别异常模式、分析海量安全数据并更快应对新威胁的 AI 系统。

微软已将人工智能定位为其网络安全战略的核心部分,并将其安全基础设施与先进 AI 模型相结合。

该公司本身已通过面向全球企业和政府机构的产品运营着庞大的网络安全生态系统。推出专门的网络安全模型,意味着微软正进一步将 AI 能力整合进安全运营中。

MDASH 据称取得更高的 CyberGym 分数

据微软称,MDASH 在 CyberGym 基准测试中取得了 95.95% 的分数,领先于若干竞争性 AI 系统。

CyberGym 旨在评估 AI 模型在网络安全相关任务上的表现,包括威胁分析、漏洞识别和问题解决场景。

微软表示,该模型能够以较高准确度完成具有挑战性的安全任务,同时维持较低的运营成本。

公司公布的对比结果显示,MDASH 在测试中优于 Anthropic 的 Mythos 5 和 GPT-5.6 Sol。

这些结果表明,专为特定行业打造的专业 AI 模型,可能能够有效与更广泛的通用系统竞争。

不过,网络安全研究人员通常提醒,基准测试结果应谨慎解读,因为受控测试环境中的表现,并不一定能直接转化为真实世界中的安全运营表现。

微软将自有模型与 OpenAI 技术结合

微软网络安全系统的一大特点是其混合式设计。

相关报道显示,MDASH 将微软自身面向网络安全的模型与 OpenAI 的 GPT-5.4 技术相结合。

据微软称,GPT-5.4 用于最困难的任务部分,约占整体工作负载的 10%。

这一策略使微软能够在大多数网络安全操作中使用专门的 AI 能力,同时在高度复杂的挑战中依赖更先进的通用推理模型。

这种做法反映出 AI 开发中的一种日益明显的趋势,即企业结合多个模型,而非只依赖单一系统。

混合式 AI 架构可通过根据不同模型的优势分配任务来提升效率。对于网络安全应用而言,这有助于企业在速度、准确性和成本之间取得平衡。

成本效率正成为 AI 竞争的关键因素

虽然 AI 性能仍是重点,但成本已成为企业采用中最重要的因素之一。

先进 AI 系统需要大量计算资源,包括高性能处理器、大规模基础设施以及持续维护。

对于部署 AI 网络安全解决方案的企业而言,运营成本会决定一项技术能否在大规模场景中切实可行。

微软称 MDASH 的运行成本只有竞争系统的一半,这凸显出效率在 AI 市场中的重要性日益上升。

企业正越来越倾向于寻找能在不产生过高支出的情况下提供强劲表现的 AI 解决方案。

更低的成本可能让先进网络安全工具惠及更多企业,包括此前缺乏资源部署复杂安全运营的小型公司。

网络安全行业面临不断升级的威胁环境

随着网络威胁变得更频繁且更复杂,对先进网络安全解决方案的需求持续上升。

企业、政府和关键基础设施提供方都面临从勒索软件攻击、数据泄露到高级持续性威胁等多种风险。

攻击者也开始使用人工智能提升自身能力,这在网络防御系统与恶意行为者之间形成了一场技术竞赛。

安全专家警告称,AI 可能让网络攻击更快、更自动化,也更难被发现。

因此,各组织正大力投资 AI 驱动的防御系统,以便更早识别威胁并更有效应对。

微软的网络安全 AI 计划进入了一个未来几年需求预计将显著增长的市场。

来源:Xpost

AI 安全模型可能改变企业防御方式

专门的网络安全 AI 模型的出现,可能改变企业管理数字安全的方式。

安全团队往往要面对海量数据、人员有限以及攻击手段日益复杂等挑战。

AI 系统可以通过自动审查安全告警、识别潜在漏洞并提出应对建议来辅助分析人员。

许多专家认为,AI 工具不会取代人类网络安全专业人士,而是会作为提高生产力的助手发挥作用。

在 AI 支持下,网络安全分析师或许能够更快地调查威胁,并将精力集中在更复杂的战略决策上。

不过,这些系统的有效性将取决于准确性、可靠性、透明度,以及在敏感环境中安全运行的能力。

微软、Anthropic 与 OpenAI 之间的竞争加剧

网络安全 AI 市场正在成为领先人工智能公司之间的又一竞争领域。

微软一方面通过与 OpenAI 的合作大举投资 AI,另一方面也在开发自身的内部 AI 技术。

Anthropic 专注于构建可靠且注重安全的 AI 系统,而其他科技公司也在继续开发面向企业应用的专用模型。

这一竞争反映出 AI 行业的更广泛转变:企业正从通用聊天机器人转向为特定专业领域设计的专用系统。

网络安全被视为 AI 开发中最有价值的领域之一,因为它会直接影响企业、政府和消费者。

独立验证问题仍然存在

尽管微软公布的结果引发关注,但分析人士指出,独立验证仍然十分重要。

据 Decrypt 引述的信息,CyberGym 排行榜在报道时尚未公开列出 MDASH 的分数。

独立基准允许研究人员和用户在一致条件下比较 AI 系统。

在没有外部确认的情况下,这些性能说法应被视为初步结果,直到完成更多测试。

这并不一定会削弱微软这一进展的潜在意义,但它强调了 AI 评估透明度的重要性。

随着竞争加剧,可靠的基准测试将对选择 AI 安全解决方案的企业变得愈发重要。

微软对 AI 驱动安全的更广阔愿景

微软正越来越多地将自己定位为 AI 驱动企业技术领域的领导者。

该公司认为,人工智能可以提高生产力、自动化复杂流程,并增强网络安全防御。

通过云基础设施和安全平台,微软拥有大量数据和运营经验,这些都可能支持先进安全模型的开发。

在各组织寻求更好地抵御不断演变威胁之际,将 AI 整合进网络安全,代表着一个重要的战略机遇。

网络安全 AI 的未来前景

MDASH 这类模型的开发表明,专用 AI 系统可能会在各个专业行业中变得越来越重要。

由于需要处理大量数据分析,网络安全很可能是 AI 最早带来可衡量运营收益的领域之一。

未来的网络安全 AI 系统或许能够持续监控网络、预测潜在攻击,并协助安全团队处理复杂调查。

不过,持续进展将需要对隐私、安全、准确性以及负责任部署给予审慎关注。

企业还需要确保 AI 工具本身不会为关键系统引入新的漏洞。

结论

微软据称在网络安全 AI 方面取得的突破,是其为企业用途构建先进人工智能系统竞争中的又一重要进展。

该公司表示,其 MDASH 模型在 CyberGym 测试中取得 95.95% 的分数,优于 Anthropic 的 Mythos 5 和 GPT-5.6 Sol,同时成本显著更低。

虽然这些结果仍基于微软自身的评估,并且仍需独立验证,但这一公告凸显了 AI 驱动网络安全的快速演进。

随着网络威胁持续扩大,各组织正越来越多地将人工智能视为保护数字基础设施的关键工具。

下一阶段的竞争可能不仅聚焦智能与准确性,也会更加关注可靠性、可负担性以及现实世界中的有效性。