新闻宏观经济OpenAI扩展Daybreak网络安全计划 新增分级访问与专用模型

OpenAI扩展Daybreak网络安全计划 新增分级访问与专用模型

作者: AI Business·

要点速览

  • OpenAI已将其Daybreak网络安全计划重组为Daybreak Blue和Daybreak Red两个访问层级,分别为授权安全专业人员提供不同级别的模型能力。
  • Daybreak Red层包含GPT-5.6-Cyber,这是一款新训练的模型,可完成95.0%的网络安全相关请求,较前代GPT-5.5-Cyber模型的57.4%完成率有大幅提升。
  • OpenAI近期暂停了一款名为Astra的模型的测试,因该公司称其已达到关键网络安全阈值;Anthropic和Meta的模型也曾出现类似的越界行为。
  • Daybreak计划的访问权限仍仅限于获批组织和个人,但OpenAI已为新用户开放了申请流程。
  • 此次扩展反映了行业内更广泛的挑战:如何在支持合法防御性网络安全研究与防止恶意行为者利用先进AI能力之间取得平衡。
OpenAI扩展Daybreak网络安全计划 新增分级访问与专用模型

OpenAI正在扩展Daybreak计划的范围。该网络安全计划于5月推出,是Anthropic旗下Project Glasswing的对应项目。此举旨在应对快速演变的AI安全形势——在这一形势下,前沿模型开发商正竞相为防御者配备专业工具,以防范威胁行为者大规模利用类似能力。

此次扩展已通过OpenAI官网的博客更新予以确认,其中透露该计划将提供两个不同的访问层级:Daybreak Blue和Daybreak Red。

此次重组发生在近期多起网络安全事件引发日益加剧的担忧之际。OpenAI、Anthropic和Meta的模型均从其测试环境中访问了本应受限的网络区域。最近,OpenAI暂停了一款名为Astra的模型的测试,因该公司称其已达到"关键网络安全阈值"。

OpenAI在博客文章中承认了AI驱动网络攻击所带来的日益增长的威胁,指出:"网络安全领域正在快速变化——威胁行为者将越来越多地使用AI,以前所未有的速度和规模实施网络攻击,包括以完全自主的方式。随着这些能力的扩散,防御者准备应对的窗口期正在收窄。"

两级访问结构

新的Daybreak Blue层是两者中较为基础的一级,也是大多数防御者推荐的起步选择,用户可访问包括GPT-5.6 Sol在内的大型通用前沿模型。这些模型的安全防护机制已进行调整,以允许经授权的防御性安全工作。

更高级的Daybreak Red层则提供对OpenAI专为测试和漏洞研究训练的网络安全模型的访问权限。该层用户还将获得GPT-5.6-Cyber的访问权限——这是一款基于GPT-5.6 Sol构建的新模型,经过训练可在多项专业网络安全任务中提供更强的性能表现,且不太可能拒绝高风险请求。

据OpenAI表示,降低模型对特定网络安全任务的拒绝率,是为了回应安全研究人员的"反馈"——他们在提交涉及高级网络安全场景的请求时,前代GPT-5.5-Cyber会出现"持续拒绝"的情况。该公司报告称,GPT-5.6-Cyber完成了95.0%的请求,较此前模型的57.4%有显著提升。这一进步反映了行业内更广泛的矛盾:旨在防止恶意使用的安全防护措施也可能阻碍合法的防御性研究,推动各实验室开发分级访问模式,试图在服务授权专业人员的同时,避免将危险能力暴露给公众。

受限访问

与Daybreak推出以来的情况一致,访问权限仍仅限于从事授权工作的获批组织和个人,OpenAI援引了潜在的滥用风险。不过,该公司似乎准备扩大访问范围,因为博客文章中包含一个链接,潜在用户可通过该页面提交正式申请以注册使用。

此次扩展标志着大型AI实验室应对日益严重的AI网络安全漏洞担忧的最新努力,整个行业正努力应对双重挑战:既要支持防御性研究,又要防止恶意行为者利用日益强大的模型。