新闻宏观经济OpenAI 发布 GPT-6 Astra,称其为其最安全的模型——但仍具危险性

OpenAI 发布 GPT-6 Astra,称其为其最安全的模型——但仍具危险性

作者: AI Business·

要点速览

  • OpenAI 于周四发布 GPT-6 Astra,将其定位为迄今对齐程度最高的模型,具备计算机使用和网络安全能力。
  • 此前一个 OpenAI 智能体入侵 Hugging Face 等平台,导致部署一度暂停,随后 OpenAI 建立了新的评估流程并加强了防护措施。
  • Astra 可处理日常数字工作,包括填写在线表单、更新 CRM 记录、整理日历、开展研究以及起草邮件摘要。
  • OpenAI 承认 Astra 仍具危险性,因为它能发现未知安全漏洞并开发新的利用方式。
  • 分析人士反驳了 Astra 代表 AGI 的说法,称其是提升智能体计算机使用能力的顶级推理模型。
OpenAI 发布 GPT-6 Astra,称其为其最安全的模型——但仍具危险性

OpenAI 发布了备受期待的 GPT-6 Astra 模型,此次发布聚焦计算机使用与网络安全,并内置安全功能。Astra 于周四推出,反映了 AI 模型正日益成为能够识别安全漏洞的“思考引擎”这一更广泛趋势——尽管它们仍带有风险。此次发布正值企业将 AI 智能体从试验性项目推向生产工作流程之际,提高了厂商在自主性、访问控制和滥用防范方面的标准。

OpenAI 对齐程度最高的模型

OpenAI 将 Astra 描述为其迄今对齐程度最高的模型,称其比前代模型更好地理解用户意图和模型行为。用户可以在信任模型判断力的前提下委派任务。据 OpenAI 介绍,Astra 可以填写在线表单、更新 CRM 中的客户记录、整理日历、进行在线研究并起草邮件摘要——这些日常数字工作过去通常需要人工操作或脆弱的自动化脚本。该公司表示,该模型的计算机使用能力可应用于游戏开发、电气工程和知识工作等多个领域。

此前,一个 OpenAI 智能体入侵了 Hugging Face 等平台,OpenAI 因此一度放慢了该模型的部署。作为回应,该 AI 实验室表示基于 Hugging Face 事件建立了新的评估流程,并加强了对模型执行有害网络行为的防护。这一新评估流程的稳健程度如何,将成为行业的关键测试案例,因为竞争对手也面临类似问题:如何安全地授予智能体访问真实系统的权限。

尽管安全性有所提升,OpenAI 也承认,在拥有合适工具和访问权限的情况下,Astra 仍可能是危险的,因为它能找到未知的安全漏洞并开发出新的利用方式。

“从近期的新闻来看,[安全] 一直是他们最大的公关问题之一,”Informa TechTarget 旗下 Omdia 的分析师 Lian Jye Su 表示。“能做到这一点意义重大。”

它是 AGI 吗?

据报道,OpenAI 总裁兼联合创始人 Greg Brockman 曾称 Astra 是通用人工智能(AGI)的开端——即 AI 能像人类一样完成任何智力任务的时点——但 Su 并不认同。

“在现阶段称其为 AGI 有些牵强,”Su 说。“现在称其为最佳推理模型是非常公允的,或者说它正在非常接近人类水平的推理能力。”

Su 认为,为物理设备提供动力的世界模型比 Astra 更接近 AGI。他表示,Astra 的作用在于提升智能体使用计算机的能力。

Agentic AI(智能体 AI)正在快速成熟,从仅通过文本识别提示词的智能体,发展到能够像人类一样解读本地环境并与本地 IT 和软件基础设施交互的智能体。AI 搜索厂商 Perplexity 已通过计算机使用功能实现这一点,Anthropic 也已在其模型中内置了计算机使用能力。OpenAI 似乎正借 Astra 将这一趋势推向更高水平,声称该模型能以速度、准确性和判断力处理复杂任务。

“现在智能体确实拥有了自己的发现机制,”Su 说。“它能独立理解正在发生的事情,并能够做出自己的推理和判断。”

聚焦计算机使用与网络安全

OpenAI 对计算机使用的关注,以及该模型在预判网络风险的同时跨领域执行和委派任务的能力,也标志着 AI 的转变,Tekonyx 创始人兼首席研究官 Sid Nag 表示。

“AI 基础设施正从仅做推理跨越到自主执行,”Nag 说。

他补充说,OpenAI 借 Astra 对网络能力的重视意义重大。该公司表示,该模型可识别零日漏洞,帮助网络防御者发现并修补弱点,同时也带来了对更强防护措施的需求。这种双用途特性——既帮助防御者发现缺陷,也可能帮助攻击者加以利用——正是围绕通用模型应释放多少网络能力的争论核心。

“网络安全本身可能成为第一个 AI 不仅创造防御机制……还创造攻击基础设施的工作负载,”Nag 说。

他指出,传统上,厂商打造的模型擅长推理,但将安全部分留给传统网络安全专家。如今,AI 厂商正更加重视将安全性内置于模型逻辑之中。

这一转变不仅体现在 Astra 上,也体现在 Anthropic 的 Fable 5.1 中。Fable 5.1 被允许在一般使用中进行源代码漏洞发现,但被限制执行漏洞利用生成等任务——即创建利用应用程序弱点软件的过程。

AI 竞赛中的主要竞争对手都在加入这一网络能力要素,随着监管机构和企业安全团队评估这些能力应如何治理,这一趋势值得关注。

来源:AI Business