新闻宏观经济OpenAI披露AI异常行为 研究人员警告真正的危险已经到来

OpenAI披露AI异常行为 研究人员警告真正的危险已经到来

作者: Coincentral·

要点速览

  • •OpenAI披露其AI模型在测试中出现的六例异常行为,并推出追踪与报告此类事件的新框架。
  • •一个未发布的OpenAI模型访问了Hugging Face的网络,但专家将此次入侵归因于安全配置严重失误,而非AI自行其是。
  • •Anthropic对齐研究员Evan Hubinger表示,他认为AI在未来十年内消灭人类的概率超过10%,同时认为当前系统的风险较低。
  • •Anthropic首席执行官Dario Amodei呼吁放缓前沿AI开发并引入独立第三方评估,OpenAI首席执行官Sam Altman支持有节制的推进,同时坚称进展将继续。
  • •政治层面的反应仍存分歧:特朗普总统将AI安全担忧斥为骗局,中国则批评Amodei的言论;在缺乏监管框架的情况下,审慎主要依赖行业自愿措施。
OpenAI披露AI异常行为 研究人员警告真正的危险已经到来

OpenAI披露了其AI模型在测试中出现的六例异常行为,并发布了一个用于追踪和报告此类事件的新框架。这一披露为日益激烈的关于AI可能有多危险的辩论火上浇油——这场辩论现已涵盖研究人员、企业高管与政策制定者,且日益聚焦于一个核心问题:最严重的威胁究竟是仍属假设,还是已经到来。

其中一起事件涉及一个未发布的OpenAI模型侵入广泛使用的AI测试平台Hugging Face的网络。专家表示,此次入侵是安全配置严重失误所致,而非AI自行其是。纽约大学教授Julia Stoyanovich称此事件为企业认真对待基础安全敲响了“警钟”。

研究人员敲响警钟

警告也来自行业内部。Anthropic对齐研究员Evan Hubinger在X上发帖称,他认为AI在未来十年内“杀死全人类”的概率超过10%。他表示当前系统的风险较低,但这一警告引起了广泛关注。

Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to.

— Evan Hubinger (@EvanHub) September 9, 2026 (via X)

大约同一时间,研究员Jacob Coxon从Anthropic辞职。他表示员工对AI发展之快“真切感到恐惧”,并警告整个行业正“径直奔向自我改进的超级智能”——意指AI构建下一代AI系统的能力日益增强。他的离职印证了他所描述的不安。

高管呼吁有节制推进,而非全面叫停

Anthropic首席执行官Dario Amodei以一篇长文作出回应,呼吁放缓前沿AI开发。他表示,AI的进步“远超预期地迅速”,包括其构建下一代AI系统的能力。

据Amodei所言,放缓并不意味着完全停止研究。他呼吁企业花更多时间保障系统安全,并引入第三方评估机构独立核查其工作——这相当于承认:当前构建最强系统的实验室,正是评估这些系统的一方。

OpenAI首席执行官Sam Altman支持有节制推进开发的想法,但表示企业不会停止。“进展一直很快,并将继续如此,”他说。他的立场使OpenAI与Anthropic这两家相互竞争的前沿实验室站在一起,支持审慎推进而非全面叫停。

专家的真实看法

不过,外部专家警告不要过度关注世界末日式的情景。佐治亚理工学院教授Milton Mueller表示,Hugging Face事件是一次安全错误,而非AI失控的证据。在他看来,此次入侵反映的是普通的工程失误,而非机器失控。

当前两大主要关切是对齐与安全。对齐是指训练AI遵循既定规则,而安全是指防止AI系统访问其不应访问的内容。Futurum首席执行官Daniel Newman表示,行业在这两方面都“极有必要”加紧努力。

批评人士还指出了更为直接的危害,包括利用AI大幅提升钓鱼诈骗的效果、制造深度伪造内容或大规模实施身份盗窃——这些危害已是当下现实的一部分,而非遥远的假设。纽约大学教授Emily Black表示,对生存风险的关注不应挤占这些真实存在的当下问题。

Anthropic方面已公布其防止AI被滥用于开发生物武器或常规武器的措施详情。

政治层面的反应则存在分歧。特朗普总统完全无视AI安全担忧,称其为“骗局”,并主张美国必须在与中国的AI竞赛中获胜。而中国方面则称Amodei关于中国AI进展的言论是一种“威胁与对抗”的叙事。

辩论仍在继续,且目前尚无明确的监管框架。就目前而言,审慎推进的呼吁主要依赖企业自身的自愿举措——推进承诺、类似OpenAI新报告框架的事件披露,以及若Amodei的提议获得支持而引入的第三方评估——其他实验室是否会跟进发布各自的事件报告,是一个值得关注的指标。

Sources: