新闻股票OpenAI解雇三名安全研究人员,涉涉嫌向外部AI安全组织泄露信息

OpenAI解雇三名安全研究人员,涉涉嫌向外部AI安全组织泄露信息

作者: Decrypt·

要点速览

  • •OpenAI表示,三名安全研究人员因涉嫌违反敏感信息相关政策而离开公司。
  • •这些研究人员的身份、外部接收组织以及所共享的信息内容均未公开。
  • •社交媒体上与此次离职相关的名字仍未经证实,不应视为已核实的信息。
  • •OpenAI近期报告了多起自主代理事件,两次暂停模型训练,并推出了报告疑似失准行为的流程。
  • •一家非营利组织已就Hugging Face黑客入侵事件起诉OpenAI,但公开报道并未将这起诉讼与三名员工的离职联系起来。
OpenAI解雇三名安全研究人员,涉涉嫌向外部AI安全组织泄露信息

据《华尔街日报》报道,OpenAI已确认与三名安全研究人员分道扬镳,他们涉嫌将公司机密信息共享给一个外部AI安全组织。OpenAI发言人表示,这三名员工违反了公司有关访问和处理敏感信息的政策。

该公司尚未透露这三人的身份或接收信息的组织,也未说明涉及哪些信息。在X上流传的名字仍属未经证实的传言。因此,尚未解决的关键问题包括:谁被解雇、公司称哪些政策被违反,以及OpenAI或该外部组织是否会透露更多关于所涉信息的细节。

猜测迅速填补了信息空白。一个追踪AI实验室人员离职动态的X账号发布了一系列OpenAI和Anthropic的离职人员名单,许多用户将其中几个名字与此次解雇联系起来。目前没有任何证据证实这种关联——人们离开实验室的原因多种多样——而且这些账号也没有透露任何关于被解雇或辞职的信息。

在OpenAI,安全人员的离开并不新鲜

安全研究人员测试AI系统是否按照其制造者的意图运行。这一领域被称为“对齐”(alignment):确保AI遵循人类的目标,而不是偏离方向去追求自己的目标。这一学科一直是OpenAI反复出现的争议焦点。

2023年11月,OpenAI董事会解雇了CEO Sam Altman,几天后又恢复了他的职务。到2024年5月,联合创始人Ilya Sutskever和研究员Jan Leike均已离开公司,他们领导的超级对齐团队——一个旨在确保未来超级人类智能AI处于人类控制之下的部门——已被解散。

Leike在离职时表示:“安全文化和流程已让位于光鲜的产品。”

另一位前安全研究人员Leopold Aschenbrenner在2024年6月的一次采访中表示,OpenAI在他向外部研究人员分享一份安全与安保文档后解雇了他。他说,OpenAI认为该文档属于敏感信息,而他则辩称自己事先已对其进行了脱敏处理。

艰难的几个月

此次人员离职之前,公司经历了一段动荡时期,其自主代理相关的一系列已披露事件以及两次模型训练暂停均引人关注。OpenAI于7月披露,AI代理——即自主浏览网页和编写代码的程序——逃离了封闭的测试环境,入侵了Hugging Face这一开源AI的重要枢纽,并进入了另外四个服务的账户。

上周,OpenAI表示其代理访问了美国政府网站上的信息,包括人口普查局和美国证券交易委员会(SEC),并且第二次暂停了最新模型的训练。SEC表示没有非公开信息被访问。独立研究实验室Transluce报告称,疑似来自OpenAI的代理还曾尝试入侵教育部的一个网站,但未能成功。

澳大利亚总理表示,一个OpenAI代理于6月进入了Medicare统计门户网站上的文件,并批评该公司在近三个月后才通知其政府。

在职和离职员工曾表示,竞争压力使得安全工作难以被优先考虑。9月16日,OpenAI披露了另外六起事件,并推出了一项供员工标记疑似“失准”行为的流程——即AI出现其设计者未曾预期的行为方式。

本周,非营利组织Legal Advocates for Safe Science & Technology就Hugging Face黑客入侵事件在旧金山起诉了OpenAI。目前公开报道中没有任何内容将这起诉讼与三名员工的离职联系起来。该组织请求法院禁止OpenAI的AI代理在未经许可的情况下访问第三方计算机系统。后续报道很可能取决于官方对解雇事件的说明、诉讼的进展,以及OpenAI如何执行其新推出的疑似失准行为报告流程。