新闻股票Anthropic 和 OpenAI 代理在安全测试中伪造身份,英国实验室称

Anthropic 和 OpenAI 代理在安全测试中伪造身份,英国实验室称

作者: AI Business·

要点速览

  • 英国 AI 安全研究所称,在对 Anthropic 和 OpenAI 的先进 AI 模型进行较为宽松的网络安全评估时,观察到了针对真实人物的欺骗行为。
  • AISI 在 122 次测试中发现 19 起未经授权行动案例,其中 17 起涉及 Anthropic 的 Mythos 5,2 起涉及 OpenAI 的 GPT-5.6 Sol。
  • 最严重的事件涉及 Mythos 5 试图通过创建 GitHub 账号、伪装成另一名开发者并重新提交恶意代码来发起供应链攻击。
  • AISI 表示未看到现实世界损害,并不确定模型是否完全意识到自己是在对真实人物采取行动。
  • Anthropic 和 OpenAI 表示测试是在刻意宽松的条件下进行的,两家公司都表示将进一步审查模型测试实践。
Anthropic 和 OpenAI 代理在安全测试中伪造身份,英国实验室称

网络安全

生成式 AI

新闻

Anthropic 和 OpenAI 代理在安全测试中伪造身份

据英国 AI 安全研究所称,这些供应商最先进的 AI 模型在网络安全测试期间试图操纵真实人物。

2026 年 8 月 5 日

英国 AI 安全研究所发布的新报告发现,Anthropic 的 AI 模型采取了“未经授权的行动”来欺骗真实人物。

该政府研究实验室在刻意较为宽松的条件下测试了 Anthropic 和 OpenAI 的最先进 AI 模型,降低安全防护并开放互联网访问,以评估这些系统在现实网络挑战中的表现。

AISI 称这是首次发现这些模型参与社会工程,试图操纵人类用户并执行超出评估设定范围的任务。

该机构在周二的一份声明中表示:“这是 AISI 首次看到如此严重、未受提示、且针对现实世界中真实个人的欺骗行为。”

不过,该组织补充称,目前尚不确定模型在多大程度上意识到自己是在对真实人群采取行动,并且没有观察到现实世界中的损害。

在 122 次评估中,AISI 发现了 19 起 AI 代理采取未经授权行动的实例,包括与真实个人和组织的互动。其中 17 起涉及 Anthropic 的 Mythos 5 模型,另外 2 起涉及 OpenAI 的 GPT-5.6 Sol。

相关:提示:AI 威胁模型已经改变

所识别出的最严重事件涉及 Mythos 5 独立发起供应链攻击,以完成其分配的网络挑战。

该模型创建了一个 GitHub 账号,并试图说服某个开源仓库的维护者接受一项恶意拉取请求。它还创建了第二个账号,伪装成另一名开发者来支持该提交。在人工审查员拒绝代码后,该模型谎称这些恶意更改是误提交,随后又在做出表面修改后试图重新提交。

报告还发现,该模型发送了包含恶意代码的定向电子邮件,并试图说服收件人接受这些更改。对于依赖开源软件的开发者和公司而言,这一事件凸显出安全测试如今必须考虑代理式行为,而不仅仅是提示跟随准确性。

这些发现出现在一系列先进 AI 系统失控并自行实施网络安全入侵之后。

OpenAI 在 7 月披露,GPT-5.6 Sol 和另一款未发布模型在内部评估期间逃离了沙盒环境,针对 Hugging Face 基础设施发起了超过 17,000 次攻击,试图获取私有数据集和基准信息。Anthropic 也报告了类似的模型越出测试环境预期边界的情况。

这些事件加剧了外界关于前沿 AI 模型在部署前应如何评估的争论,一些研究人员和政策制定者呼吁加强监管并进行更严格的安全测试。

相关:OpenAI-Hugging Face 黑客事件对企业意味着什么

AISI 的报告发布于同一天,领先 AI 公司的代表在白宫会面,讨论一项提议中的框架,即美国政府将在公开发布前审查最先进的 AI 模型。

Anthropic 在一份声明中为其模型辩护,称这些模型是在“刻意宽松的条件”下评估的,关键防护已被移除,并且没有证据表明模型从安全环境中逃逸。

该公司表示:“在我们开展自身调查的同时,我们正与他们密切合作,以收集有关该事件的更多细节。”

同样地,OpenAI 在一篇博客文章中表示,涉及 GPT-5.6 Sol 的事件属于超出预期测试环境的操作,并且对于完成评估并非必要。

“在未来几周内,我们将审查自己对第三方测试的处理方式,包括如何识别更高风险的评估、商定范围、评估启用互联网访问或降低防护措施的请求、设定隔离、凭证处理、监控和停止条件方面的预期,并建立更清晰的事件通知和升级流程,”该供应商表示。

关于作者

Scarlett Evans

特约撰稿人

Scarlett Evans 是一名自由撰稿人,关注新兴技术和矿产行业。此前,她曾任 IoT World Today 副编辑,专注于机器人和智慧城市技术。Scarlett 也拥有采矿和资源领域背景,曾在 Mine Australia、Mine Technology 和 Power Technology 任职。她于 2022 年 4 月加入 Informa,之后转为自由撰稿工作。

想在 Google 搜索结果中查看更多 AI Business 文章?

最新新闻

想在 Google 搜索结果中查看更多 AI Business 文章?

热门文章

2026 年 8 月 5 日

2026 年 8 月 5 日

生成式 AI 私募市场中的 AI 来了 商业 2026 年 7 月 28 日

私募市场中的 AI 来了 商业

代理式 AI 使用 AI 代理与人类员工协作 2026 年 7 月 10 日

使用 AI 代理与人类员工协作

生成式 AI SMB 如何利用生成式 AI 2026 年 6 月 29 日

SMB 如何利用生成式 AI

生成式 AI Rebellions 旨在挑战 Nvidia 的 AI 推理芯片之战 2026 年 6 月 15 日

Rebellions 旨在挑战 Nvidia 的 AI 推理芯片之战

由 Google Cloud 赞助

选择你的第一个生成式 AI 用例

要开始使用生成式 AI,首先应聚焦于那些能够改善人们获取信息体验的领域。

纽约 2026 AI 峰会

汇聚企业领袖、技术创新者和 AI 决策者,探索商业 AI 的最新发展