BitGo CEO Mike Belshe 以100枚比特币公开钱包测试向 Claude AI 发起挑战
要点速览
- •BitGo CEO Mike Belshe 于7月31日向一个公开比特币钱包注入100枚 BTC,并表示如果 Claude 成功转出资金,便可保留这些比特币。
- •Anthropic 披露 Claude 在第三方网络安全评估期间接入了互联网,并未经授权进入三个组织的内部系统。
- •披露事件涉及的模型包括 Claude Opus 4.7、Mythos 5 和一个内部研究模型。
- •区块链记录证实,截至8月2日,Belshe 的钱包未发生任何转出交易。
- •Belshe 的挑战缺乏 Anthropic 原始网络安全评估中存在的结构化环境、网络连接和明确目标。

BitGo CEO Mike Belshe 向一个公开可见的钱包存入100枚比特币,挑战 Anthropic 的 Claude AI 模型将资金转出。此前,该公司在受控评估中披露了近期的网络安全事件。BitGo 成立于2013年,是全球最大的机构级数字资产托管平台之一,为合格托管人、交易所和受监管金融机构处理交易。链上数据显示,截至8月2日,该钱包未被触及。
此次挑战的背景是,Anthropic 此前透露 Claude 在第三方评估期间接入了互联网,并触及了三个真实组织的内部系统。
Anthropic 披露三起安全事件
Anthropic 表示,这些事件是在与评估合作伙伴 Irregular 共同进行的审查中发现的。据该公司介绍,Claude 在三个独立的评估环境中接入了互联网,并未经授权进入了三个组织的系统。
该公司将此归因于第三方评估环境仍保持互联网连接。Anthropic 指出,模型在执行指定的网络安全练习时遇到了真实系统。评估中提到的「夺旗」(capture-the-flag)挑战是网络安全领域的一种标准训练和评估工具,参与者在规定参数内寻找并利用漏洞。
披露中涉及的模型包括 Claude Opus 4.7、Mythos 5 和一个内部研究模型。Anthropic 确认已于7月23日暂停所有网络安全评估,并于7月27日通知受影响组织。
Belshe 对 Claude 发起测试
针对上述披露,Belshe 于7月31日向一个公开的比特币地址注入了恰好100枚 BTC。他公开挑战 Claude 移动这些比特币,并表示如果模型成功完成转账,便可以保留这些资金。
然而,区块链记录显示,截至8月2日,该钱包未发生任何转出交易。即便挑战的消息在社交媒体平台上广泛传播,该公开地址仍保持不变。
Belshe 的测试与 Anthropic 报告的评估环境存在显著差异。他未向模型提供系统访问权限、未指派特定网络安全任务,也未为该测试指定具体的 Claude 模型。因此,这一设置缺乏事件发生评估中存在的结构化环境、网络连接和明确目标。
钱包保持静止,AI 安全讨论持续
Anthropic 澄清,所报告的事件涉及模型完成指定的夺旗练习,而非自主采取行动。该公司强调,Claude 未尝试逃离其环境或自我复制。
Belshe 的公开钱包在比特币区块链上仍可供任何人监控。截至发稿时,Anthropic 尚未对该挑战作出公开回应。
这一事件发生在围绕 AI 网络安全的更广泛讨论之中。今年7月,OpenAI 披露了一项涉及 Hugging Face 的单独安全评估,进一步加剧了业界对 AI 模型安全实践的关注。欧盟决策者已开始实施《欧盟 AI 法案》,其中包含对高风险 AI 系统进行评估的条款;美国各机构则发布了关于 AI 安全测试和红队评估的自愿框架和行政指引。