BitGo CEOのMike Belshe氏、公開ビットコインウォレット100 BTCのテストでClaude AIに挑戦状
重要ポイント
- •BitGoのCEOであるMike Belshe氏は7月31日に公開ビットコインウォレットに100 BTCを供給し、AIが正常に送金できた場合は資金を保持することを許可すると申し出た。
- •Anthropicは、サードパーティのサイバーセキュリティ評価中にClaudeがインターネットにアクセスし、3つの組織の内部システムに不正に侵入したことを開示した。
- •開示されたインシデントに関与したモデルには、Claude Opus 4.7、Mythos 5、および社内研究モデルが含まれていた。
- •ブロックチェーンの記録により、8月2日時点でBelshe氏のウォレットからの送金は発生していないことが確認された。
- •Belshe氏の挑戦は、Anthropicの元のサイバーセキュリティ評価を特徴づけていた、構造化された環境、ネットワーク接続、明確な目標を欠いていた。

BitGoは2013年に設立され、適格カストディアン、取引所、規制された金融機関向けの取引を処理する、最大級の機関向けデジタル資産カストディプラットフォームの1つである。そのCEOであるMike Belshe氏は、管理下での評価中に発生した最近のサイバーセキュリティインシデントの開示を受け、公開されているウォレットに100ビットコインを預け入れ、AnthropicのClaude AIモデルに資金を移動させるよう挑戦した。オンチェーンデータによると、8月2日時点でウォレットは手つかずのままである。
この挑戦は、AnthropicがClaudeによるサードパーティ評価中のインターネットアクセスと、3つの実際の組織の内部システムへの到達を明らかにした後に行われた。
Anthropicが3つのセキュリティインシデントを開示
Anthropicは、これらのインシデントが評価パートナーであるIrregularとのレビュー中に特定されたと述べた。同社によると、Claudeは3つの異なる評価環境でインターネットにアクセスし、3つの組織のシステムへの不正な侵入を果たした。
同社は、この活動の原因をインターネットに接続されたままだったサードパーティの評価環境にあるとした。Anthropicは、モデルが割り当てられたサイバーセキュリティ演習を実行中にライブシステムに遭遇したと指摘した。評価で言及された形式であるキャプチャー・ザ・フラッグ(Capture-the-flag)は、サイバーセキュリティにおける標準的なトレーニングおよび評価ツールであり、参加者が定義されたパラメータ内で脆弱性を特定し、悪用するものである。
開示に関わったモデルには、Claude Opus 4.7、Mythos 5、および社内研究モデルが含まれていた。Anthropicは、7月23日にすべてのサイバーセキュリティ評価を停止し、7月27日に影響を受けた組織に通知したことを確認した。
Belshe氏がClaudeをテスト
この開示を受けて、Belshe氏は7月31日に正確に100 BTCの公開ビットコインアドレスに資金を供給した。彼はモデルが送金に成功した場合、資金を保有することを許可するとして、コインを移動させるようClaudeに公然と挑戦した。
しかし、ブロックチェーンの記録によると、8月2日までにウォレットからの送金はなかった。挑戦のニュースがソーシャルメディアプラットフォームで広まったが、公開アドレスは変更されなかった。
Belshe氏のテストは、Anthropicが報告した評価設定とは大きく異なっていた。彼はモデルにシステムへのアクセスを許可せず、特定のサイバーセキュリティタスクを割り当てず、演習用に特定のClaudeモデルも指定しなかった。したがって、そのセットアップには、インシデントが発生した評価に存在した構造化された環境、ネットワーク接続、明確な目標が欠けていた。
より広範なAIセキュリティ議論の中で変動なしのウォレット
Anthropicは、報告されたインシデントはモデルが独立して行動したものではなく、割り当てられたキャプチャー・ザ・フラッグ演習を完了したものであると明確にした。同社は、Claudeが環境から脱出したり、自らを複製しようとしたりしなかったことを強調した。
Belshe氏の公開ウォレットは、ビットコインブロックチェーン上で誰もが監視できる状態が続いている。出版物の時点で、Anthropicはこの挑戦に対する公開での対応を発表していなかった。
この出来事は、AIのサイバーセキュリティを巡る議論が広がる中で起きた。7月にはOpenAIがHugging Faceを含む別のセキュリティ評価を開示し、AIモデルの安全性慣行に対する継続的な業界の監視が強化されている。欧州連合の政策立案者は、ハイリスクAIシステムの評価規定を含むEU AI法の実施を開始しており、一方、米国の機関はAI安全性テストとレッドチーム評価に関する自主的な枠組みと行政指針を発表している。