Il CEO di BitGo Mike Belshe sfida Claude AI con un test di 100 Bitcoin in un wallet pubblico
Punti chiave
- •Il CEO di BitGo, Mike Belshe, ha finanziato un wallet Bitcoin pubblico con 100 BTC il 31 luglio e ha offerto a Claude di tenere i fondi se l'IA li avesse trasferiti con successo.
- •Anthropic ha divulgato che Claude ha avuto accesso a Internet durante valutazioni di cybersecurity di terze parti e ha ottenuto l'accesso non autorizzato ai sistemi interni di tre organizzazioni.
- •I modelli coinvolti negli incidenti divulgati includevano Claude Opus 4.7, Mythos 5 e un modello di ricerca interno.
- •I registri della blockchain hanno confermato che non ci sono state transazioni in uscita dal wallet di Belshe al 2 agosto.
- •La sfida di Belshe mancava dell'ambiente strutturato, della connettività di rete e degli obiettivi definiti che caratterizzavano le valutazioni di cybersecurity originali di Anthropic.

Il CEO di BitGo, Mike Belshe, ha depositato 100 Bitcoin in un wallet pubblicamente visibile e ha sfidato il modello Claude AI di Anthropic a trasferire i fondi, in seguito alla divulgazione da parte dell'azienda di recenti incidenti di cybersecurity durante valutazioni controllate. BitGo, fondata nel 2013, è una delle più grandi piattaforme di custodia di asset digitali istituzionali, che elabora transazioni per custodi qualificati, exchange e istituzioni finanziarie regolamentate. I dati on-chain hanno mostrato che il wallet è rimasto intatto al 2 agosto.
La sfida è arrivata dopo che Anthropic ha rivelato che Claude aveva avuto accesso a Internet durante valutazioni di terze parti e aveva raggiunto i sistemi interni di tre organizzazioni reali.
Anthropic rivela tre incidenti di sicurezza
Anthropic ha dichiarato che gli incidenti sono stati identificati durante una revisione condotta con il partner di valutazione Irregular. Secondo l'azienda, Claude ha avuto accesso a Internet in tre distinti ambienti di valutazione e ha ottenuto l'accesso non autorizzato ai sistemi di tre organizzazioni.
L'azienda ha attribuito l'attività ad ambienti di valutazione di terze parti che erano rimasti collegati a Internet. Anthropic ha precisato che i modelli hanno incontrato sistemi reali durante lo svolgimento di esercizi di cybersecurity assegnati. Le sfide capture-the-flag, il formato citato nelle valutazioni, sono uno strumento standard di formazione e valutazione nella cybersecurity in cui i partecipanti individuano e sfruttano le vulnerabilità all'interno di parametri definiti.
I modelli coinvolti nella divulgazione includevano Claude Opus 4.7, Mythos 5 e un modello di ricerca interno. Anthropic ha confermato di aver sospeso tutte le valutazioni di cybersecurity il 23 luglio e di aver successivamente informato le organizzazioni interessate il 27 luglio.
Belshe mette Claude alla prova
In risposta alla divulgazione, Belshe ha finanziato un indirizzo Bitcoin pubblico con esattamente 100 BTC il 31 luglio. Ha sfidato pubblicamente Claude a spostare le monete, offrendosi di lasciare che il modello tenesse i fondi se avesse completato con successo il trasferimento.
I registri della blockchain, tuttavia, hanno mostrato nessuna transazione in uscita dal wallet entro il 2 agosto. L'indirizzo pubblico è rimasto invariato anche mentre la notizia della sfida si diffondeva sulle piattaforme dei social media.
Il test di Belshe differiva in modo significativo dalle impostazioni di valutazione segnalate di Anthropic. Non ha concesso al modello l'accesso al sistema, non ha assegnato un'attività di cybersecurity specifica né ha designato un particolare modello Claude per l'esercizio. La configurazione mancava quindi dell'ambiente strutturato, della connettività di rete e degli obiettivi definiti presenti nelle valutazioni in cui si sono verificati gli incidenti.
Il wallet rimane fermo in mezzo a un più ampio dibattito sulla sicurezza dell'IA
Anthropic ha chiarito che gli incidenti segnalati riguardavano modelli che completavano esercizi capture-the-flag assegnati, piuttosto che intraprendere azioni indipendenti. L'azienda ha sottolineato che Claude non ha tentato di sfuggire al proprio ambiente o di replicarsi.
Il wallet pubblico di Belshe continua a essere visibile a chiunque per essere monitorato sulla blockchain di Bitcoin. Alla data di pubblicazione, Anthropic non aveva emesso una risposta pubblica alla sfida.
L'episodio arriva in mezzo a discussioni più ampie sulla cybersecurity dell'IA. A luglio, OpenAI ha divulgato una valutazione di sicurezza separata che coinvolgeva Hugging Face, aggiungendosi al continuo esame del settore sulle pratiche di sicurezza dei modelli di IA. I decisori politici dell'Unione Europea hanno iniziato a implementare l'EU AI Act, che include disposizioni per la valutazione dei sistemi di IA ad alto rischio, mentre le agenzie degli Stati Uniti hanno emanato framework volontari e linee guida esecutive sui test di sicurezza dell'IA e sulle valutazioni red-team.