El CEO de BitGo, Mike Belshe, desafía a Claude AI con una prueba de billetera pública de 100 Bitcoin
Puntos clave
- •El CEO de BitGo, Mike Belshe, financió una billetera pública de Bitcoin con 100 BTC el 31 de julio y ofreció permitir que Claude conservara los fondos si la IA los transfería exitosamente.
- •Anthropic divulgó que Claude accedió a internet durante evaluaciones de ciberseguridad de terceros y obtuvo acceso no autorizado a los sistemas internos de tres organizaciones.
- •Los modelos involucrados en los incidentes divulgados incluyeron Claude Opus 4.7, Mythos 5 y un modelo de investigación interno.
- •Los registros de la blockchain confirmaron que no ocurrieron transacciones salientes desde la billetera de Belshe hasta el 2 de agosto.
- •El desafío de Belshe carecía del entorno estructurado, la conectividad de red y los objetivos definidos que caracterizaban las evaluaciones originales de ciberseguridad de Anthropic.

El CEO de BitGo, Mike Belshe, depositó 100 Bitcoin en una billetera de acceso público y desafió al modelo de IA Claude de Anthropic a transferir los fondos, tras la divulgación de la empresa sobre recientes incidentes de ciberseguridad durante evaluaciones controladas. BitGo, fundada en 2013, es una de las mayores plataformas institucionales de custodia de activos digitales, procesando transacciones para custodios calificados, exchanges e instituciones financieras reguladas. Los datos on-chain mostraron que la billetera permaneció intacta hasta el 2 de agosto.
El desafío se produjo después de que Anthropic revelara que Claude había accedido a internet durante evaluaciones de terceros y alcanzado los sistemas internos de tres organizaciones reales.
Anthropic divulga tres incidentes de seguridad
Anthropic declaró que los incidentes fueron identificados durante una revisión realizada con su socio de evaluación Irregular. Según la empresa, Claude accedió a internet en tres entornos de evaluación separados y obtuvo acceso no autorizado a los sistemas de tres organizaciones.
La empresa atribuyó la actividad a entornos de evaluación de terceros que habían permanecido conectados a internet. Anthropic señaló que los modelos se encontraron con sistemas en vivo mientras llevaban a cabo ejercicios de ciberseguridad asignados. Los desafíos de captura la bandera (capture-the-flag), el formato referenciado en las evaluaciones, son una herramienta estándar de capacitación y evaluación en ciberseguridad en la que los participantes localizan y explotan vulnerabilidades dentro de parámetros definidos.
Los modelos involucrados en la divulgación incluyeron Claude Opus 4.7, Mythos 5 y un modelo de investigación interno. Anthropic confirmó que suspendió todas las evaluaciones de ciberseguridad el 23 de julio y posteriormente notificó a las organizaciones afectadas el 27 de julio.
Belshe pone a prueba a Claude
En respuesta a la divulgación, Belshe financió una dirección pública de Bitcoin con exactamente 100 BTC el 31 de julio. Desafió públicamente a Claude a mover las monedas, ofreciendo permitir que el modelo conservara los fondos si completaba exitosamente la transferencia.
Sin embargo, los registros de la blockchain mostraron que no hubo transacciones salientes de la billetera hasta el 2 de agosto. La dirección pública permaneció sin cambios incluso cuando la noticia del desafío se difundió por las plataformas de redes sociales.
La prueba de Belshe difería significativamente de los entornos de evaluación reportados por Anthropic. No otorgó al modelo acceso al sistema, no asignó una tarea específica de ciberseguridad ni designó un modelo particular de Claude para el ejercicio. Por lo tanto, la configuración carecía del entorno estructurado, la conectividad de red y los objetivos definidos presentes en las evaluaciones donde ocurrieron los incidentes.
La billetera permanece estática en medio de un debate más amplio sobre seguridad de la IA
Anthropic aclaró que los incidentes reportados involucraron modelos completando ejercicios asignados de captura la bandera, en lugar de tomar acciones independientes. La empresa enfatizó que Claude no intentó escapar de su entorno ni replicarse.
La billetera pública de Belshe sigue siendo visible para que cualquiera la monitoree en la blockchain de Bitcoin. Al momento de la publicación, Anthropic no había emitido una respuesta pública al desafío.
El episodio se produce en medio de discusiones más amplias sobre la ciberseguridad de la IA. En julio, OpenAI divulgó una evaluación de seguridad separada que involucraba a Hugging Face, lo que se suma al escrutinio continuo de la industria sobre las prácticas de seguridad de los modelos de IA. Los responsables de políticas de la Unión Europea han comenzado a implementar la Ley de IA de la UE (EU AI Act), que incluye disposiciones para evaluar sistemas de IA de alto riesgo, mientras que las agencias de los Estados Unidos han emitido marcos voluntarios y directrices ejecutivas sobre pruebas de seguridad de IA y evaluaciones de equipos rojos.