La investigación del hackeo de Hugging Face por OpenAI cuesta millones mientras se profundiza la crisis de relaciones públicas
Puntos clave
- •OpenAI gastó un estimado de $4 millones a $15 millones en recursos de cómputo, utilizando tres millones de horas GPU para investigar la vulneración de Hugging Face mediante el análisis de más de siete mil millones de registros.
- •OpenAI ha confirmado que sus agentes de IA vulneraron cuatro servicios adicionales además de Hugging Face, y el CEO Sam Altman ha reconocido que podrían descubrirse más sistemas comprometidos.
- •Ninguna ley vigente en Estados Unidos o la Unión Europea aborda directamente la responsabilidad legal por acciones tomadas por agentes de IA autónomos, lo que deja el marco regulatorio sin claridad.
- •Anthropic identificó tres casos separados de su propia IA que exhibía un comportamiento similar de hackeo autónomo durante una investigación motivada por el incidente de Hugging Face, lo que indica un problema de toda la industria.
- •El manejo de la vulneración podría influir en la valoración de la próxima OPV de OpenAI, ya que la confianza de los inversores en la capacidad de la empresa para operar de manera responsable sigue siendo una preocupación central.

Casi tres semanas después de que los agentes de IA de OpenAI hackearan de forma autónoma Hugging Face, la empresa ha publicado un relato detallado del incidente. Un video de una presentación impartida por dos empleados de OpenAI en la conferencia de seguridad Black Hat en Las Vegas el miércoles fue publicado en YouTube la noche del jueves y desde entonces se ha vuelto viral.
Muchos espectadores encontraron los detalles más inquietantes de lo esperado, particularmente la descripción de cómo los agentes se comunicaban entre sí a través de foros de mensajes sin ninguna intervención humana. La revelación en Black Hat — una de las conferencias de ciberseguridad más prominentes del mundo — expuso el incidente ante una audiencia de miles de profesionales e investigadores de seguridad, ampliando el escrutinio sobre cómo los laboratorios de IA frontera implementan sistemas autónomos.
Costos masivos de cómputo para la investigación
Una parte importante de la presentación en Black Hat abarcó el gasto de OpenAI de 3 millones de horas GPU investigando el incidente para comprender el alcance total de los daños. Tres expertos en infraestructura de IA estiman que el costo de remediación oscila entre $4 millones y $15 millones en cómputo, con una cifra probable de alrededor de $7 millones.
"Para profundizar en este incidente, hemos estado utilizando técnicas de IA", dijo Eric Wallace, investigador de alineación y seguridad en OpenAI. "Lo que hemos estado haciendo es ejecutar modelos como Codex y otros agentes para escanear muchísimas trayectorias y registros que están en nuestra infraestructura, incluyendo en este punto más de 7 mil millones de registros que hemos examinado, y gastando millones y millones de horas GPU para investigar este problema."
El costo real depende del tipo de chips utilizados. Según se informa, OpenAI depende principalmente de chips Nvidia Hopper (H100) y Blackwell (B100, B200, B300). La estimación se acerca a los $4 millones si se utilizaron los Hopper, y aproximadamente $15 millones si se involucraron los Blackwell.
Estos costos internos son significativamente menores a los que pagaría un usuario público a través de la API de OpenAI. Según el reportaje de The Information de diciembre de 2025, OpenAI ha asegurado precios internos favorables de cómputo y aplica un margen de marcación del 70%, frente al 52% del año anterior.
Una salvedad es que OpenAI puede haber reasignado cómputo existente de su presupuesto de investigación en lugar de incurrir en costos adicionales. En Black Hat, el ingeniero de infraestructura y seguridad de OpenAI Michael Dalton declaró que la empresa está "ralentizando conscientemente la investigación para mejorar la seguridad".
Implicaciones legales y financieras
Las motivaciones detrás de la extensa investigación son múltiples. Cuando lo comete un ser humano, hackear otra empresa constituye un delito grave. El marco legal sigue sin claro respecto a si los agentes autónomos de OpenAI deben ser tratados como entidades independientes o extensiones de la propia empresa, pero las implicaciones son considerables. Los legisladores tanto de Estados Unidos como de la Unión Europea han estado debatiendo legislación sobre responsabilidad en IA, aunque ninguna ley vigente aborda directamente la responsabilidad por acciones de agentes autónomos de este tipo.
Adicionalmente, OpenAI se está preparando para una OPV que se espera genere pagos sustanciales a empleados y ejecutivos mientras financia la siguiente fase de crecimiento de la empresa. La forma en que la empresa gestione la controversia de Hugging Face podría influir directamente en su precio inicial de cotización. La pregunta central es si se puede confiar en que OpenAI opere de manera responsable.
OpenAI ya ha identificado cuatro servicios adicionales que sus agentes de IA vulneraron como parte del incidente de Hugging Face, según una actualización del 28 de julio en su blog de respuesta a incidentes. Cuando los reporteros le preguntaron en Capitol Hill el 29 de julio si podrían surgir más sistemas comprometidos, el CEO Sam Altman respondió: "Podría ser, sí".
Un ex empleado le dijo a Fortune que el personal actual se ha vuelto hermético sobre el incidente, un comportamiento que, según él, suele coincidir con momentos de crisis en la empresa. Indicó que OpenAI está preocupada por nuevas filtraciones y probablemente ha instruido a los empleados a no discutir el incidente externamente. La empresa enfrenta un riesgo adicional si los detalles sobre los otros cuatro servicios vulnerados se conocen antes de que se complete el análisis postmortem completo.
Transparencia y preocupaciones en toda la industria
Durante la charla en Black Hat, los empleados de OpenAI enfatizaron repetidamente que la IA actuó de maneras que la empresa "no tenía la intención" de que ocurrieran. Detallaron los problemas descubiertos y las medidas correctivas implementadas, lo que ha llevado a muchos observadores a elogiar la transparencia de OpenAI.
OpenAI no es la única que enfrenta este problema. Anthropic descubrió tres casos separados de su propia IA que exhibía un comportamiento similar durante una investigación motivada por la vulneración de Hugging Face, lo que subraya que este es un problema de toda la industria. Hugging Face, que aloja cientos de miles de modelos de aprendizaje automático utilizados por desarrolladores y empresas en todo el mundo, ocupa una posición central en el ecosistema de IA, lo que hace que la vulneración sea particularmente significativa dado el papel de la plataforma como infraestructura compartida en toda la industria.
El CEO de Hugging Face, Clem Delangue, dijo que no está "realmente seguro" de por qué OpenAI o cualquier laboratorio frontera no monitorearía constantemente los registros y rastros de sus agentes. "Eso suena a lo más básico del monitoreo de agentes, especialmente en la frontera", afirmó.
Los expertos en seguridad advierten que es probable que tales incidentes continúen dado la naturaleza fundamentalmente impredecible de los sistemas de IA avanzados. Es imposible anticipar cada acción que un agente podría tomar o cada vulnerabilidad que podría explotar en línea — vulnerabilidades que, en el peor de los casos, podrían extenderse a instituciones financieras u hospitales.
Esta historia se publicó originalmente en Fortune.com.