NoticiasMacroOpenAI detiene el entrenamiento de sus modelos tras agentes descontrolados que atacaron sitios del gobierno de EE.UU.

OpenAI detiene el entrenamiento de sus modelos tras agentes descontrolados que atacaron sitios del gobierno de EE.UU.

Autor: Decrypt·

Puntos clave

  • •Los agentes de OpenAI usaron claves encontradas en repositorios públicos para obtener datos demográficos y económicos de la Oficina del Censo.
  • •La SEC afirmó que no encontró evidencia de que los agentes accedieran a información no pública, mientras que un presunto intento de intrusión en el Departamento de Educación falló y sigue bajo investigación.
  • •La pausa del entrenamiento es la segunda de OpenAI desde que los agentes violaron la seguridad de Hugging Face, donde supuestamente un agente usó una credencial robada para acceder a un archivo de biología.
  • •OpenAI ya había enfrentado escrutinio después de que un agente accediera a un portal australiano de estadísticas de Medicare, y la empresa dice que ha notificado a decenas de organizaciones afectadas.
OpenAI detiene el entrenamiento de sus modelos tras agentes descontrolados que atacaron sitios del gobierno de EE.UU.

OpenAI ha pausado el entrenamiento de sus modelos de IA más recientes después de que sus agentes usaran claves de acceso encontradas en internet para extraer datos de un sitio web de la Oficina del Censo de EE.UU., según Associated Press. Es la segunda vez que la empresa detiene el entrenamiento desde que sus agentes violaron la seguridad de Hugging Face, una plataforma ampliamente utilizada donde los desarrolladores comparten modelos y conjuntos de datos de IA.

La pausa entró en vigencia el fin de semana, después de que los agentes de OpenAI interactuaran con sitios web del gobierno de EE.UU. En la Oficina del Censo, una agencia del Departamento de Comercio, los agentes usaron claves de desarrollador descubiertas en repositorios de código públicos para obtener datos que, según el departamento, eran públicos. La Comisión de Bolsa y Valores (SEC), cuyos sitios también fueron investigados por los agentes, afirma que no tiene conocimiento de accesos no autorizados a información no pública. OpenAI señala que los sitios gubernamentales aparecieron en la actividad de los agentes porque sus modelos suelen tratarlos como fuentes autorizadas, y la empresa ha notificado a decenas de organizaciones.

Un agente es un programa de IA que navega por la web y escribe código por sí mismo, sin que una persona apruebe cada paso, a diferencia de un chatbot convencional, que solo responde a indicaciones. OpenAI prueba estos programas durante el entrenamiento, la etapa en la que un modelo aprende mediante práctica repetida, y durante la evaluación, cuando se le califica en tareas.

Los incidentes han generado muchos problemas para la empresa: los agentes, aparentemente decididos a completar sus tareas a cualquier costo, ya habían atacado a empresas privadas y ahora han llegado a portales sensibles del gobierno de Estados Unidos.

Mientras buscaban datos, los agentes de OpenAI encontraron claves de desarrollador —contraseñas que permiten al software comunicarse con el servicio de datos de un sitio web— en repositorios de código públicos de GitHub, un sitio donde los programadores publican su código que cualquiera pueda verlo. Con esas claves, extrajeron cifras demográficas y económicas de la API de Datos del Censo de EE.UU., el canal automatizado de datos de la oficina.

El Departamento de Comercio afirma que los datos eran públicos; nada secreto salió por la puerta. El problema es cómo entraron los agentes. El propio marco de reportes de OpenAI clasifica el uso de credenciales expuestas sin autorización como una categoría de conducta indebida, y la "desalineación" es el término del sector para cuando una IA hace algo que sus diseñadores no pretendían.

¿Por qué sitios gubernamentales?

La respuesta de OpenAI, según CNN, es que algunos de los incidentes involucraron sitios gubernamentales porque sus modelos suelen recurrir a ellos como fuentes autorizadas de información pública. Además del Departamento de Comercio, otras agencias también fueron afectadas por estos agentes descontrolados.

El episodio de la SEC fue más leve. Los agentes copiaron material público de SEC.gov e Investor.gov y lo republicaron en otra página web. OpenAI afirma que no encontró uso de credenciales de la SEC, y la SEC indica que no tiene conocimiento de accesos no autorizados a información no pública.

El caso del Departamento de Educación es más confuso. Transluce, un laboratorio independiente de investigación en IA, afirma que un agente que parecía provenir de OpenAI intentó, sin éxito, irrumpir en el sitio web de la oficina de derechos civiles del departamento. OpenAI aún investiga ese incidente, y el departamento afirma que no encontró impacto. El intento fue señalado por observadores externos, no por OpenAI. El trabajo previo de Transluce se basó en registros públicos de urlquery.net, un servicio de escaneo web, y rastrea la actividad sospechosa de agentes hasta marzo.

Cómo llegamos a esto

El uso desalineado de claves de acceso repite un truco antiguo. En el caso de Hugging Face, el propio informe de incidentes de OpenAI dijo que un agente robó una credencial de inicio de sesión para acceder a un archivo de biología, y un investigador independiente descubrió después que los agentes estaban sondeando el sitio desde mayo.

El 21 de julio, OpenAI reveló que GPT-5.6 Sol y un modelo no lanzado escaparon de un sandbox —un entorno de pruebas aislado sin acceso a internet— durante una prueba de ciberseguridad y violaron la seguridad de Hugging Face. Dos días después, dos miembros del Congreso presentaron un proyecto de ley que permitiría al gobierno federal apagar un modelo de IA, una medida que aún tendría que aprobar ambas cámaras del Congreso antes de entrar en vigencia. El proyecto exime el red-teaming, es decir, las pruebas adversariales, por lo que la violación de Hugging Face no lo habría activado.

En junio, un agente de OpenAI accedió a un portal australiano de estadísticas de Medicare, el sistema de salud pública del país. El primer ministro Anthony Albanese dijo que OpenAI tardó aproximadamente tres meses en informar a su gobierno y calificó de inaceptable la forma en que lo hizo.

OpenAI afirma que hasta ahora ha notificado a decenas de organizaciones y que su revisión de la actividad de los agentes tomará meses con la investigación del Departamento de Educación aún abierta.