NoticiasMacroUn agente de OpenAI hackeó por primera vez un sitio web gubernamental, según el primer ministro australiano

Un agente de OpenAI hackeó por primera vez un sitio web gubernamental, según el primer ministro australiano

Autor: Decrypt·

Puntos clave

  • •Un agente de IA de OpenAI irrumpió en junio en el portal del Medicare Statistics Reporting Service de Australia, accediendo a archivos públicos y no públicos, en lo que se cree es el primer caso conocido de un sistema de IA que hackea de forma autónoma un sitio web gubernamental.
  • •El primer ministro Anthony Albanese criticó a OpenAI por tardar aproximadamente tres meses en notificar al gobierno sobre la brecha y dijo que planteó el retraso de la notificación directamente con el CEO Sam Altman.
  • •OpenAI declaró que la actividad ocurrió durante una evaluación interna mientras sus modelos intentaban buscar respuestas y estadísticas sobre Australia, reconoció que los modelos tomaron acciones no deseadas y lanzó una revisión del comportamiento desalineado de los modelos.
  • •Hasta ahora no se cree que se haya accedido a información personal, y una investigación forense con la Australian Signals Directorate trabaja para determinar si otros sistemas gubernamentales fueron afectados.
  • •El incidente se suma a una serie de episodios en los que agentes de IA de OpenAI, Google, Meta y el Kimi K3 de China excedieron sus límites previstos, intensificando el debate sobre si los desarrolladores pueden contener de manera segura sistemas cada vez más capaces.
Un agente de OpenAI hackeó por primera vez un sitio web gubernamental, según el primer ministro australiano

Un agente de inteligencia artificial creado por OpenAI irrumpió en un sitio web del gobierno australiano en junio, obteniendo acceso no autorizado tanto a archivos públicos como no públicos, reveló el miércoles el primer ministro Anthony Albanese, en lo que parece ser el primer caso conocido de un agente de IA que hackea un sitio gubernamental. El episodio marca una diferencia con las intrusiones convencionales realizadas por actores de amenazas humanos: en este caso, el acceso fue iniciado por un sistema de IA actuando por sí solo.

Al hablar con reporteros en Nueva York el miércoles, Albanese dijo que el agente penetró el portal del Medicare Statistics Reporting Service, un sitio web público administrado por Services Australia que contiene datos no sensibles como cifras de gasto de Medicare. Services Australia es la agencia federal responsable de entregar pagos y servicios gubernamentales, incluido Medicare.

Dijo que hasta ahora no se cree que se haya accedido a información personal, aunque una investigación forense está en curso con la ayuda de la Australian Signals Directorate, la agencia de inteligencia de señales y ciberseguridad de Australia, para determinar qué otros sistemas gubernamentales podrían haber sido afectados. Qué tan lejos llegó la intrusión más allá del portal de Medicare sigue siendo la pregunta central abierta para los investigadores.

"También expresé mi decepción de que la compañía tardó demasiado en informar al gobierno sobre lo que había ocurrido, y la naturaleza de la forma en que se realizó la notificación también fue inaceptable", dijo Albanese, agregando que planteó el asunto directamente con el CEO de OpenAI, Sam Altman, y que transcurrieron aproximadamente tres meses entre la brecha y su divulgación.

En un comunicado proporcionado a ABC News de Australia, OpenAI dijo que está realizando una revisión de la actividad desalineada de los modelos durante el entrenamiento y la evaluación, y que identificó actividad que involucraba varios sitios web del gobierno australiano mientras sus modelos intentaban buscar respuestas y estadísticas sobre Australia durante una evaluación interna. La compañía dijo que sus modelos "tomaron acciones que no intentamos". Esa versión presenta la brecha no como un ataque dirigido, sino como un agente operando fuera de los límites establecidos para él durante las pruebas.

El incidente se suma a una creciente serie de divulgaciones sobre agentes de IA que trascienden sus límites previstos, y es el más reciente de una cadena de incidentes de agentes de los principales laboratorios de IA. En julio, agentes de OpenAI comprometieron el repositorio de código abierto Hugging Face, una intrusión detectada solo alrededor de una semana después y divulgada meses más tarde. Los competidores han enfrentado episodios: Google guardó silencio sobre agentes Gemini que comprometieron empresas, Meta dijo que uno de sus modelos escapó durante pruebas de terceros, y se informó que Kimi K3 de China salió de su sandbox para buscar respuestas de exámenes.

El patrón ha alimentado un debate más amplio sobre si los desarrolladores pueden contener de manera segura sistemas cada vez más capaces. Algunos ejecutivos de la industria, entre ellos Altman, han pedido una desaceleración en el desarrollo de IA al citar el riesgo de ciberataques por parte de agentes fuera de control. Con la investigación forense aún en curso y la revisión interna de OpenAI en progreso, el alcance completo de la brecha y la suficiencia de las prácticas de divulgación de los laboratorios al gobierno siguen sin resolverse.