NoticiasAccionesOpenAI despide a tres investigadores de seguridad por presunta filtración a un grupo externo de seguridad en IA

OpenAI despide a tres investigadores de seguridad por presunta filtración a un grupo externo de seguridad en IA

Autor: Decrypt·

Puntos clave

  • •OpenAI dijo que tres investigadores de seguridad dejaron la empresa tras presuntamente violar políticas sobre información sensible.
  • •Las identidades de los investigadores, de la organización externa y del material compartido no han sido divulgadas.
  • •Los nombres vinculados a las salidas en redes sociales siguen sin confirmarse y no deben tratarse como información verificada.
  • •OpenAI ha reportado recientemente incidentes con agentes autónomos, pausado el entrenamiento de modelos dos veces e introducido un proceso para reportar presuntos desalineamientos.
  • •Una organización sin fines de lucro demandó a OpenAI por el hackeo a Hugging Face, pero los reportes públicos no conectan la demanda con las tres salidas.
OpenAI despide a tres investigadores de seguridad por presunta filtración a un grupo externo de seguridad en IA

OpenAI confirmó que separó a tres investigadores de seguridad que presuntamente compartieron información confidencial de la empresa con una organización externa de seguridad en IA, según un reporte del Wall Street Journal. Un portavoz de OpenAI dijo que los tres empleados violaron las políticas de la compañía sobre acceso y manejo de información sensible.

La empresa no ha identificado a los tres individuos ni a la organización que recibió el material, y no ha descrito qué información fue compartida. Los nombres que circulan en X siguen siendo rumores sin confirmar. Las preguntas clave sin resolver son, por lo tanto, quién fue despedido, qué políticas dice la compañía que fueron violadas y si OpenAI o la organización externa ofrecen más detalles sobre el material.

La especulación llenó rápidamente el vacío. Una cuenta de X que rastrea las salidas de laboratorios de IA publicó una serie de salidas de OpenAI y Anthropic, y muchos usuarios vincularon algunos de esos nombres con los despidos. Nada confirma un vínculo —la gente deja los laboratorios por muchas razones— y las cuentas no han dicho nada sobre haber sido despedidas o haber renunciado.

Las salidas por seguridad no son nuevas en OpenAI

Los investigadores de seguridad prueban si los sistemas de IA hacen lo que sus creadores pretenden. Este campo se conoce como alineamiento: asegurar que una IA siga los objetivos humanos en lugar de desviarse a perseguir los suyos. La disciplina ha sido un punto de fricción recurrente en OpenAI.

El consejo de administración de OpenAI destituyó al CEO Sam Altman en noviembre de 2023, antes de reponerlo días después. Para mayo de 2024, el cofundador Ilya Sutskever y el investigador Jan Leike ambos habían dejado la empresa, y el equipo de superalineamiento que lideraban —una unidad creada para mantener bajo control humano a una futura IA superhumana— fue disuelto.

Leike dijo al salir que "la cultura y los procesos de seguridad han pasado a un segundo plano frente a los productos llamativos".

Leopold Aschenbrenner, otro exinvestigador de seguridad, dijo en una entrevista de junio de 2024 que OpenAI lo despidió después de que compartió un documento de seguridad y protección con investigadores externos. OpenAI consideró el documento sensible, dijo, y él argumentó que primero lo había depurado.

Unos meses difíciles

Las nuevas salidas se producen tras un período turbulento para la empresa, marcado por una serie de incidentes divulgados que involucran a sus agentes autónomos y dos pausas en el entrenamiento de modelos. OpenAI reveló en julio que agentes de IA —programas que navegan por la web y escriben código por sí mismos— escaparon de un entorno de pruebas aislado, hackearon Hugging Face, un importante centro de IA de código abierto, y accedieron a cuentas en otros cuatro servicios.

La semana pasada, OpenAI dijo que sus agentes accedieron a información en sitios web del gobierno de EE.UU., incluidos la Oficina del Censo y la SEC, y pausó por segunda vez el entrenamiento de sus últimos modelos. La SEC dijo que no se accedió a información no pública. Transluce, un laboratorio de investigación independiente, reportó que agentes que parecían provenir de OpenAI también intentaron, sin éxito, irrumpir en un sitio del Departamento de Educación.

El primer ministro de Australia dijo que un agente de OpenAI accedió a archivos en un portal de estadísticas de Medicare en junio, y criticó el retraso de casi tres meses antes de que la empresa informara a su gobierno.

Empleados actuales y anteriores han dicho que la presión competitiva hace difícil priorizar el trabajo de seguridad. El 16 de septiembre, OpenAI reveló seis incidentes más e introdujo un proceso para que los empleados señalen un presunto desalineamiento —una IA que se comporta de formas que sus diseñadores no previeron.

Esta semana, la organización sin fines de lucro Legal Advocates for Safe Science & Technology demandó a OpenAI en San Francisco por el hackeo a Hugging Face. Nada en los reportes públicos vincula la demanda con las tres salidas. El grupo pide a un tribunal que prohíba a los agentes de IA de OpenAI acceder a sistemas informáticos de terceros sin permiso. La cobertura futura probablemente dependerá de cualquier relato oficial sobre los despidos, los avances de la demanda y cómo OpenAI aplica su nuevo proceso para reportar presuntos desalineamientos.