NoticiasAccionesEmpleados de Microsoft preguntaron si el scraping de IA era el 'mayor robo de trabajo en la historia de la humanidad'

Empleados de Microsoft preguntaron si el scraping de IA era el 'mayor robo de trabajo en la historia de la humanidad'

Autor: Decrypt·

Puntos clave

  • Documentos revelados de la demanda por derechos de autor de 2023 del Times muestran que empleados de Microsoft compararon en privado el uso de artículos de noticias por parte de OpenAI con un robo de trabajo humano sin precedentes y advirtieron que entrenar con material generado por IA podría degradar progresivamente la calidad de los modelos.
  • El CEO de Microsoft, Satya Nadella, declaró que el contenido bajo muro de pago debería licenciarse y dijo que habría ejercido el derecho de Microsoft a obligar a OpenAI a reentrenar sus modelos si hubiera sabido que usaba material bajo muro de pago.
  • Las comunicaciones internas de OpenAI incluyen la descripción de un empleado sobre la construcción de una herramienta para eludir el muro de pago del Times, que recibió una respuesta positiva del presidente Greg Brockman.
  • Hallazgos internos de OpenAI, incluida la observación de un ingeniero de que los usuarios rara vez hacen clic en los enlaces citados, debilitan el argumento de las empresas de que los chatbots devuelven tráfico a los editores.
  • Ambos demandados sostienen que entrenar con artículos de noticias constituye uso legítimo mientras el juez Sidney Stein evalúa las mociones de sentencia sumaria en un caso que el Times presentó a finales de 2023 al que se han sumado otros once editores.
Empleados de Microsoft preguntaron si el scraping de IA era el 'mayor robo de trabajo en la historia de la humanidad'

Empleados de Microsoft debatieron si el uso de artículos de noticias por parte de OpenAI equivalía a "el mayor robo de trabajo en la historia de la humanidad" y si podía desencadenar un "círculo vicioso" que degradara los propios modelos que estaban construyendo, según documentos judiciales revelados el jueves y reportados por el New York Times.

Los documentos provienen de la demanda por derechos de autor que el Times presentó contra OpenAI y Microsoft a finales de 2023, un caso al que luego se sumaron otros once editores. OpenAI ha impugnado las acusaciones a lo largo del proceso, y el litigio ya obligó a la empresa a preservar 20 millones de registros de conversaciones de ChatGPT. El juez Sidney Stein del Distrito Sur de Nueva York está evaluando mociones de sentencia sumaria, y los documentos se están revelando mientras las considera. La sentencia sumaria permite a un juez resolver un caso sin juicio cuando no existe una disputa genuina de hechos materiales, razón por la cual el expediente revelado —incluidas comunicaciones internas de ambas empresas— tiene peso en esta etapa del litigio.

Documentos internos de Microsoft de 2023 anticiparon la reacción adversa. "Millones de personas en todo el mundo pronto considerarán que los modelos grandes que 'aspiran' todo su trabajo constituyen un robo asombroso de proporciones sin precedentes", señala un memorando. El mismo autor escribió que los modelos grandes de IA "son un producto que destruye su propia cadena de suministro". El comentario apuntaba a un bucle de retroalimentación en el que los modelos entrenados intensamente con material generado por IA degradarían progresivamente su propio resultado: el "círculo vicioso" al que se referían los empleados.

Microsoft indicó que los memorandos fueron escritos por Brent Hecht, director de ciencia aplicada que también ocupaba un cargo en la Universidad Northwestern, y que no representan los puntos de vista de la empresa. En una presentación, la empresa afirmó que Hecht no era un tomador de decisiones y había sido contratado para "presentar perspectivas divergentes y asimétricas".\n## "Dejando un desastre en la alfombra"

El CEO de Microsoft, Satya Nadella, declaró que "todo lo que esté bajo muro de pago debería ser licenciado por cualquiera que quiera usarlo", y agregó que, si hubiera sabido que OpenAI estaba entrenando con contenido bajo muro de pago, habría ejercido el derecho de Microsoft a obligarla a reentrenar sus modelos. Un portavoz de la empresa dijo que Nadella "habló de principios generales" sobre cómo las personas encuentran y consumen información.

En OpenAI, un empleado comentó al presidente Greg Brockman sobre la construcción de un "hack" para eludir el muro de pago del Times. Brockman respondió: "ah nice".

Nick Turley, quien dirigía el equipo de ChatGPT, escribió en junio de 2023 que la IA representaba una "amenaza existencial" para los editores. En febrero de 2024, escribió que los productos de IA "serán cada vez más sustitutivos a medida que mejoren", y señaló en otra parte que los productos de IA "son en gran medida sustitutivos, punto".

Un ingeniero de OpenAI observó en febrero de 2023 que "por más prominentes que mostremos los enlaces, los usuarios no harán clic", un hallazgo que contradice el argumento de que los chatbots devuelven tráfico a los editores, una fuente histórica de lectores e ingresos para las organizaciones de noticias.

En un memorando de 2020 a Brockman y al CEO Sam Altman, el entonces director de políticas Jack Clark advirtió que la empresa estaba "creando sistemas que sustituyen el trabajo de las personas que definen la 'cultura' de la sociedad", y que se convertiría "en el símbolo de cómo Silicon Valley se mete imprudentemente en otras partes de la vida y deja un desastre en la alfombra". Clark luego dejó la empresa para cofundar Anthropic, que remitió a OpenAI una solicitud de comentarios del Times.

Tanto Microsoft como OpenAI sostienen que entrenar con artículos de noticias constituye uso legítimo, transformando el material en una obra nueva en lugar de sustituir a los originales. El uso legítimo permite el uso limitado de material con derechos de autor sin licencia, y si el entrenamiento a gran escala con periodismo publicado califica es la cuestión legal central que el caso pondrá a prueba.

"El mundo puede ver lo que OpenAI y Microsoft pensaron todo el tiempo sobre la justicia de su propio comportamiento", dijo Steven Lieberman, abogado que representa al New York Daily News y a otros siete periódicos en el caso.

El Times, él mismo demandante, declinó comentar a sus propios reporteros, quienes dijeron que OpenAI no respondió a las solicitudes de comentarios. Con las mociones de sentencia sumaria aún pendientes, los próximos hitos del caso son el fallo del juez Stein y lo demás que el proceso de revelación de documentos ponga al descubierto.