NotizieAzioniDipendenti Microsoft si chiedevano se il rac实现了 scraping di AI fosse il "più grande furto di lavoro nella storia dell'umanità"

Dipendenti Microsoft si chiedevano se il rac实现了 scraping di AI fosse il "più grande furto di lavoro nella storia dell'umanità"

Autore: Decrypt·

Punti chiave

  • Gli atti desecretati della causa per violazione del copyright del 2023 del Times mostrano che dipendenti Microsoft paragonavano privatamente l'uso degli articoli di giornale da parte di OpenAI a un furto di lavoro umano senza precedenti e avvertivano che l'addestramento su materiale generato dall'AI poteva degradare progressivamente la qualità dei modelli.
  • L'amministratore delegato di Microsoft, Satya Nadella, ha dichiarato sotto giuramento che i contenuti dietro paywall dovrebbero essere soggetti a licenza e ha detto che avrebbe esercitato il diritto di Microsoft di costringere OpenAI a riaddestrare i propri modelli se avesse saputo che usava materiale dietro paywall.
  • Le comunicazioni interne di OpenAI includono la descrizione di un dipendente della realizzazione di un sistema per aggirare il paywall del Times, che ha ricevuto una risposta positiva dal presidente Greg Brockman.
  • Riscontri interni di OpenAI, tra cui l'osservazione di un ingegnere che gli utenti raramente cliccano i link citati, indeboliscono l'argomento delle aziende secondo cui i chatbot generano traffico per gli editori.
  • Entrambe le aziende convenute sostengono che l'addestramento su articoli di giornale costituisca fair use mentre il giudice Sidney Stein valuta le richieste di giudizio sommario in una causa intentata dal Times alla fine del 2023 e a cui si sono uniti altri undici editori.
Dipendenti Microsoft si chiedevano se il rac实现了 scraping di AI fosse il "più grande furto di lavoro nella storia dell'umanità"

I dipendenti Microsoft discutevano se l'uso degli articoli di giornale da parte di OpenAI costituisse "il più grande furto di lavoro nella storia dell'umanità" e potesse innescare un "doom loop" che degradasse i modelli stessi che stavano sviluppando, secondo documenti giudiziari desecretati giovedì e riportati dal New York Times.

I documenti derivano dalla causa per violazione del copyright intentata dal Times contro OpenAI e Microsoft alla fine del 2023, a cui si sono uniti altri undici editori. OpenAI ha contestato le accuse dall'inizio, e la causa ha già costretto l'azienda a conservare 20 milioni di log di conversazioni di ChatGPT. Il giudice Sidney Stein del distretto meridionale di New York sta valutando le richieste di giudizio sommario, e i documenti vengono desecretati mentre le esamina. Il giudizio sommario consente a un giudice di risolvere un caso senza processo quando non esiste una reale contestazione di fatti rilevanti, ed è per questo che gli atti desecretati — incluse comunicazioni interne di entrambe le aziende — hanno peso in questa fase del contenzioso.

Documenti interni Microsoft del 2023 avevanoato la reazione negativa. "Millioni di persone nel mondo considereranno presto i modelli di grandi dimensioni che 'risucchiano' tutto il loro lavoro un furto sorprendente di proporzioni senza precedenti", si legge in un promemoria. Lo stesso autore ha scritto che i grandi modelli di AI "sono un prodotto che distrugge la propria catena di fornitura". L'osservazione puntava a un circolo vizioso in cui modelli addestrati pesantemente su materiale generato dall'AI degraderebbero progressivamente la propria produzione — il "doom loop" citato dai dipendenti.

Microsoft ha dichiarato che i promemoria erano stati scritti da Brent Hecht, direttore della scienza applicata che ricopriva anche un incarico alla Northwestern University, e non rappresentano le posizioni aziendali. In un atto, l'azienda ha affermato che Hecht non era un decisore e era stato assunto per "presentare prospettive divergenti e asimmetriche".

"Lasciare un pasticcio sul tappeto"

L'amministratore delegato di Microsoft, Satya Nadella, ha dichiarato sotto giuramento che "tutto ciò che è dietro paywall dovrebbe essere concesso in licenza a chiunque voglia utilizzarlo", aggiungendo che se avesse saputo che OpenAI stava addestrando i propri modelli su contenuti dietro paywall, avrebbe esercitato il diritto di Microsoft di costringerla a riaddestrarli. Un portavoce aziendale ha detto che Nadella "si è espresso su principi generali" su come le persone trovano e fruiscono le informazioni.

In OpenAI, un dipendente ha riferito al presidente Greg Brockman di aver realizzato un "hack" per aggirare il paywall del Times. Brockman ha risposto: "ah nice".

Nick Turley, che guidava il team di ChatGPT, ha scritto a giugno 2023 che l'AI rappresentava una "minaccia esistenziale" per gli editori. A febbraio 2024, ha scritto che i prodotti AI "diventeranno sempre più sostitutivi man mano che miglioreranno", notando altrove che i prodotti AI "sono in gran parte sostitutivi, punto".

Un ingegnere di OpenAI ha osservato a febbraio 2023 che "per quanto mostriamo i link in evidenza, gli utenti non cliccano" — un riscontro che depone contro l'argomento secondo cui i chatbot inviano traffico agli editori, una fonte storica di lettori e ricavi per le organizzazioni di stampa.

In un promemoria del 2020 a Brockman e all'amministratore delegato Sam Altman, l'allora direttore delle politiche Jack Clark ha avvertito l'azienda stava "creando sistemi che sostituiscono il lavoro delle persone che definiscono la 'cultura' della società", e che sarebbero divenuti "il simbolo di come la Silicon Valley sta entrando sconsideratamente in altre sfere della vita lasciando un pasticcio sul tappeto". Clark ha successivamente lasciato l'azienda per co-fondare Anthropic, che ha rimandato una richiesta di commento del Times a OpenAI.

Sia Microsoft che OpenAI sostengono che l'addestramento su articoli di giornale costituisca fair use, trasformando il materiale in nuove opere anziché sostituirne gli originali. Il fair use consente un uso limitato di materiale protetto da copyright senza licenza, e se l'addestramento su larga scala su giornalistica pubblicata rientri in questa categoria è la questione giuridica centrale che il caso andrà a verificare.

"Il mondo può vedere cosa OpenAI e Microsoft hanno sempre pensato dell'equità del proprio comportamento", ha detto Steven Lieberman, avvocato che rappresenta il New York Daily News e altri sette quotidiani nel caso.

Il Times, esso stesso parte querelante, ha rifiutato di commentare con i propri giornalisti, i quali hanno riferito che OpenAI non ha risposto alle richieste di commento. Con le richieste di giudizio sommario ancora in sospeso, i prossimi momenti chiave del caso sono la sentenza del giudice Stein ed eventuali altri sviluppi del processo di desecretazione.