NieuwsAandelenMicrosoft-medewerkers vroegen zich af of AI-scraping 'de grootste diefstal van arbeid in de menselijke geschiedenis' was

Microsoft-medewerkers vroegen zich af of AI-scraping 'de grootste diefstal van arbeid in de menselijke geschiedenis' was

Auteur: Decrypt·

Belangrijkste punten

  • Openbare gemaakte stukken uit de auteursrechtzaak van de Times uit 2023 laten zien dat Microsoft-medewerkers intern het gebruik van nieuwsartikelen door OpenAI vergeleken met een ongekende diefstal van menselijke arbeid, en waarschuwden dat trainen op AI-gegenereerd materiaal de modelkwaliteit geleidelijk kan aantasten.
  • Microsoft-ceo Satya Nadella verklaarde dat betaalmuurcontent gelicentieerd zou moeten worden en zei dat hij het recht van Microsoft zou hebben ingeroepen om OpenAI zijn modellen opnieuw te laten trainen als hij had geweten dat het bedrijf betaalmuurmateriaal gebruikte.
  • Interne OpenAI-communicatie omvat de beschrijving door een medewerker van een omweg rond de betaalmuur van de Times, wat een positieve reactie van president Greg Brockman kreeg.
  • Interne bevindingen van OpenAI, waaronder de observatie van een ingenieur dat gebruikers zelden op bronlinks klikken, ondergraven het argument van de bedrijven dat chatbots verkeer terugsturen naar uitgevers.
  • Beide gedaagden volhouden dat trainen op nieuwsartikelen fair use vormt, terwijl rechter Sidney Stein moties voor een summary judgment beoordeelt in een zaak die de Times eind 2023 aanspande en waaraan elf andere uitgevers zijn toegetreden.
Microsoft-medewerkers vroegen zich af of AI-scraping 'de grootste diefstal van arbeid in de menselijke geschiedenis' was

Microsoft-medewerkers debatteerden of het gebruik van nieuwsartikelen door OpenAI neerkwam op "de grootste diefstal van arbeid in de menselijke geschiedenis" en of het een "doom loop" kon veroorzaken die de modellen die ze zelf aan het bouwen waren aantaste, volgens donderdag openbare gemaakte gerechtelijke documenten, gerapporteerd door de New York Times.

De stukken komen voort uit de auteursrechtzaak die de Times eind 2023 aanspande tegen OpenAI en Microsoft, een zaak waaraan inmiddels elf andere uitgevers zijn toegetreden. OpenAI heeft de claims van het begin af aan bestreden, en de rechtszaak heeft het bedrijf er al toe gedwongen 20 miljoen ChatGPT-gesprekslogs te bewaren. Rechter Sidney Stein van de Southern District of New York beoordeelt moties voor een summary judgment, en documenten worden openbaar gemaakt terwijl hij deze overweegt. Een summary judgmentelt een rechter in staat een zaak zonder proces af te doen wanneer er geen wezenlijk geschil over feiten bestaat — daarom wegen de ontsloten stukken, waaronder interne communicatie van beide bedrijven, op dit moment van het proces zwaar.

Interne Microsoft-documenten uit 2023 voorzagen al de terugslag. "Miljoenen mensen over de hele wereld zullen grote modellen die al hun werk 'opzuigen' al snel beschouwen als een verbluffende diefstal van ongekende omvang," stond in een intern memo. Dezelfde auteur schreef dat grote AI-modellen "een product zijn dat zijn eigen toeleveringsketen vernietigt." De opmerking wees op een terugkoppellus waarbij modellen die zwaar getraind zijn op AI-gegenereerd materiaal geleidelijk hun eigen output aantasten — de "doom loop" waar medewerkers naar verwezen.

Microsoft verklaarde dat de memo's zijn geschreven door Brent Hecht, een director of applied science die ook een aanstelling aan de Northwestern University had, en dat deze niet de standpunten van het bedrijf vertegenwoordigen. In een rechtsstuk zei het bedrijf dat Hecht geen beslisser was en was aangenomen om "uiteenlopende en asymmetrische perspectieven te presenteren."

"Een rommeltje achterlaten op het tapijt"

Microsoft-ceo Satya Nadella verklaarde dat "alles wat achter een betaalmuur zit gelicentieerd zou moeten worden door iedereen die het wil gebruiken," en voegde eraan toe dat hij, als hij had geweten dat OpenAI trainde op betaalmuurcontent, het recht van Microsoft zou hebben ingeroepen om het bedrijf zijn modellen opnieuw te laten trainen. Een woordvoerder zei dat Nadella "sprak over brede principes" over hoe mensen informatie vinden en consumeren.

Bij OpenAI vertelde een medewerker president Greg Brockman over het bouwen van een "hack" om de betaalmuur van de Times te omzeilen. Brockman antwoordde: "ah nice."

Nick Turley, die het ChatGPT-team leidde, schreef in juni 2023 dat AI een "existential threat" vormde voor uitgevers. In februari 2024 schreef hij dat AI-producten "steeds meer vervangend worden naarmate ze beter worden," en elders dat AI-producten "grotendeels vervangend zijn, punt."

Een OpenAI-ingenieur stelde in februari 2023 vast dat "hoe prominent we de links ook tonen, gebruikers niet klikken" — een bevinding die afbreuk doet aan het argument dat chatbots verkeer terugsturen naar uitgevers, een langdurige bron van lezers en inkomsten voor nieuwsorganisaties.

In een memo uit 2020 aan Brockman en ceo Sam Altman waarschuwde toenmalig policy-directeur Jack Clark dat het bedrijf "systemen creëert die de arbeid vervangen van de mensen die de 'cultuur' van de samenleving bepalen," en dat het "het symbool zou worden van hoe Silicon Valley gedachteloos andere delen van het leven intreedt en een rommeltje achterlaat op het tapijt." Clark vertrok later om medeoprichter te worden van Anthropic, dat een verzoek om commentaar van de Times doorverwees naar OpenAI.

Zowel Microsoft als OpenAI betogen dat trainen op nieuwsartikelen fair use vormt: het materiaal wordt omgezet in nieuw werk in plaats van de originelen te vervangen. Fair use staat beperkt gebruik van auteursrechtelijk beschermd materiaal zonder licentie toe, en of grootschalige training op gepubliceerde journalistiek daaronder valt, is de centrale juridische vraag die deze zaak zal toetsen.

"De wereld kan zien wat OpenAI en Microsoft altijd dachten over de billijkheid van hun eigen gedrag," zei Steven Lieberman, een advocaat die in deze zaak de New York Daily News en zeven andere kranten vertegenwoordigt.

De Times, zelf eiser in de zaak, wilde niet reageren op vragen van haar eigen journalisten, die meldden dat OpenAI niet op verzoeken om commentaar had gereageerd. Nu de moties voor een summary judgment nog lopen, zijn de volgende mijlpalen in de zaak de uitspraak van rechter Stein en wat het ontsluitingsproces verder aan het licht brengt.