Microsoft-Mitarbeiter fragten, ob KI-Scraping der „größte Diebstahl menschlicher Arbeit in der Geschichte“ sei
Wichtige Erkenntnisse
- •Freigegebene Akten aus der Urheberrechtsklage der Times von 2023 zeigen, dass Microsoft-Mitarbeiter intern die Nutzung von Nachrichtenartikeln durch OpenAI mit einem beispiellosen Diebstahl menschlicher Arbeit verglichen und warnten, das Training mit KI-generiertem Material könnte die Modellqualität schrittweise verschlechtern.
- •Microsoft-Chef Satya Nadella sagte aus, dass Paywall-Inhalte lizenziert werden sollten, und erklärte, er hätte Microsofts Recht ausgeübt, OpenAI zum Neutraining seiner Modelle zu verpflichten, hätte er von der Nutzung Paywall-geschützter Inhalte gewusst.
- •Die interne Kommunikation von OpenAI umfasst die Schilderung eines Mitarbeiters, eine Umgehung der Times-Paywall entwickelt zu haben, was eine zustimmende Antwort von Präsident Greg Brockman erhielt.
- •Interne Befunde von OpenAI, darunter die Beobachtung eines Ingenieurs, dass Nutzer zitierte Links selten anklicken, schwächen das Argument der Unternehmen, Chatbots leiteten Verkehr an Verlage zurück.
- •Beide Beklagten behaupten, das Training mit Nachrichtenartikeln stelle Fair Use dar, während Richter Sidney Stein über Anträge auf Partialurteil in einem Fall entscheidet, den die Times Ende 2023 einreichte und dem sich elf weitere Verlage angeschlossen haben.

Microsoft-Mitarbeiter erörterten, ob die Nutzung von Nachrichtenartikeln durch OpenAI den „größten Diebstahl menschlicher Arbeit in der Geschichte“ darstelle und einen „Doom Loop“ auslösen könne, der die Modelle, die sie selbst entwickelten, beeinträchtigen könnte. Das geht aus am Donnerstag freigegebenen Gerichtsunterlagen hervor, über die die New York Times berichtete.
Die Unterlagen stammen aus der Urheberrechtsklage, die die Times Ende 2023 gegen OpenAI und Microsoft eingereicht hatte und der sich inzwischen elf weitere Verlage angeschlossen haben. OpenAI hat die Vorwürfe durchgehend bestritten, und das Verfahren hat das Unternehmen bereits dazu gezwungen, 20 Millionen ChatGPT-Unterhaltungsprotokolle aufzubewahren. Richter Sidney Stein vom Bundesbezirksgericht für den südlichen Bezirk von New York berät über Anträge auf Partialurteil (Summary Judgment); die Unterlagen werden im Zuge dessen freigegeben. Ein Partialurteil erlaubt es einem Richter, einen Fall ohne Prozess zu entscheiden, wenn kein tatsächlicher Meinungsstreit über wesentliche Fragen besteht – deshalb kommt dem freigegebenen Aktenbestand, einschließlich interner Kommunikation beider Unternehmen, in dieser Phase des Verfahrens großes Gewicht zu.
Interne Microsoft-Dokumente aus dem Jahr 2023 ahnten den Gegenwind bereits voraus. „Millionen von Menschen weltweit werden es bald als erstaunlichen Diebstahl von nie dagewesenem Ausmaß betrachten, dass große Modelle ihre gesamte Arbeit ‚einsaugen'“, hieß es in einem Memo. Derselbe Autor schrieb, große KI-Modelle seien „ein Produkt, das seine eigene Lieferkette zerstört“. Die Bemerkung verwies auf eine Rückkopungsschleife, in der stark mit KI-generiertem Material trainierte Modelle ihre eigene Ausgabe schrittweise verschlechtern – der von Mitarbeitern erwähnte „Doom Loop“.
Microsoft erklärte, die Memos stammten von Brent Hecht, einem Direktor der angewandten Wissenschaft, der zugleich eine Position an der Northwestern University innehatte, und spiegelten nicht die Ansichten des Unternehmens wider. In einer Eingabe teilte das Unternehmen mit, Hecht sei kein Entscheidungsträger gewesen, sondern damit beauftragt worden, „divergente und asymmetrische Perspektiven“ aufzuzeigen.
„Ein Durcheinander auf dem Teppich hinterlassen“
Microsoft-Chef Satya Nadella sagte aus, dass „alles, was hinter einer Paywall steht, von jedem lizenziert werden sollte, der es nutzen möchte“, und fügte hinzu, hätte er gewusst, dass OpenAI mit Paywall-Inhalten trainierte, hätte er das Recht Microsofts ausgeübt, das Unternehmen zu verpflichten, seine Modelle neu zu trainieren. Ein Unternehmenssprecher erklärte, Nadella habe zu „grundsätzlichen Prinzipien“ darüber gesprochen, wie Menschen Informationen finden und konsumieren.
Bei OpenAI teilte ein Mitarbeiter Präsident Greg Brockman mit, ein „Hack“ zum Umgehen der Paywall der Times entwickelt zu haben. Brockman antwortete: „ah nice.“
Nick Turley, der das ChatGPT-Team leitete, schrieb im Juni 2023, KI stelle eine „existenzielle Bedrohung“ für Verlage dar. Im Februar 2024 schrieb er, KI-Produkte würden „mit jeder Verbesserung immer substitutiver“, und stellte an anderer Stelle fest, KI-„Produkte seien im Wesentlichen substitutiv, Punkt“.
Ein OpenAI-Ingenieur stellte im Februar 2023 fest, dass „Nutzer nicht klicken, egal wie prominent wir die Links anzeigen“ – ein Befund, der dem Argument widerspricht, Chatbots würden Verkehr an Verlage zurückleiten, eine langjährige Quelle für Leser und Einnahmen von Nachrichtenorganisationen.
In einem Memo aus dem Jahr 2020 an Brockman und CEO Sam Altman warnte der damalige Policy-Direktor Jack Clark, das Unternehmen erschaffe „Systeme, die die Arbeit der Menschen ersetzen, die die ‚Kultur' der Gesellschaft prägen“, und würden „zum Symbol dafür werden, wie das Silicon Valley gedankenlos in andere Lebensbereiche vordringt und ein Durcheinander auf dem Teppich hinterlässt“. Clark verließ das Unternehmen später und war Mitgründer von Anthropic, das eine Anfrage der Times nach Stellungnahme an OpenAI verwies.
Sowohl Microsoft als auch OpenAI argumentieren, das Training mit Nachrichtenartikeln stelle Fair Use dar, da das Material in neue Wer transformiert werde, statt die Originale zu ersetzen. Fair Use gestattet die eingeschränkte Nutzung urheberrechtlich geschützten Materials ohne Lizenz; ob ein umfassendes Training mit veröffentlichtem Journalismus darunter fällt, ist die zentrale Rechtsfrage, die der Fall prüfen wird.
„Die Welt kann sehen, was OpenAI und Microsoft von Anfang an über die Fairness ihres eigenen Verhaltens dachten“, sagte Steven Lieberman, ein Anwalt, der die New York Daily News und sieben weitere Zeitungen in dem Fall vertritt.
Die Times selbst ist Klägerin im Verfahren und lehnte eine Stellungnahme gegenüber ihren eigenen Reportern ab, die mitteilten, OpenAI habe auf Anfragen nicht reagiert. Da die Anträge auf Partialurteil noch ausstehen, sind die nächsten Meilensteine im Verfahren Steinens Entscheidung und alles Weitere, was der Prozess der Aktenfreigabe ans Licht bringt.