NachrichtenAktienUniversity of Oxford erlaubt OpenAI das Training von KI-Modellen mit Daten der Bodleian Library

University of Oxford erlaubt OpenAI das Training von KI-Modellen mit Daten der Bodleian Library

Autor: CryptoBriefing·

Wichtige Erkenntnisse

  • •Im Rahmen einer am 4. März 2025 angekündigten fünfjährigen Partnerschaft kann OpenAI seine KI-Modelle mit historischen Texten der Bodleian Libraries von Oxford trainieren.
  • •Ein Pilotprojekt im Februar digitalisiert rund 3.500 gemeinfreie Dissertationen aus den Jahren 1498 bis 1884, mit dem Ziel, die jahrhundertealten Sammlungen durchsuchbar und global zugänglich zu machen.
  • •Die Vereinbarung ist Teil von OpenAIs NextGenAI-Programm, das 50 Millionen US-Dollar in Forschungszuschüsse, Rechenressourcen und API-Zugang für Eliteinstitutionen einschließlich Harvard und MIT investiert hat.
  • •Oxford plant, ab September 2025 ChatGPT Edu universitätsweit einzuführen, nachdem es mit rund 750 Nutzern pilotiert wurde; Open-Access-Forschungsberichte zum Digitalisierungsprojekt werden Anfang 2026 erwartet.
  • •Einige Universitätsmitarbeiter haben aufgrund der Urheberrechtskontroversen und Datenbeschaffungspraktiken von OpenAI Bedenken hinsichtlich des reputativen Risikos geäußert – obwohl die Dissertationen des Pilotprojekts gemeinfrei sind.
University of Oxford erlaubt OpenAI das Training von KI-Modellen mit Daten der Bodleian Library

Die University of Oxford hat eine fünfjährige Partnerschaft mit OpenAI geschlossen, die es dem Unternehmen hinter ChatGPT ermöglicht, seine KI-Modelle mit historischen Texten der Bodleian Libraries zu trainieren – eines der ältesten und renommiertesten Bibliothekssysteme der Welt.

Die am 4. März 2025 angekündigte Zusammenarbeit begann im Februar mit einem Pilotprojekt zur Digitalisierung von rund 3.500 gemeinfreien Dissertationen aus den Jahren 1498 bis 1884. Bei diesen Jahrhunderte alten Texten, die zuvor weitgehend nur für Personen zugänglich waren, die Oxford persönlich besuchen konnten, blieb ein Großteil des Materials für die globale Forschungsgemeinschaft faktisch unerreichbar.

Was die Partnerschaft beinhaltet

Die Vereinbarung fällt unter OpenAIs NextGenAI-Programm, das 50 Millionen US-Dollar in Forschungszuschüsse, Rechenressourcen und API-Zugang für eine Gruppe von Eliteinstitutionen investiert hat – darunter neben Oxford auch Harvard und MIT.

Für die Bodleian Libraries ist das erklärte Ziel klar: KI-gestützte Metadaten-Anreicherung und verbesserte Transkriptionsdienste sollen die jahrhundertealten Sammlungen durchsuchbar und global zugänglich machen.

Im Bildungsbereich plant Oxford, ab September 2025 ChatGPT Edu universitätsweit einzuführen. Das Tool wurde bereits mit rund 750 Nutzern pilotiert. Die Forschungsergebnisse des Digitalisierungsprojekts sollen voraussichtlich Anfang 2026 in Open-Access-Berichten veröffentlicht werden, womit Beobachter konkrete Messpunkte dafür erhalten, ob die Partnerschaft ihre erklärten Ziele erfüllt.

Bedenken des Personals

Nicht alle an Oxford feiern diese Vereinbarung. Mitarbeiter der Universität haben Bedenken hinsichtlich des reputativen Risikos einer Partnerschaft mit OpenAI geäußert – einem Unternehmen, das aufgrund von Urheberrechtsproblemen, Datenbeschaffungspraktiken und seiner raschen Kommerzialisierung unter CEO Sam Altman anhaltender Kritik ausgesetzt war.

Die im Pilotprojekt erfassten Dissertationen sind gemeinfrei, d. h. es besteht kein Urheberrecht. Dennoch hat die Optik einer rund 900 Jahre alten akademischen Institution, die ihre Sammlungen einem gewinnorientierten KI-Unternehmen zur Verfügung stellt, erhöhte Aufmerksamkeit auf sich gezogen.

Es stellt sich zudem die Frage, was jede Seite gewinnt. Oxford erhält Unterstützung bei der Digitalisierung, Rechenressourcen und Bildungswerkzeuge. OpenAI erhält hochwertige, kuratierte Trainingsdaten aus einer weltweit vertrauenswürdigen Quelle sowie dieschweigende Billigung, die mit einer Oxford-Partnerschaft einhergeht – eine Billigung, deren Wert dadurch noch steigt, dass die Datenpraktiken des Unternehmens weiterhin umstritten sind.

Das größere Bild

Oxfords Deal fügt sich in einen Muster ein, das sich in der Hochschulbildung beschleunigt. Technologiefirmen greifen zunehmend auf akademische Institutionen als Datenquellen zurück – zum einen, weil web-gescrapte Daten auf rechtliche Herausforderungen stoßen, zum anderen, weil akademische Korpora in der Regel hochwertiger sind als der Durchschnitt des Internets.

Vor diesem Hintergrund wird beobachtet werden, wie Oxfords ChatGPT-Edu-Einführung und die Digitalisierungsberichte bei Institutionen ankommen, die ähnliche Vereinbarungen prüfen. Das Engagement von 50 Millionen US-Dollar im NextGenAI-Programm, verteilt auf mehrere Institutionen, ist erheblich, aber bescheiden im Vergleich zu OpenAIs Gesamtausgaben, die sich jährlich auf Milliarden von US-Dollar belaufen.