NieuwsAandelenUniversiteit van Oxford werkt met OpenAI samen om AI-modellen te trainen op teksten van de Bodleian Library

Universiteit van Oxford werkt met OpenAI samen om AI-modellen te trainen op teksten van de Bodleian Library

Auteur: CryptoBriefing·

Belangrijkste punten

  • •OpenAI kan onder een vijfjarig partnerschap, aangekondigd op 4 maart 2025, zijn AI-modellen trainen op historische teksten uit de Bodleian Libraries van Oxford.
  • •Een pilotproject in februari digitaliseert ongeveer 3.500 public-domain-dissertaties uit de periode 1498 tot 1884, met als doel de eeuwenoude collecties doorzoekbaar en wereldwijd toegankelijk te maken.
  • •De overeenkomst maakt deel uit van OpenAI's NextGenAI-programma, dat 50 miljoen dollar aan onderzoeksbeurzen, rekenkracht en API-toegang heeft toegezegd aan topinstellingen waaronder Harvard en MIT.
  • •Oxford wil vanaf september 2025 ChatGPT Edu universiteitsbreed uitrollen na een test met ongeveer 750 gebruikers; open-access onderzoeksrapporten van het digitaliseringsproject worden begin 2026 verwacht.
  • •Sommige medewerkers hebben zorgen geuit over het reputatierisico van samenwerking met OpenAI vanwege de controverse rond auteursrechten en dataverzameling, ook al vallen de dissertaties uit de pilot in het publieke dome.
Universiteit van Oxford werkt met OpenAI samen om AI-modellen te trainen op teksten van de Bodleian Library

De Universiteit van Oxford is een vijfjarig partnerschap aangegaan met OpenAI waarmee het bedrijf achter ChatGPT zijn AI-modellen mag trainen op historische teksten uit de Bodleian Libraries, een van de oudste en meest gerenommeerde bibliotheeksystemen ter wereld.

De samenwerking, aangekondigd op 4 maart 2025, begon met een pilotproject in februari dat gericht was op het digitaliseren van ongeveer 3.500 public-domain-dissertaties uit de periode 1498 tot 1884. Het betreft eeuwenoude teksten die voorheen grotendeels ontoegankelijk waren voor iedereen die niet fysiek naar Oxford kon reizen, waardoor veel van dit materiaal feitelijk buiten bereik van de wereldwijde onderzoekscommunity bleef.

Wat het partnerschap inhoudt

De overeenkomst valt onder OpenAI's NextGenAI-programma, dat 50 miljoen dollar aan onderzoeksbeurzen, rekenkracht en API-toegang heeft toegezegd aan een groep topinstellingen waaronder Harvard en MIT, naast Oxford.

Voor de Bodleian Libraries is het gestelde doel helder: door AI ondersteunde metadata-verrijking en verbeterde transcriptiediensten moeten de eeuwenoude collecties doorzoekbaar en wereldwijd toegankelijk maken.

Op onderwijsgebied wil Oxford vanaf september 2025 ChatGPT Edu universiteitsbreed uitrollen. De tool is al getest met ongeveer 750 gebruikers. Onderzoeksresultaten van het digitaliseringsproject worden begin 2026 verwacht in open-access rapporten, waarmee waarnemers concrete ijkpunten hebben om te beoordelen of het partnerschap zijn gestelde doelen waarmaakt.

Bezwaren van het personeel

Niet iedereen aan Oxford juicht de regeling toe. Medewerkers van de universiteit hebben zich zorgen gemaakt over hetatierisico van een samenwerking met OpenAI, een bedrijf dat doorlopend kritiek heeft gekregen op auteursrechenkwesties, dataverzamelingspraktijken en de snelle commercialisering onder CEO Sam Altman.

De dissertaties uit de pilot vallen in het publieke domein, wat betekent dat er geen auteursrecht op rust. Toch heeft de verschijning van een ongeveer 900 jaar oude academische instelling die zijn collecties beschikbaar stelt aan een commercieel AI-bedrijf tot kritische vragen geleid.

Er is ook de vraag wat elke partij eraan verdient. Oxford krijgt ondersteuning bij digitalisering, rekenkracht en onderwijstools. OpenAI krijgt hoogwaardige, gecureerde trainingsdata van een wereldwijd vertrouwde bron, plus de impliciete onderschrijving die voortvloeit uit een partnerschap met Oxford — een onderschrijving waarvan de waarde nog wordt vergroot doordat de datapraktijken van het bedrijf omstreden blijven.

Het bredere beeld

De deal van Oxford past in een patroon dat zich in het hoger onderwijs steeds sneller voortzet. Technologiebedrijven wenden zich in toenemende mate tot academische instellingen als databron, deels omdat webscraped data juridische uitdagingen tegenkomt en deels omdat academische corpora doorgaans van hogere kwaliteit zijn dan de gemiddelde internettekst.

Tegen die achtergrond wordt met aandacht gevolgd hoe Oxfords uitrol van ChatGPT Edu en de digitaliseringsrapporten worden ontvangen door instellingen die soortgelijke afspraken overwegen. De toezegging van 50 miljoen dollar uit het NextGenAI-programma, verdeeld over meerdere instellingen, is aanzienlijk maar bescheiden vergeleken met de totale uitgaven van OpenAI, die jaarlijks in de miljarden dollars worden gemeten.