L'Università di Oxford collabora con OpenAI per addestrare modelli AI sui testi della Bodleian Library
Punti chiave
- •OpenAI potrà addestrare i suoi modelli AI su testi storici delle Bodleian Libraries di Oxford nell'ambito di una partnership quinquennale annunciata il 4 marzo 2025.
- •Un progetto pilota avviato a febbraio sta digitalizzando circa 3.500 dissertazioni di pubblico dominio databili tra il 1498 e il 1884, con l'obiettivo di rendere le collezioni secolari ricercabili e accessibili a livello globale.
- •L'accordo fa parte del programma NextGenAI di Open, che ha destinato 50 milioni di dollari in sovvenzioni per la ricerca, risorse di calcolo e accesso API a istituzioni d'élite tra cui Harvard e il MIT.
- •Oxford prevede di distribuire ChatGPT Edu in tutta l'università a partire da settembre 2025 dopo averlo testato con circa 750 utenti; i rapporti di ricerca in accesso libero sul progetto di digitalizzazione sono attesi entro l'inizio del 2026.
- •Alcuni membri del personale universitario hanno sollevato preoccupazioni sul rischio reputazionale di una partnership con OpenAI per le sue controversie sul copyright e le pratiche di raccolta dei dati, anche se le dissertazioni del progetto pilota sono di pubblico dominio.

L'Università di Oxford ha stipulato una partnership quinquennale con OpenAI che consentirà all'azienda dietro ChatGPT di addestrare i suoi modelli AI su testi storici conservati nelle Bodleian Libraries, uno dei sistemi bibliotecari più antichi e prestigiosi al mondo.
La collaborazione, annunciata il 4 marzo 2025, è iniziata con un progetto pilota a febbraio incentrato sulla digitalizzazione di circa 3.500 dissertazioni di pubblico dominio databili tra il 1498 e il 1884. Si tratta di testi secolari che in precedenza erano in gran parte inaccessibili per chiunque non potesse recarsi fisicamente a Oxford, il che significa che gran parte di questo materiale è rimasto di fatto fuori dalla portata della comunità di ricerca globale.
Cosa prevede la partnership
L'accordo rientra nel programma NextGenAI di OpenAI, che ha destinato 50 milioni di dollari in sovvenzioni per la ricerca, risorse di calcolo e accesso API a un gruppo di istituzioni d'élite che comprende Harvard e il MIT insieme a Oxford.
Per le Bodleian Libraries, l'obiettivo dichiarato è chiaro: l'arricchimento dei metadati basato sull'AI e servizi di trascrizione migliorati renderanno le collezioni secolari ricercabili e accessibili a livello globale.
Sul fronte dell'istruzione, Oxford prevede di distribuire ChatGPT Edu in tutta l'università a partire da settembre 2025. Lo strumento è già stato testato in via pilota con circa 750 utenti. I della ricerca del progetto di digitalizzazione sono attesi entro l'inizio del 2026 in rapporti ad accesso libero, offrendo agli osservatori punti di riferimento concreti per valutare se la partnership raggiungerà gli obiettivi dichiarati.
Le preoccupazioni del personale
Non tutti a Oxford festeggiano l'accordo. Il personale universitario ha espresso preoccupazioni sul rischio reputazionale di una partnership con OpenAI, un'azienda che ha affrontato critiche continue per questioni di copyright, pratiche di raccolta dei dati e la sua rapida commercializzazione sotto l'amministratore delegato Sam Altman.
Le dissertazioni oggetto del progetto pilota sono di pubblico dominio, quindi non si applica alcun copyright. Ciononostante, l'immagine di un'istituzione accademica di circa 900 anni che fornisce le sue collezioni a un'azienda AI a scopo di lucro ha attirato l'attenzione.
Vi è anche la questione di cosa guadagni ciascuna parte. Oxford riceve supporto per la digitalizzazione, risorse di calcolo e strumenti educativi. OpenAI riceve dati di addestramento curati e di alta qualità da una fonte affidabile a livello globale, oltre all'approvazione implicita che deriva da una partnership con Oxford — un'approvazione il cui valore è accentuato dal fatto che le pratiche sui dati dell'azienda restano contestate.
Il quadro generale
L'accordo di Oxford con OpenAI rientra in un modello che si sta accelerando nel settore dell'istruzione superiore. Le aziende tecnologiche si rivolgono sempre più alle istituzioni accademiche come fonti di dati, in parte perché i dati raccolti dal web incontrano sfide legali e in parte perché i corpora accademici tendono a essere di qualità superiore rispetto alla media di internet.
In questo contesto, l'accoglienza dell'implementazione di ChatGPT Edu a Oxford e dei rapporti sulla digitalizzazione sarà seguita dalle istituzioni che valutano accordi simili. L'impegno di 50 milioni di dollari del programma NextGenAI, distribuito su più istituzioni, è sostanziale ma modesto rispetto alla spesa complessiva di OpenAI, che si misura in miliardi di dollari all'anno.