AktualnościAkcjeUniwersytet Oksfordzki pozwala OpenAI trenować modele AI na danych Biblioteki Bodlejańskiej

Uniwersytet Oksfordzki pozwala OpenAI trenować modele AI na danych Biblioteki Bodlejańskiej

Autor: CryptoBriefing·

Najważniejsze informacje

  • •OpenAI będzie mogła trenować swoje modele AI na historycznych tekstach z oksfordzkich Bibliotek Bodlejańskich w ramach pięcioletniego partnerstwa ogłoszonego 4 marca 2025 roku.
  • •Projekt pilotażowy rozpoczęty w lutym digitalizuje około 3500 dissertacji z domeny publicznej z lat 1498–1884, aby uczynić kilkusetletnie zbiory przeszukiwalnymi i dostępnymi na całym świecie.
  • •Umowa jest częścią programu NextGenAI firmy OpenAI, który przeznaczył 50 milionów dolarów na granty badawcze, zasoby obliczeniowe i dostęp do API dla elitarnych instytucji, w tym Harvardu i MIT.
  • •Oksford planuje wdrożyć ChatGPT Edu na całym uniwersytecie od września 2025 roku po pilotażu na około 750 użytkownikach, a raporty badawcze w otwartym dostępie z projektu digitalizacji mają się pojawić na początku 2026 roku.
  • •Część pracowników uniwersytetu wyraziła obawy dotyczące ryzyka wizerunkowego współpracy z OpenAI w związku z kontrowersjami wokół praw autorskich i praktyk pozyskiwania danych, mimo że dissertacje z pilotażu należą do domeny publicznej.
Uniwersytet Oksfordzki pozwala OpenAI trenować modele AI na danych Biblioteki Bodlejańskiej

Uniwersytet Oksfordzki zawarł pięcioletnie partnerstwo z OpenAI, które pozwoli firmie stojącej za ChatGPT trenować swoje modele AI na historycznych tekstach przechowywanych w Bibliotekach Bodlejańskich – jednym z najstarszych i najbardziej renomowanych systemów bibliotecznych na świecie.

Współpraca, ogłoszona 4 marca 2025 roku, rozpoczęła się od projektu pilotażowego w lutym, którego celem była digitalizacja około 3500 dissertacji z domeny publicznej pochodzących z lat 1498–1884. Są to teksty liczące setki lat, wcześniej w dużej mierze niedostępne dla osób, które nie mogły osobiście przybyć do Oksfordu, co oznaczało, że znaczna część tego materiału pozostawała praktycznie poza zasięgiem światowej społeczności badawczej.

Na czym polega partnerstwo

Porozumienie mieści się w ramach programu NextGenAI firmy OpenAI, który przeznaczył 50 milionów dolarów na granty badawcze, zasoby obliczeniowe i dostęp do API dla grupy elitarnych instytucji, obok Oksfordu obejmującej Harvard i MIT.

Dla Bibliotek Bodlejańskich deklarowany cel jest prosty: wzbogacanie metadanych za pomocą AI oraz ulepszone usługi transkrypcji mają uczynić kilkusetletnie zbiory przeszukiwalnymi i dostępnymi na całym świecie.

W obszarze edukacji Oksford planuje wdrożyć ChatGPT Edu na całym uniwersytecie od września 2025 roku. Narzędzie zostało już przetestowane na około 750 użytkownikach. Wyniki badań z projektu digitalizacji mają zostać opublikowane w raportach w otwartym dostępie na początku 2026 roku, dając obserwatorom konkretne punkty odniesienia do oceny, czy partnerstwo realizuje deklarowane cele.

Obawy pracowników

Nie wszyscy na Oksfordzie święt to porozumienie. Pracownicy uniwersytetu wyrazili obawy dotyczące ryzyka wizerunkowego związanego ze współpracą z OpenAI – firmą, która od dłuższego czasu jest krytykowana za kwestie praw autorskich, praktyki pozyskiwania danych oraz szybką komercjalizację pod kierownictwem CEO Sama Altmana.

Dissertacje objęte pilotażem należą do domeny publicznej, co oznacza, że nie podlegają prawom autorskim. Mimo to wizerunek liczącej około 900 lat instytucji akademickiej przekazującej swoje zbiory komercyjnemu przedsiębiorstwu AI wzbudził zainteresowanie i krytykę.

Pojawia się również pytanie o korzyści obu stron. Oksford otrzymuje wsparcie w digitalizacji, zasoby obliczeniowe i narzędzia edukacyjne. OpenAI otrzymuje wysokiej jakości, wyselekcjonowane dane treningowe z globalnie zaufanego źródła, a także dorozumiane poparcie, jakie niesie partnerstwo z Oksfordem – poparcie, którego wartość jest tym większa, że praktyki firmy w zakresie danych pozostają kwestionowane.

Szerszy kontekst

Umowa Oksfordu z OpenAI wpisuje się w trend, który przyspiesza w całym szkolnictwie wyższym. Firmy technologiczne coraz częściej zwracają się ku instytucjom akademickim jako źródłom danych – częściowo dlatego, że dane pozyskiwane przez skrobanie sieci napotykają na wyzwania prawne, a częściowo dlatego, że korpusy akademickie są zwykle wyższej jakości niż przeciętne treści internetowe.

Na tym tle sposób, w jaki przyjęte zostaną wdrożenie ChatGPT Edu oraz raporty z digitalizacji, będzie obserwowany przez instytucje rozważające podobne porozumienia. Zobowiązanie programu NextGenAI w wysokości 50 milionów dolarów, rozłożone na wiele instytucji, jest znaczące, ale skromne w stosunku do ogólnych wydatków OpenAI, które szacuje się na miliardy dolarów rocznie.