Оксфордский университет разрешил OpenAI обучать ИИ-модели на данных библиотеки Бодлеяна
Ключевые выводы
- •OpenAI сможет обучать свои ИИ-модели на исторических текстах библиотек Бодлеяна Оксфордского университета в рамках пятилетнего партнерства, анонсированного 4 марта 2025 года.
- •Пилотный проект, запущенный в феврале, оцифровывает около 3500 диссертаций из общественного достояния, датируемых 1498–1884 годами, с целью сделать многовековые коллекции доступными для поиска и открытыми для всего мира.
- •Соглашение является частью программы OpenAI NextGenAI, которая выделила 50 млн долларов на исследовательские гранты, вычислительные ресурсы и доступ к API для элитных учреждений, включая Гарвард и MIT.
- •Оксфорд планирует развернуть ChatGPT Edu по всему университету с сентября 2025 года после пилотного тестирования с участием около 750 пользователей; открытые исследовательские отчеты по проекту оцифровки ожидаются к началу 2026 года.
- •Некоторые сотрудники университета выразили обеспокоенность репутационными рисками партнерства с OpenAI из-за споров вокруг авторских прав и практики сбора данных, хотя диссертации пилотного проекта находятся в общественном достоянии.

Оксфордский университет заключил пятилетнее партнерское соглашение с OpenAI, которое позволит компании — разработчику ChatGPT — обучать свои ИИ-модели на исторических текстах библиотек Бодлеяна, одной из старейших и самых известных библиотечных систем мира.
Сотрудничество, анонсированное 4 марта 2025 года, началось с пилотного проекта в феврале, направленного на оцифровку около 3500 диссертаций из общественного достояния, датируемых 1498–1884 годами. Речь идет о текстах возрастом в несколько столетий, которые ранее были практически недоступны для тех, кто не мог лично посетить Оксфорд, — значительная часть этих материалов фактически оставалась вне досягаемости мирового исследовательского сообщества.
Что включает соглашение
Соглашение входит в программу OpenAI NextGenAI, которая выделила 50 млн долларов на исследовательские гранты, вычислительные ресурсы и доступ к API для группы элитных учреждений, включающих наряду с Оксфордом Гарвард и MIT.
Для библиотек Бодлеяна заявленная цель проста: обогащение метаданных с помощью ИИ и улучшенные услуги транскрибации сделают многовековые коллекции доступными для поиска и открытыми для всего мира.
В сфере образования Оксфорд планирует развернуть ChatGPT Edu по всему университету начиная с сентября 2025 года. Инструмент уже прошел пилотное тестирование с участием около 750 пользователей. Результаты исследования по проекту оцифровки ожидаются в открытых отчетах к началу 2026 года, что даст наблюдателям конкретные ориентиры для оценки того, оправдывает ли партнерство заявленные цели.
Опасения сотрудников
Далеко не все в Оксфорде радуются этому соглашению. Сотрудники университета выразили обеспокоенность репутационными рисками партнерства с OpenAI — компанией, которая подвергалась устойчивой критике из-за проблем с авторскими правами, практики сбора данных и стремительной коммерциализации под руководством генерального директора Сэма Альтмана.
Диссертации, охваченные пилотным проектом, находятся в общественном достоянии, то есть авторские права на них не распространяются. Тем не менее сам факт того, что академическое учреждение возрастом около 900 лет передает свои коллекции коммерческой ИИ-компании, вызвал пристальное внимание.
Возникает и вопрос о том, что получает каждая из сторон. Оксфорд получает поддержку оцифровке, вычислительные ресурсы и образовательные инструменты. OpenAI получает качественные, тщательно отобранные обучающие данные из пользующегося глобальным доверием источника, а также неявное одобрение, которое сопутствует партнерству с Оксфордом, — одобрение, ценность которого возрастает на фоне того, что практика работы с данными компании по-прежнему оспаривается.
Более широкая картина
Соглашение Оксфорда вписывается в тенденцию, которая ускоряется по всему сектору высшего образования. Технологические компании все чаще обращаются к академическим учреждениям как к источникам данных — отчасти потому, что данные, собранные путем веб-скрейпинга, сталкиваются с юридическими проблемами, а отчасти потому, что академические корпуса, как правило, качественнее среднего интернет-текста.
На этом фоне реакция на развертывание ChatGPT Edu в Оксфорде и отчеты о оцифровке будет важна для учреждений, рассматривающих аналогичные соглашения. Обязательство программы NextGenAI в 50 млн долларов, распределенное между несколькими учреждениями, значительно, но скромно по сравнению с общими расходами OpenAI, которые исчисляются миллиардами долларов в год.