НовостиАкцииОксфордский университет разрешил OpenAI обучать ИИ-модели на данных библиотеки Бодлеяна

Оксфордский университет разрешил OpenAI обучать ИИ-модели на данных библиотеки Бодлеяна

Автор: CryptoBriefing·

Ключевые выводы

  • •OpenAI сможет обучать свои ИИ-модели на исторических текстах библиотек Бодлеяна Оксфордского университета в рамках пятилетнего партнерства, анонсированного 4 марта 2025 года.
  • •Пилотный проект, запущенный в феврале, оцифровывает около 3500 диссертаций из общественного достояния, датируемых 1498–1884 годами, с целью сделать многовековые коллекции доступными для поиска и открытыми для всего мира.
  • •Соглашение является частью программы OpenAI NextGenAI, которая выделила 50 млн долларов на исследовательские гранты, вычислительные ресурсы и доступ к API для элитных учреждений, включая Гарвард и MIT.
  • •Оксфорд планирует развернуть ChatGPT Edu по всему университету с сентября 2025 года после пилотного тестирования с участием около 750 пользователей; открытые исследовательские отчеты по проекту оцифровки ожидаются к началу 2026 года.
  • •Некоторые сотрудники университета выразили обеспокоенность репутационными рисками партнерства с OpenAI из-за споров вокруг авторских прав и практики сбора данных, хотя диссертации пилотного проекта находятся в общественном достоянии.
Оксфордский университет разрешил OpenAI обучать ИИ-модели на данных библиотеки Бодлеяна

Оксфордский университет заключил пятилетнее партнерское соглашение с OpenAI, которое позволит компании — разработчику ChatGPT — обучать свои ИИ-модели на исторических текстах библиотек Бодлеяна, одной из старейших и самых известных библиотечных систем мира.

Сотрудничество, анонсированное 4 марта 2025 года, началось с пилотного проекта в феврале, направленного на оцифровку около 3500 диссертаций из общественного достояния, датируемых 1498–1884 годами. Речь идет о текстах возрастом в несколько столетий, которые ранее были практически недоступны для тех, кто не мог лично посетить Оксфорд, — значительная часть этих материалов фактически оставалась вне досягаемости мирового исследовательского сообщества.

Что включает соглашение

Соглашение входит в программу OpenAI NextGenAI, которая выделила 50 млн долларов на исследовательские гранты, вычислительные ресурсы и доступ к API для группы элитных учреждений, включающих наряду с Оксфордом Гарвард и MIT.

Для библиотек Бодлеяна заявленная цель проста: обогащение метаданных с помощью ИИ и улучшенные услуги транскрибации сделают многовековые коллекции доступными для поиска и открытыми для всего мира.

В сфере образования Оксфорд планирует развернуть ChatGPT Edu по всему университету начиная с сентября 2025 года. Инструмент уже прошел пилотное тестирование с участием около 750 пользователей. Результаты исследования по проекту оцифровки ожидаются в открытых отчетах к началу 2026 года, что даст наблюдателям конкретные ориентиры для оценки того, оправдывает ли партнерство заявленные цели.

Опасения сотрудников

Далеко не все в Оксфорде радуются этому соглашению. Сотрудники университета выразили обеспокоенность репутационными рисками партнерства с OpenAI — компанией, которая подвергалась устойчивой критике из-за проблем с авторскими правами, практики сбора данных и стремительной коммерциализации под руководством генерального директора Сэма Альтмана.

Диссертации, охваченные пилотным проектом, находятся в общественном достоянии, то есть авторские права на них не распространяются. Тем не менее сам факт того, что академическое учреждение возрастом около 900 лет передает свои коллекции коммерческой ИИ-компании, вызвал пристальное внимание.

Возникает и вопрос о том, что получает каждая из сторон. Оксфорд получает поддержку оцифровке, вычислительные ресурсы и образовательные инструменты. OpenAI получает качественные, тщательно отобранные обучающие данные из пользующегося глобальным доверием источника, а также неявное одобрение, которое сопутствует партнерству с Оксфордом, — одобрение, ценность которого возрастает на фоне того, что практика работы с данными компании по-прежнему оспаривается.

Более широкая картина

Соглашение Оксфорда вписывается в тенденцию, которая ускоряется по всему сектору высшего образования. Технологические компании все чаще обращаются к академическим учреждениям как к источникам данных — отчасти потому, что данные, собранные путем веб-скрейпинга, сталкиваются с юридическими проблемами, а отчасти потому, что академические корпуса, как правило, качественнее среднего интернет-текста.

На этом фоне реакция на развертывание ChatGPT Edu в Оксфорде и отчеты о оцифровке будет важна для учреждений, рассматривающих аналогичные соглашения. Обязательство программы NextGenAI в 50 млн долларов, распределенное между несколькими учреждениями, значительно, но скромно по сравнению с общими расходами OpenAI, которые исчисляются миллиардами долларов в год.