La Universidad de Oxford se asocia con OpenAI para entrenar modelos de IA con textos de la Biblioteca Bodleian
Puntos clave
- •OpenAI podrá entrenar sus modelos de IA con textos históricos de las Bibliotecas Bodleian de Oxford en el marco de una asociación de cinco años anunciada el 4 de marzo de 2025.
- •Un proyecto piloto de febrero está digitalizando alrededor de 3,500 disertaciones de dominio público fechadas entre 1498 y 1884, con el objetivo de hacer que las colecciones centenarias sean buscables y accesibles globalmente.
- •El acuerdo forma parte del programa NextGenAI de OpenAI, que ha comprometido 50 millones de dólares en subvenciones de investigación, recursos de cómputo y acceso a la API para instituciones de élite como Harvard y MIT.
- •Oxford planea implementar ChatGPT Edu en toda la universidad a partir de septiembre de 2025, tras probarla con unos 750 usuarios, y se esperan informes de investigación de acceso abierto del proyecto de digitalización para principios de 2026.
- •Algunos miembros del personal universitario han expresado preocupación por el riesgo reputacional de asociarse con OpenAI debido a sus controversias de derechos de autor y prácticas de obtención de datos, aunque las disertaciones del piloto son de dominio público.

La Universidad de Oxford ha firmado una asociación de cinco años con OpenAI que permitirá a la empresa detrás de ChatGPT entrenar sus modelos de IA con textos históricos de las Bibliotecas Bodleian, uno de los sistemas bibliotecarios más antiguos y reconocidos del mundo.
La colaboración, anunciada el 4 de marzo de 2025, comenzó con un proyecto piloto en febrero enfocado en digitalizar alrededor de 3,500 disertaciones de dominio público fechadas entre 1498 y 1884. Se trata de textos de siglos de antigüedad que antes eran en gran medida inaccesibles para quienes no podían visitar Oxford físicamente, lo que significaba que gran parte de este material quedaba fuera del alcance de la comunidad investigadora global.
Qué implica el acuerdo
El acuerdo forma parte del programa NextGenAI de OpenAI, que ha comprometido 50 millones de dólares en subvenciones de investigación, recursos de cómputo y acceso a la API para un grupo de instituciones de élite que incluye a Harvard y MIT junto con Oxford.
Para las Bibliotecas Bodleian, el objetivo declarado es claro: el enriquecimiento de metadatos impulsado por IA y los servicios mejorados de transcripción harán que las colecciones centenarias sean buscables y accesibles a nivel global.
En el ámbito educativo, Oxford planea implementar ChatGPT Edu en toda la universidad a partir de septiembre de 2025. La herramienta ya ha sido probada con unos 750 usuarios. Los hallazgos de investigación del proyecto de digitalización se esperan en informes de acceso abierto para principios de 2026, lo que ofrece a los observadores puntos de referencia concretos para evaluar si la asociación cumple sus objetivos declarados.
Preocupaciones del personal
No todos en Oxford celebran el acuerdo. El personal universitario ha expresado su preocupación por el riesgo reputacional de asociarse con OpenAI, una empresa que ha enfrentado críticas persistentes por temas de derechos de autor, prácticas de obtención de datos y su rápida comercialización bajo el director general Sam Altman.
Las disertaciones cubiertas por el piloto son de dominio público, lo que significa que no aplica ningún derecho de autor. Aun así, la imagen de una institución académica de aproximadamente 900 años entregando sus colecciones a una empresa de IA con fines de lucro ha generado escrutinio.
También está la cuestión de qué gana cada parte Oxford recibe apoyo de digitalización, recursos de cómputo y herramientas educativas. OpenAI recibe datos de entrenamiento curados y de alta calidad de una fuente de confianza mundial, además del respaldo implícito que conlleva una asociación con Oxford, un respaldo cuyo valor se ve acentuado por el hecho de que las prácticas de datos de la empresa siguen siendo objeto de controversia.
El panorama general
El acuerdo de Oxford encaja en un patrón que se ha acelerado en la educación superior. Las empresas tecnológicas recurren cada vez más a instituciones académicas como fuentes de datos, en parte porque los datos extraídos de la web enfrentan desafíos legales y en parte porque los corpus académicos suelen ser de mayor calidad que el texto promedio de internet.
En ese contexto, la recepción del despliegue de ChatGPT Edu en Oxford y de los informes de digitalización será observada por instituciones que evalúan acuerdos similares. El compromiso de 50 millones de dólares del programa NextGenAI, distribuido entre varias instituciones, es considerable pero modesto en comparación con el gasto total de OpenAI, que se ha medido en miles de millones de dólares anuales.