Великобритания

Оксфордский университет разрешил OpenAI обучать модели ИИ на текстах Бодлианской библиотеки, сообщает The Guardian

Оксфордский университет разрешил компании OpenAI использовать старые тексты из своей Бодлианской библиотеки для обучения своих моделей искусственного интеллекта, согласно внутренним документам, оказавшимся в распоряжении The Guardian. Авторы материала Итан Пенни и Дэн Милмо опубликовали его в субботу.

Оксфордский университет разрешил OpenAI обучать модели ИИ на текстах Бодлианской библиотеки, сообщает The Guardian

В документах говорится, что тексты, которые OpenAI сканировала в библиотеке, пополнили обучающие данные компании.

Оксфорд объявил о своей сделке с OpenAI в марте 2025 года. Тогда заявлялось, что инструменты OpenAI помогут оцифровать редкие тексты, чтобы с ними могли ознакомиться больше студентов и исследователей. О том, что тексты будут использоваться для обучения ИИ, не сообщалось.

К июню 2025 года Бодлианская библиотека передала OpenAI 125 000 сканированных копий старых кандидатских и докторских диссертаций, сообщает The Guardian. Среди них — работы, написанные в университетах Европы и США в XIX и XX веках.

Заметки с собраний сотрудников, которые The Guardian получила в ответ на запрос о свободе информации, показывают, что у некоторых работников были сомнения. Они опасались репутационного ущерба для Оксфорда и высокого энергопотребления ИИ.

Тем не менее в Оксфорде заявили, что масштабы сканирования невелики, материалы не защищены авторским правом, а соглашение не является эксклюзивным для OpenAI. Библиотека сохраняет за собой права и начнет публиковать сканы в интернете в ближайшие несколько месяцев, сообщил представитель университета.

Представитель также добавил, что аспект обучения ИИ никто не скрывал. Главной целью Оксфорда было сканирование, но сотрудники открыто говорили о том, что тексты также будут использоваться для обучения моделей.

«Учитывая, что этой технологией в повседневной жизни пользуются более миллиарда человек, важно, чтобы она отражала разные культуры, истории и точки зрения», — заявил представитель OpenAI изданию The Guardian.

Оксфорд — единственный британский участник группы NextGenAI, созданной OpenAI. В число других участников входят Бостонская общественная библиотека, Калифорнийский технологический институт, Массачусетский технологический институт (MIT) и Мичиганский университет.

Эта сделка заключается на фоне того, как компании, занимающиеся разработкой ИИ, скупают печатные книги для получения качественных обучающих данных, поскольку интернет теперь переполнен текстами, созданными искусственным интеллектом. Некоторые покупатели разрезают книги для их сканирования, что вызвало возмущение у букинистов.

В августе издание 404 Media проследило путь партии редких книг до объекта Amazon, где книги сканируют и уничтожают ради обучения ИИ. Как сообщает The Guardian, книги из Бодлианской библиотеки в рамках этого соглашения остаются в целости и сохранности.

Опубликовано 26 сентября 2026 - 09:06 Наверх