Оксфордський університет змушує OpenAI використовувати старі тексти з Бодліанської бібліотеки для навчання своїх моделей штучного інтелекту, згідно з внутрішнім документом, з яким ознайомився Guardian. Ітан Пенні та Ден Мілмо повідомили про цю історію в суботу. Згідно з документом, текст, відсканований OpenAI у бібліотеках, був включений у навчальні дані компанії. У березні 2025 року Оксфордський університет […]

Оксфордський університет змушує OpenAI використовувати старі тексти з Бодліанської бібліотеки для навчання своїх моделей штучного інтелекту, згідно з внутрішнім документом, з яким ознайомився Guardian. Ітан Пенні та Ден Мілмо повідомили про цю історію в суботу.
Згідно з документом, текст, відсканований OpenAI у бібліотеках, був включений у навчальні дані компанії.
У березні 2025 року Оксфордський університет оголосив про угоду з OpenAI. Тоді Оксфордський університет заявив, що інструменти OpenAI допоможуть сканувати рідкісні документи, роблячи їх доступними для більшої кількості студентів і науковців. Там не сказано, що текст буде використовуватися для навчання ШІ.
The Guardian повідомляє, що до червня 2025 року Бодліан надіслав OpenAI 125 000 сканів своїх старих докторських дисертацій. Серед них – статті, написані в університетах Європи та Сполучених Штатів у 19-му та 20-му століттях.
Записи зустрічей персоналу, отримані Guardian через запит на свободу інформації, показують, що деякі співробітники мали сумніви. Вони були стурбовані негативним впливом на репутацію Оксфорда та використанням енергії ШІ.
Однак Оксфорд сказав, що скани невеликі, не підлягають авторському праву та не є ексклюзивними для OpenAI. Представник сказав, що бібліотека володіє правами та планує почати розміщувати скани в Інтернеті найближчими місяцями.
Речник також сказав, що аспекти навчання ШІ не були приховані. Хоча основною метою Оксфордського університету було сканування, співробітники були відкриті, що текст також буде використовуватися для навчання моделей.
«Більше мільярда людей використовують цю технологію у своєму повсякденному житті, тому важливо, щоб ми відображали різні культури, історії та погляди», — сказав Guardian представник OpenAI.
Оксфорд є єдиним британським членом групи NextGenAI OpenAI. Серед інших членів — Бостонська публічна бібліотека, Каліфорнійський технологічний інститут, Массачусетський технологічний інститут і Мічиганський університет.
Угода відбувається в той час, коли компанії, що займаються штучним інтелектом, скуповують друковані книги для необроблених навчальних даних, оскільки мережа зараз переповнена текстами, створеними штучним інтелектом. Деякі покупці розривають книги, щоб відсканувати їх, викликаючи гнів продавців вживаних книг.
У серпні 404 Media відстежили коробку з рідкісними книгами на сайті Amazon, який використовує штучний інтелект для сканування та знищення книг. The Guardian повідомляє, що книги Bodleian залишаться недоторканими згідно з угодою.