Как стало известно, ИИ-стартапы сканируют книги для обучения своих языковых моделей, а после утилизируют бумажные версии
Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта
Как стало известно, ИИ-стартапы сканируют книги для обучения своих языковых моделей, а после утилизируют бумажные версии
Проект Anna’s Archive, который называет себя крупнейшей открытой библиотекой в мире, призвал добровольцев по всему миру помогать сканировать и сохранять физические книги. Инициатива появилась на фоне растущих опасений, что крупные технологические компании закупают бумажные книги для обучения искусственного интеллекта (ИИ), после чего некоторые экземпляры уничтожаются в процессе оцифровки.
Источник изображения: ChatGPTАктивисты проекта считают, что человечество может столкнуться с риском потери части культурного наследия, если редкие и малоизвестные издания будут превращаться исключительно в закрытые цифровые наборы данных, доступные только владельцам ИИ-стартапов. Представители Anna’s Archive заявляют, что время для массового сохранения книг ограничено, поскольку знания могут оказаться «монополизированными» корпоративными серверами.
Поводом для беспокойства стали сообщения о том, что некоторые компании, занимающиеся развитием ИИ, закупают большие объемы физических книг, сканируют их, а затем уничтожают оригиналы. В отдельных случаях описывается процесс, при котором переплёты удаляются для ускоренного сканирования страниц, после чего бумажные экземпляры уже невозможно восстановить.
Ситуация уже неоднократно приводил к юридическим спорам, поскольку использование книг для обучения ИИ сталкивается с вопросами авторского права. Anthropic уже шла на урегулирование такого судебного спора, согласившись выплатить 1,5 миллиарда долларов, чтобы избежать обвинений.