Крупнейшая открытая библиотека призвала спасти книги от ИИ

Источник: 

Грамота.ру
Крупнейшая открытая библиотека призвала спасти книги от ИИ

Изображение: overclockers.ru

Все началось с того, что компания Anthropic была вынуждена заплатить 1,5 млрд долларов в рамках урегулирования иска о нарушении авторских прав, поданного в 2024 году. Компания, занимающаяся разработкой искусственного интеллекта, использовала для обучения своих моделей книги из «пиратской» коллекции. Именно этот факт суд счел нарушением.

В то же время суд подтвердил, что использование существующих произведений для обучения моделей ИИ является добросовестным, поэтому не нарушает авторских прав. Это дало зеленый свет на массовую скупку произведений всем компаниям, обучающим языковые модели искусственного интеллекта.

Открытый онлайн-архив печатных изданий Anna’s Archive в своем блоге обратил внимание на то, что ИИ-компании массово скупают редкие, неликвидные или малотиражные книги. Причина кроется в том, что большинство контента в Интернете уже «скормлено» моделям. Многие новые тексты содержат следы ИИ и могут испортить результаты на выходе. А редкие книги, единичные экземпляры которых находятся в библиотеках и букинистических магазинах, содержат свежий контент для обучения, с хорошей редактурой и структурой, а также редкой терминологией.

Проблема в том, что после сканирования редкие экземпляры книг просто уничтожаются: промышленные сканеры автоматически срезают у них корешок, а сшивать их обратно компании невыгодно. К тому же уничтожение оригинального материала означает, что конкуренты не смогут использовать эти же книги для обучения своих моделей ИИ, что дает первоначальному покупателю преимущество.

Проект Anna’s Archive выпустил призыв к добровольцам по всему миру: проект просит помочь со сканированием и сохранением физических книг. По данным инициативы, время стремительно уходит — знания рискуют оказаться навсегда монополизированы на частных серверах компаний, разрабатывающих искусственный интеллект.

«Если каждый человек отсканирует книгу, а во всем мире 10 миллионов добровольцев, мы сможем получить 10 миллионов бесценных экземпляров», — говорится в сообщении в блоге. Те, кто хочет проводить масштабные сканирования и загружать много книг, могут обратиться в архив за поддержкой: его представители заявляют, что «могут помочь оплатить расходы на сканирование и предложить другую форму вознаграждения».

Проект был создан в 2022 году с целью «каталогизации всех существующих книг и отслеживания прогресса человечества на пути к тому, чтобы сделать все эти книги легкодоступными в цифровой форме». По состоянию на 23 января 2026 года архив включает свыше 61,6 млн книг и 95,6 млн статей. При этом Anna’s Archive сам неоднократно получал обвинения в свой адрес из-за хранения онлайн-копий книг без разрешения правообладателей.

Наш сайт использует файлы cookie для вашего максимального удобства. Пользуясь сайтом, вы даете согласие с политикой конфиденциальности.
Понятно