Источники
Будь в курсе ИИ-арта
Получай на почту главные истории недели об ИИ и ИИ-арте — отобранные, краткие, бесплатно.
Бесплатно. Отписаться можно в любой момент.
Обсуди это с
Выбери компаньона и узнай его мнение об этой истории

Получай на почту главные истории недели об ИИ и ИИ-арте — отобранные, краткие, бесплатно.
Бесплатно. Отписаться можно в любой момент.
Выбери компаньона и узнай его мнение об этой истории
Продавцы редких книг по всей отрасли сообщают о тревожной закономерности: оптовые заказы на книги, вышедшие из печати и труднодоступные, после которых появляются свидетельства уничтожения томов — это питает подозрения, что ИИ-компании приобретают физические тексты специально для их сканирования в целях формирования обучающих данных.
Согласно репортажу Ars Technica, дилеры описывают покупателей — нередко действующих через агентов или подставные аккаунты, — которые заказывают большие партии конкретных малоизвестных изданий, объединённых одной общей чертой: они недоступны в оцифрованном виде нигде. Заказы размещаются без типичного для коллекционера интереса к состоянию экземпляра, его происхождению или перепродажной стоимости. Книги поступают к покупателю — и след обрывается. Некоторые продавцы впоследствии обнаруживали, что их издания нигде не фигурируют: ни на рынках перепродажи, ни в библиотечных фондах, — что наводит на мысль о том, что физические экземпляры попросту прекратили существование после покупки.
Если именно это и происходит, правовая логика здесь проста: покупка физической книги даёт право собственности на данный объект. Сканирование её для личного использования находится в правовой серой зоне, однако последующее уничтожение устраняет любые свидетельства копирования. Это куда более юридически защищённая позиция, чем парсинг защищённых авторским правом текстов из интернета — стратегия, которая уже втянула несколько ИИ-компаний в громкие судебные разбирательства.
Объектами, по всей видимости, становятся книги, которые так и не попали в Project Gutenberg, Internet Archive или какой-либо крупный проект оцифровки: узкоспециализированные академические тексты, региональные исторические исследования, специализированные технические руководства, малоизвестная художественная литература. Это именно те пробелы в существующих обучающих корпусах, которые разработчики ИИ публично признавали своим желанием заполнить. Большие языковые модели и системы генерации изображений, обученные на более широких и редких текстовых распределениях, как правило, лучше справляются с нишевыми запросами и специализированными знаниями — именно тот уровень нюансированного результата, которого всё активнее добиваются авторы, использующие инструменты генерации изображений с помощью ИИ.
Для создателей ИИ-арта косвенный эффект менее очевиден, чем выход новой модели или изменение цен, однако он вполне реален: широта и специфичность обучающих данных модели определяет то, что она способна убедительно воспроизводить. Модель, обученная на редкой истории дизайна, малоизвестной мифологии или специализированной литературе о ремёслах, будет надёжнее справляться с нишевыми эстетическими запросами, чем та, что обучена исключительно на том, что уже было доступно онлайн.
Рынок редких книг невелик и строится на личных связях — а значит, информация распространяется быстро. Дилеры обмениваются наблюдениями, и некоторые уже начали включать в договоры купли-продажи антисканирующие оговорки или попросту отказываться от заказов, соответствующих характерному профилю: большие партии, безразличие к состоянию экземпляра, отсутствие заявленной коллекционной цели. Другие уведомляют профессиональные ассоциации.
Сложность состоит в установлении авторства. Покупатели редко называют себя, а использование посредников делает практически невозможным указание на конкретную ИИ-компанию. Ни один крупный разработчик ИИ не подтвердил эту практику. Подозрение по-прежнему основывается на закономерности: достаточно устойчивой среди независимых продавцов, чтобы воспринимать её всерьёз, — однако без документальных следов, необходимых для судебного преследования.
Это вписывается в более широкий круг вопросов о том, что ИИ-компании делают для формирования обучающих данных, — вопросов, которые уже породили иски о веб-парсинге, споры об использовании защищённых авторским правом изображений и продолжающиеся дискуссии о стандартах метаданных происхождения, таких как водяные знаки C2PA. Физические книги, как выясняется, тоже находятся в пределах этого спорного периметра.
Если практика будет подтверждена в масштабе, это станет значительной эскалацией: речь пойдёт уже не просто о копировании существующего цифрового контента, но об активном преобразовании и уничтожении физических культурных артефактов ради этой цели. Сообщество торговцев редкими книгами достаточно невелико, чтобы даже скромная кампания по приобретению, организованная хорошо финансируемой ИИ-лабораторией, могла нанести ощутимый ущерб доступности незаменимых текстов.