Источники
Будь в курсе ИИ-арта
Получай на почту главные истории недели об ИИ и ИИ-арте — отобранные, краткие, бесплатно.
Бесплатно. Отписаться можно в любой момент.
Обсуди это с
Выбери компаньона и узнай его мнение об этой истории

София следит за деньгами, политикой и платформами, которые определяют, что могут создавать авторы.
Получай на почту главные истории недели об ИИ и ИИ-арте — отобранные, краткие, бесплатно.
Бесплатно. Отписаться можно в любой момент.
Выбери компаньона и узнай его мнение об этой истории
Недавно рассекреченные судебные материалы по иску New York Times о нарушении авторских прав против OpenAI и Microsoft показывают, что один из руководителей Microsoft в частном порядке охарактеризовал ИИ-скрапинг данных как «крупнейшую кражу труда в истории человечества» — и это несмотря на то, что обе компании формировали обучающие датасеты из платного контента Times.
Материалы, о которых сообщил TechCrunch, свидетельствуют о том, что высокопоставленные сотрудники Microsoft прекрасно понимали юридические и этические последствия масштабного веб-скрапинга. Формулировка одного из руководителей — «крупнейшая кража труда в истории человечества» — поражает именно потому, что она фигурирует во внутренней переписке, а не в судебном документе или публичном заявлении, рассчитанном на аудиторию. Именно такой язык появляется тогда, когда люди считают, что за ними не наблюдают.
Фреймирование «петли смерти» не менее красноречиво. По данным Ars Technica, во внутренних письмах предупреждалось, что ИИ-системы, вытесняющие новостных издателей, в конечном счёте уничтожат высококачественные потоки данных, от которых зависят те же самые ИИ-системы, — самоподрывающийся цикл, который обе компании, судя по всему, осознавали и всё равно запустили.

Microsoft и OpenAI сталкиваются с нарастающими правовыми рисками по мере того, как рассекреченные материалы раскрывают внутреннее понимание этических ставок скрапинга.
Изображение: TechCrunch / TechCrunch AI
Для всех, кто работает с ИИ-генераторами изображений или текстовыми моделями, правовая архитектура, лежащая в основе этих инструментов, всегда оставалась туманной. Данное дело существенно проясняет картину. Та же логика скрапинга, которая извлекала статьи Times, питала и массивные датасеты изображений — LAION, производные Common Crawl, — на которых обучались Stable Diffusion, Midjourney и их преемники. Когда в 2023 году Stability AI столкнулась с аналогичным правовым давлением со стороны Getty Images и группы художников, защита компании частично строилась на аргументе, что скрапинг является стандартной отраслевой практикой. Документы Microsoft свидетельствуют о том, что собственные руководители отрасли понимали ограниченность этого аргумента.
Практические ставки для обучения моделей изображений вполне конкретны. Если суды постановят, что скрапинг платного или защищённого авторским правом контента без лицензии является нарушением — а внутренние признания в «краже» явно не помогают ответчикам, — структура затрат на создание передовых моделей изменится. Лицензионные соглашения станут обязательными, а не опциональными, и эти расходы в конечном счёте перейдут вниз по цепочке: в ценообразование API, уровни подписки на платформах и доступные создателям модели.
Лицензированная платформа для ИИ-ремиксов Universal Music и ElevenLabs, анонсированная ранее в этом году, представляет собой один из вариантов того, как выглядит экономика моделей после эпохи скрапинга: права согласовываются заранее, доходы распределяются. Пойдут ли платформы для генерации изображений по тому же пути, во многом зависит от того, чем завершится это дело.
Рассекреченные материалы — это принципиально иная категория документов по сравнению с засекреченными. Суды снимают с них гриф секретности, когда приходят к выводу, что общественный интерес перевешивает претензии ответчиков на конфиденциальность, — порог, который сам по себе сигнализирует о скептицизме суда. Юридическая команда NYT теперь имеет в протоколе, словами самих ответчиков, признание того, что оспариваемые действия причинили вред.
«Крупнейшая кража труда в истории человечества.»
— Руководитель Microsoft, внутренняя переписка (через TechCrunch)
Для создателей, использующих ИИ-инструменты, построенные на аналогичных потоках данных, вопрос уже не в том, является ли правовой риск теоретическим. Вопрос в том, как быстро движутся суды и успели ли крупные платформы — включая те, что сегодня обеспечивают генерацию изображений с помощью ИИ, — получить достаточно лицензированных данных, чтобы пережить неблагоприятное решение. Следующее существенное слушание по делу NYT v. OpenAI определит, удастся ли ответчикам ограничить использование этих внутренних признаний в качестве доказательств.