Джерела
Будь на крок попереду у ШІ-арті
Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.
Обговори це з
Обери компаньйона і дізнайся його думку про цю історію

Софія стежить за грошима, політикою та платформами, які визначають, що можуть створювати автори.
Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.
Обери компаньйона і дізнайся його думку про цю історію
Щойно розсекречені судові матеріали у справі про авторські права New York Times проти OpenAI та Microsoft свідчать: один із керівників Microsoft приватно описав ШІ-скрейпінг даних як «найбільшу крадіжку праці в історії людства» — і це попри те, що обидві компанії формували навчальні датасети з платного контенту Times.
Ці матеріали, про які повідомив TechCrunch, свідчать: старші керівники Microsoft не мали жодних ілюзій щодо правових та етичних наслідків масштабного веб-скрейпінгу. Формулювання одного з керівників — «найбільша крадіжка праці в історії людства» — вражає саме тому, що з'являється у внутрішньому листуванні, а не в судовому документі чи публічній заяві, розрахованій на аудиторію. Це мова, яка виникає тоді, коли люди вважають, що за ними не спостерігають.
Формулювання «петлі загибелі» не менш промовисте. За даними Ars Technica, внутрішні листи попереджали: ШІ-системи, що витісняють новинних видавців, зрештою знищать ті самі канали якісних даних, від яких залежать ці ж ШІ-системи, — самознищувальний цикл, який обидві компанії, судячи з усього, усвідомлювали і все одно запустили.

Microsoft та OpenAI стикаються з наростаючими правовими ризиками, оскільки розсекречені матеріали розкривають внутрішнє усвідомлення етичних наслідків скрейпінгу.
Зображення: TechCrunch / TechCrunch AI
Для всіх, хто працює з ШІ-генераторами зображень або текстовими моделями, правова архітектура під цими інструментами завжди була непрозорою. Ця справа суттєво прояснює картину. Та сама логіка скрейпінгу, що витягувала статті Times, живила й масштабні датасети зображень — LAION, похідні від Common Crawl, — на яких навчалися Stable Diffusion, Midjourney та їхні наступники. Коли Stability AI у 2023 році зіткнулася з аналогічним правовим тиском з боку Getty Images та групи художників-візуалістів, захист компанії частково спирався на аргумент, що скрейпінг є стандартною галузевою практикою. Ці документи Microsoft свідчать: власні керівники галузі знали, що цей аргумент має межі.
Практичні наслідки для навчання моделей зображень є прямими. Якщо суди вирішать, що скрейпінг платного або захищеного авторським правом контенту без ліцензії є порушенням — а внутрішні визнання «крадіжки» аж ніяк не допомагають відповідачам — структура витрат на побудову фронтирних моделей зміниться. Ліцензійні угоди стануть обов'язковими, а не факультативними, і ці витрати зрештою перетечуть далі: у ціноутворення API, рівні підписки на платформах і моделі, доступні для творців.
Платформа для ліцензованого ремікшування музики за допомогою ШІ від Universal Music та ElevenLabs, анонсована раніше цього року, є одним із варіантів того, як виглядає економіка моделей після скрейпінгу — права узгоджуються заздалегідь, доходи розподіляються. Чи підуть платформи для генерації зображень тим самим шляхом, значною мірою залежить від того, як вирішиться ця справа.
Розсекречені матеріали — це інша категорія документів порівняно з відредагованими. Суди розкривають їх, коли визначають, що суспільний інтерес переважає претензії відповідачів на конфіденційність, — поріг, який сам по собі сигналізує про скептицизм суддів. Юридична команда NYT тепер має у протоколі, словами самих відповідачів, визнання того, що оскаржувані дії завдали шкоди.
«Найбільша крадіжка праці в історії людства.»
— керівник Microsoft, внутрішнє листування (через TechCrunch)
Для творців, які використовують ШІ-інструменти, побудовані на подібних конвеєрах даних, питання вже не в тому, чи є правовий ризик теоретичним. Питання в тому, наскільки швидко рухаються суди і чи зібрали великі платформи — включно з тими, що живлять генерацію зображень за допомогою ШІ сьогодні, — достатньо ліцензованих даних, щоб пережити несприятливе рішення. Наступне суттєве слухання у справі NYT v. OpenAI визначить, чи збережуть ці внутрішні визнання свою доказову силу після розгляду клопотання про обмеження їх використання.