Джерела
Будь на крок попереду у ШІ-арті
Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.
Обговори це з
Обери компаньйона і дізнайся його думку про цю історію

Софія стежить за грошима, політикою та платформами, які визначають, що можуть створювати автори.
Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.
Обери компаньйона і дізнайся його думку про цю історію
Нещодавно розсекречені судові матеріали у справі New York Times проти OpenAI розкривають, що і OpenAI, і Microsoft приватно задокументували — у власних внутрішніх записах — ризик того, що їхні практики навчання ШІ можуть створити «петлю загибелі», яка деградує відкритий веб. Щонайменше один виконавець Microsoft охарактеризував скрейпінг як «найбільшу крадіжку праці в історії людства».
Фраза «петля загибелі» фігурує у власній документації компаній, а не в позові Times. Логіка проста й самовикривальна: системи ШІ скрейплять веб для навчання на контенті, а потім надають відповіді безпосередньо користувачам, не направляючи їх на вихідні сайти, — це позбавляє видавців трафіку та рекламних доходів, необхідних для створення нового контенту, що деградує веб, на якому ті самі системи ШІ мають навчатися далі. З кожним поколінням моделей петля затягується.

Сторінка з розсекречених судових матеріалів, де директор Microsoft з прикладних наук описує отримання даних ШІ як 'приголомшливу крадіжку безпрецедентних масштабів'.
Зображення: The Verge / The Verge AI
Показання Сатьї Наделли є особливо промовистими. За даними The Verge, Наделла під присягою погодився, що взаємодія з чатботами «замінює» відвідування відповідних вебсайтів — поступка, яка безпосередньо підтримує теорію шкоди Times. Це не твердження з позовної заяви позивача; це генеральний директор відповідача — на запису.
Щодо OpenAI: внутрішні записи свідчать, що компанія ще у 2021 році знала, що її API може дослівно відтворювати наявний контент, і що запобігання запам'ятовуванню є важливим «для дотримання принципу добросовісного використання та мінімізації» правової відповідальності. Компанія також зазначала, що обходить платні стіни та порушує умови надання послуг під час отримання навчальних даних, — і що окремі особи всередині організації вважали ці проблеми прийнятними витратами.
«Ця справа стосується того, що директор Microsoft з прикладних наук назвав 'приголомшливою крадіжкою безпрецедентних масштабів'; можливо, 'найбільшою крадіжкою праці в історії людства'.»
— Судовий матеріал, NYT проти OpenAI
Це не перший раз, коли велика AI-компанія стикається з розплатою за джерела навчальних даних. Коли Stability AI зіткнулася з аналогічними звинуваченнями у 2023 році, позиція компанії зводилася до того, що скрейпінг є юридично невирішеною територією. Те, що структурно відрізняє ситуацію OpenAI-Microsoft, — це те, що шкідливі формулювання походять зсередини: від керівників і прикладних науковців, а не від ворожих експертів.

Розсекречений матеріал, що показує визнання OpenAI у 2021 році: її API може дослівно відтворювати наявний контент — позначено як проблему дотримання принципу добросовісного використання.
Зображення: The Verge / The Verge AI
Для творців AI-арту похідні ставки є реальними. Навчальні датасети, що лежать в основі моделей генерації зображень, стикаються з аналогічними питаннями щодо скрейпінгу візуального контенту з вебу без компенсації. Якщо справа NYT призведе до рішення — або до мирової угоди з умовами ліцензування, — що встановить прецедент для тексту, очікуйте, що ця система буде застосована до даних зображень майже одразу. Платформи, які вже перейшли до ліцензованих або синтетичних навчальних даних, отримають структурну перевагу; ті, що досі покладаються на нефільтрований вебскрейпінг, зіткнуться з тією самою відповідальністю, яка зараз розглядається в Манхеттені.
Каталог доступних моделей Charmloop вже відображає частину цього зсуву: провайдери дедалі частіше розрізняють моделі, навчені на ліцензованих і скрейплених датасетах, — відмінність, яка ось-ось набуде юридичного, а не лише етичного значення.
Наш попередній матеріал про нередаговані матеріали Microsoft виклав початкові розкриття документів; ці нещодавно розсекречені записи йдуть далі, вміщуючи формулювання «петлі загибелі» та визнання щодо запам'ятовування безпосередньо до судового протоколу.
Дата судового розгляду ще не призначена. Наступний визначальний момент — те, як суд вирішить клопотання про винесення рішення без розгляду справи по суті: рішення, яке або змусить до мирової угоди, або відправить документи про «петлю загибелі» перед присяжними.