Źródła
Bądź na bieżąco ze sztuką AI
Otrzymuj na maila najważniejsze historie tygodnia o AI i sztuce AI — wyselekcjonowane, zwięzłe, za darmo.

Sofia śledzi pieniądze, regulacje i platformy, które kształtują to, co mogą tworzyć twórcy.
Otrzymuj na maila najważniejsze historie tygodnia o AI i sztuce AI — wyselekcjonowane, zwięzłe, za darmo.
Za darmo. Wypisz się w każdej chwili.
Wybierz towarzysza i poznaj jego zdanie na temat tej historii
USA Today Co. oraz kilka jej lokalnych gazet pozywają OpenAI o ponad 250 milionów dolarów, zarzucając firmie skrobanie i kopiowanie setek tysięcy ich artykułów bez autoryzacji w celu trenowania modeli AI — to kolejny w serii pozwów dużych wydawców, które systematycznie zawężają prawne podstawy dla każdego modelu tekstowego AI na rynku.\n\n## Kluczowe informacje\n\n- USA Today Co. złożyła pozew przeciwko OpenAI w czwartek, domagając się odszkodowania przekraczającego 250 milionów dolarów.\n- Skarga zarzuca OpenAI skopiowanie „setek tysięcy" artykułów z USA Today i powiązanych lokalnych gazet bez pozwolenia.\n- O pozwie jako pierwszy poinformował Reuters, a potwierdził The Verge.\n- To jedna z największych kwot odszkodowania żądanych w fali spraw o naruszenie praw autorskich przez AI wniesionych przez wydawców prasowych.\n- Wynik może wpłynąć na to, na jakich korpusach tekstowych przyszłe modele AI będą mogły legalnie się trenować — z bezpośrednimi konsekwencjami dla możliwości modeli i jakości kreatywnych rezultatów.\n\n## Kwota 250 milionów dolarów i co oznacza\n\nKwota odszkodowania nie jest przypadkowa. Kiedy New York Times pozwał OpenAI pod koniec 2023 roku, nie podał konkretnej kwoty — domagał się „miliardów". Wyraźne żądanie 250 milionów dolarów przez USA Today Co. to wybór taktyczny: konkretna, możliwa do obrony liczba powiązana ze skalą domniemanego kopiowania. Daje to ławie przysięgłych punkt odniesienia i sygnalizuje, że wydawca przeliczył wartość utraconych licencji.\n\nPozew obejmuje nie tylko flagowy tytuł USA Today, ale także lokalne gazety należące do USA Today Co. — szczegół, który ma znaczenie, ponieważ lokalne reportaże historycznie stanowiły niegłośny trzon korpusów treningowych. To właśnie ten rodzaj regionalnego, obszernego, faktograficznego tekstu sprawia, że wyniki AI brzmią rzetelnie i autorytatywnie. Wydawcy to wiedzą i coraz częściej odpowiednio to wyceniają.\n\n## Wzorzec, którego OpenAI nie może już nazywać odosobnionym\n\nNew York Times, grupa Chicago Tribune, a teraz USA Today Co. — lista powodów jest już na tyle długa, że „odosobniony spór" nie jest już wiarygodnym ujęciem. Każde nowe złożenie pozwu dodaje do materiału dowodowego, że branżowa praktyka skrobania treści wydawców nie była prawną strefą szarą, po której rozsądni aktorzy mogli poruszać się w dobrej wierze; to była przemyślana gra, że koszt sporów sądowych będzie niższy niż koszt licencjonowania.\n\nTa gra wygląda coraz bardziej niepewnie z każdym kwartałem. OpenAI podpisało umowy licencyjne z niektórymi wydawcami — między innymi z Associated Press i Axel Springer — ale warunki nie zostały ujawnione, a istnienie płatnych umów prawdopodobnie podważa argument o dozwolonym użytku dla niepłatnego skrobania. Jeśli licencjonowanie było dostępne, dlaczego nie zostało wykorzystane?\n\nDla kontekstu, Stability AI stanęło przed podobną presją w 2023 roku, gdy artyści i Getty Images złożyli pozew dotyczący danych treningowych obrazów — spór, który zmusił firmę do lat niepewności prawnej i przyczynił się do rotacji w kierownictwie. Trajektoria dla modeli tekstowych teraz mocno przypomina tamtą wcześniejszą walkę o dane obrazowe.\n\n## Co presja prawna robi z treningiem modeli na początku łańcucha\n\nPraktyczna konsekwencja dla twórców AI-art jest pośrednia, ale realna. Modele tekstowe, które napędzają interpretację promptów, opisy postaci i wskazówki stylistyczne w narzędziach takich jak ChatGPT — które wpływają na przepływy pracy generowania obrazów w całej branży — są budowane na tych samych pipeline'ach treningowych, które teraz są pod kontrolą prawną. Jeśli sądy zaczną wydawać nakazy sądowe lub zmuszać do usuwania danych, następna generacja modeli multimodalnych może pojawić się z celowo zubożonymi korpusami tekstowymi, wpływając na to, jak dobrze parsują niuansowane prompty kreatywne.\n\nWłasne niedawne ruchy OpenAI dotyczące znakowania wodnego UE i zgodności sugerują, że firma już działa w bardziej ostrożnej postawie prawnej. Spory o prawa autorskie to kolejny wymiar tej samej presji. Pytanie brzmi, czy ugody prawne wyprodukują ramy licencyjne, które ustabilizują łańcuch dostaw danych treningowych — czy też pofragmentują go w sposób, który będzie faworyzować dobrze skapitalizowanych graczy mogących sobie pozwolić na umowy zbiorcze i pozostawi mniejszych deweloperów modeli niezdolnych do konkurowania.\n\nNiedawna ocena senatora Adama Schiffa dotycząca impasu w Kongresie w sprawie praw autorskich AI jasno pokazuje, że legislacyjna ulga dla firm AI nie nadejdzie wkrótce. To pozostawia sądy jako główną arenę, a złożenie pozwu o 250 milionów dolarów przez USA Today Co. to najnowszy dowód, że wydawcy zamierzają ich używać agresywnie.\n\nNajbliższy konkretny kamień milowy do obserwowania: czy OpenAI będzie dążyć do oddalenia pozwu, czy spróbuje się ugodzić przed rozpoczęciem postępowania dowodowego — ponieważ postępowanie dowodowe, które zmusiłoby do ujawnienia dokładnie jakie dane zostały użyte i kiedy, to to, na czym firma ma najwięcej do stracenia.