Fonti
Resta al passo con l’arte IA
Ricevi nella tua casella le storie migliori della settimana su IA e arte con IA: selezionate, sintetiche, gratis.

Sofia segue i soldi, le politiche e le piattaforme che decidono cosa possono creare gli artisti.
Ricevi nella tua casella le storie migliori della settimana su IA e arte con IA: selezionate, sintetiche, gratis.
Gratis. Disattiva quando vuoi.
Scegli un compagno e scopri cosa ne pensa di questa storia
USA Today Co. e alcune delle sue testate giornalistiche locali hanno intentato una causa contro OpenAI per oltre 250 milioni di dollari, sostenendo che l'azienda abbia estratto e copiato centinaia di migliaia dei loro articoli senza autorizzazione per addestrare i propri modelli di intelligenza artificiale — l'ultima di una serie di importanti cause legali promosse da grandi editori, che stanno progressivamente erodendo il terreno giuridico su cui si reggono tutti i modelli di testo basati sull'IA attualmente sul mercato.
La cifra del risarcimento non è casuale. Quando il New York Times ha citato in giudizio OpenAI alla fine del 2023, non ha specificato un importo in dollari — ha chiesto «miliardi». La richiesta esplicita di 250 milioni di dollari da parte di USA Today Co. è una scelta tattica: un numero concreto e difendibile, ancorato alla portata della presunta copiatura. Offre alla giuria un punto di riferimento preciso e segnala che l'editore ha calcolato il valore delle licenze non percepite.
La causa riguarda non solo la testata principale USA Today, ma anche i giornali locali di proprietà di USA Today Co. — un dettaglio rilevante, poiché il giornalismo locale è stato storicamente la spina dorsale, spesso poco valorizzata, dei corpus di addestramento. È esattamente il tipo di testo regionale, ad alto volume e di natura fattuale che rende gli output dell'IA più credibili e autorevoli. Gli editori ne sono consapevoli e stanno sempre più adeguando i prezzi di conseguenza.
Il New York Times, il gruppo Chicago Tribune e ora USA Today Co. — la lista dei querelanti è ormai abbastanza lunga da rendere non più credibile la definizione di «disputa isolata». Ogni nuovo ricorso si aggiunge al registro delle prove che la pratica, diffusa a livello industriale, di estrarre contenuti dagli editori non era una zona grigia giuridica in cui attori ragionevoli potevano muoversi in buona fede; era una scommessa calcolata sul fatto che il costo del contenzioso sarebbe stato inferiore al costo delle licenze.
Questa scommessa appare sempre più rischiosa di trimestre in trimestre. OpenAI ha firmato accordi di licenza con alcuni editori — tra cui Associated Press e Axel Springer — ma i termini non sono stati resi pubblici, e l'esistenza di accordi a pagamento mina di fatto l'argomento del fair use per l'estrazione non retribuita. Se le licenze erano disponibili, perché non sono state utilizzate?
Per contestualizzare, Stability AI ha affrontato pressioni simili nel 2023, quando artisti e Getty Images hanno intentato causa per i dati di addestramento delle immagini — una disputa che ha costretto l'azienda ad anni di incertezza legale e ha contribuito al suo avvicendamento ai vertici. La traiettoria per i modelli di testo riecheggia da vicino quella precedente battaglia sui dati visivi.
Le ripercussioni pratiche per i creatori di arte con l'IA sono indirette ma reali. I modelli di testo che alimentano l'interpretazione dei prompt, la descrizione dei personaggi e la guida stilistica in strumenti come ChatGPT — che si inserisce nei flussi di lavoro per la generazione di immagini in tutto il settore — sono costruiti sulle stesse pipeline di addestramento ora sotto esame legale. Se i tribunali dovessero emettere ingiunzioni o imporre la rimozione dei dati, la prossima generazione di modelli multimodali potrebbe arrivare con corpus testuali deliberatamente impoveriti, compromettendo la capacità di interpretare prompt creativi articolati.
Le recenti mosse di OpenAI in materia di watermarking nell'UE e conformità normativa suggeriscono che l'azienda stia già operando con un atteggiamento più cauto dal punto di vista legale. Il contenzioso sul copyright è un'ulteriore dimensione di questa stessa pressione. La domanda è se gli accordi legali produrranno framework di licenza in grado di stabilizzare la catena di approvvigionamento dei dati di addestramento — oppure se la frammenteranno in modi che avvantaggiano i soggetti più capitalizzati, in grado di permettersi accordi globali, lasciando i produttori di modelli più piccoli incapaci di competere.
La recente valutazione del senatore Adam Schiff sull'impasse del copyright sull'IA al Congresso chiarisce che un intervento legislativo a favore delle aziende di IA non è imminente. Ciò lascia ai tribunali il ruolo di arena principale, e il ricorso da 250 milioni di dollari di USA Today Co. è l'ultima prova che gli editori intendono utilizzarli in modo aggressivo.
Il prossimo traguardo concreto da monitorare: se OpenAI presenterà istanza di rigetto o tenterà di raggiungere un accordo prima dell'inizio della fase istruttoria — perché è proprio la discovery, che imporrebbe la divulgazione di quali dati siano stati utilizzati e quando, a rappresentare il rischio maggiore per l'azienda.