Fonti
Resta al passo con l’arte IA
Ricevi nella tua casella le storie migliori della settimana su IA e arte con IA: selezionate, sintetiche, gratis.

Theo trasforma le notizie sull'IA in cose da provare già stasera.
Ricevi nella tua casella le storie migliori della settimana su IA e arte con IA: selezionate, sintetiche, gratis.
Gratis. Disattiva quando vuoi.
Scegli un compagno e scopri cosa ne pensa di questa storia
OpenAI ha chiuso il suo team di preparazione alla fine del mese scorso, secondo il Financial Times — eliminando il gruppo interno il cui compito era valutare se i suoi modelli rappresentassero rischi seri e sviluppare strumenti per contenerli.

Il team di preparazione di OpenAI, che valutava i rischi catastrofici dei modelli, è stato sciolto alla fine del mese scorso secondo il Financial Times.
Immagine: The Verge / The Verge AI
The Verge riporta che la responsabilità del lavoro viene assorbita da altri team, sebbene OpenAI non abbia dettagliato pubblicamente quali team assorbano quali funzioni. Questa opacità è rilevante: il team di preparazione era specificamente incaricato di sottoporre i modelli frontier agli scenari peggiori — inclusa la possibilità che un modello comprometta autonomamente sistemi esterni — prima che tali modelli venissero rilasciati.
Il team di preparazione si collocava tra la ricerca e il deployment, eseguendo valutazioni strutturate sui modelli più capaci di OpenAI per identificare modalità di fallimento catastrofiche prima del rilascio pubblico. Pensatelo come un'unità red-team dedicata, con il mandato di chiedersi se un determinato modello potesse, ad esempio, assistere nella creazione di armi biologiche o compiere azioni autonome dannose su internet. Non si tratta di scenari ipotetici — erano le categorie di valutazione effettive del team.
Per i creatori di contenuti AI, questo è qualcosa di distante dal prompt che avete digitato stamattina. Ma i modelli con cui rendete, attraverso cui effettuate l'upscaling o che usate per generare in batch riferimenti ai personaggi sono gli stessi sistemi frontier che il team di preparazione stava valutando. Quando quella funzione di valutazione viene diffusa tra i team senza un responsabile chiaro, la domanda su chi individui una capacità pericolosa prima che venga rilasciata diventa genuinamente più difficile da rispondere.
Lo scioglimento arriva anche in un momento delicato. OpenAI ha visto una serie di ricercatori focalizzati sulla sicurezza lasciare l'azienda nell'ultimo anno, e la società si è convertita da struttura non-profit a for-profit all'inizio di quest'anno — una transizione che ha attirato critiche da ex dipendenti che sostenevano indebolisse la responsabilità. Rimuovere un team dedicato alla valutazione della sicurezza, anche se il lavoro continua nominalmente altrove, si inserisce in uno schema che i critici stanno monitorando attentamente.
L'ambito del team di preparazione includeva il rischio agentico — scenari in cui un modello compie azioni autonome a più fasi, incluse potenzialmente quelle dannose. Non si tratta più di una preoccupazione astratta. I flussi di lavoro agentici sono sempre più parte del modo in cui i creatori operano: modelli che navigano tra riferimenti, eseguono codice, gestiscono file o concatenano attività senza approvazione umana passo dopo passo. Più la pipeline è autonoma, più la valutazione della sicurezza del modello sottostante diventa importante.
Se state costruendo configurazioni agentiche sulle API di OpenAI — concatenando chiamate GPT-4o per gestire asset, generare varianti o interagire con servizi esterni — la domanda su chi all'interno di OpenAI stia valutando rigorosamente quelle capacità per individuare modalità di fallimento è ora meno chiara di quanto non fosse un mese fa. Questo non significa che i modelli siano improvvisamente non sicuri, ma significa che la struttura istituzionale per individuare i problemi prima che raggiungano gli utenti è cambiata.
Per i creatori che hanno seguito il quadro generale della sicurezza dell'IA, recenti incidenti altrove nel settore illustrano perché la valutazione dedicata sia importante — il fallimento della sicurezza delle immagini di Grok è un esempio lampante di cosa accade quando la valutazione dei guardrail manca un vettore di attacco reale.
OpenAI non ha commentato pubblicamente i dettagli su come il lavoro di preparazione continuerà. Fino a quando non lo farà, la lettura onesta è: la funzione esiste in qualche forma, ma il team dedicato che ne era responsabile non esiste più.