Il contenzioso tra New York Times, OpenAI e Microsoft entra in una fase cruciale, superando la mera legittimità tecnica dell’addestramento dei modelli per affrontare il valore economico del lavoro giornalistico nell’ecosistema dell’intelligenza artificiale. Nuove informazioni, precedentemente oscurate, rivelano un quadro in cui lo AI scraping è stato discusso internamente come una pratica ad alto rischio per gli editori, con potenziali impatti negativi sul traffico verso le testate e sulla sostenibilità della produzione informativa.
Il punto centrale è chiaro e dirompente: se un chatbot fornisce direttamente la risposta, l’utente potrebbe non visitare più il sito che ha prodotto l’informazione originale.
In questo passaggio si concentra la tensione tra innovazione tecnologica, protezione del copyright e i modelli di business della stampa digitale.
Le rivelazioni sui contenuti editoriali
I documenti citati nella causa includono comunicazioni e deposizioni in cui dirigenti e ricercatori avrebbero riconosciuto la portata problematica dell’uso di contenuti editoriali per addestrare sistemi di intelligenza artificiale. Un dirigente di Microsoft avrebbe definito la copia di massa di articoli senza autorizzazione come una forma di “furto” del lavoro umano. Altre comunicazioni interne avrebbero descritto i prodotti AI come potenzialmente sostitutivi rispetto alla consultazione diretta delle fonti originali.
Molte di queste informazioni provengono dal brief degli editori e non dagli allegati integrali, i quali restano sigillati. Questo elemento metodologico, pur non riducendo il peso della vicenda, suggerisce cautela nell’interpretazione. Il tema dello AI scraping si intreccia con accuse di aggiramento di paywall, l’uso di dataset contenenti opere giornalistiche e la rimozione di avvisi di copyright dai dati di training.
Il dibattito sulla sostituzione dei contenuti
La mozione parzialmente desecretata si inserisce nel contenzioso multidistrettuale davanti al tribunale federale del Southern District of New York. Qui, editori e autori accusano OpenAI e Microsoft di aver utilizzato contenuti protetti da copyright per addestrare i loro grandi modelli linguistici.
Un aspetto particolarmente rilevante riguarda il concetto di sostituzione. Satya Nadella avrebbe riconosciuto in deposizione che le conversazioni con i chatbot possono effettivamente sostituire la visita ai siti degli editori. Vengono inoltre citate comunicazioni attribuite a Nick Turley di OpenAI, secondo cui i prodotti sarebbero “largamente sostitutivi”. Microsoft, tuttavia, respinge l’idea che tali affermazioni equivalgano a conclusioni legali. L’azienda sostiene che riflettono osservazioni generali sul cambiamento del consumo di informazione, non un’ammissione definitiva sul copyright.