Vai al contenuto
AI.info

The Pulse

The Seattle Times e Newsday fanno causa a OpenAI e Microsoft per l’addestramento dell’IA

The Seattle Times e Newsday hanno intentato una causa federale contro OpenAI e Microsoft, accusandole di aver copiato i loro articoli per addestrare e far funzionare prodotti di IA. Gli editori chiedono un risarcimento e un provvedimento ri

The Seattle Times e Newsday fanno causa a OpenAI e Microsoft per l’addestramento dell’IA

AI.info Team ·

Quando un utente ha fornito a ChatGPT soltanto il titolo e l’indirizzo web di un’inchiesta del Seattle Times sugli incidenti del Boeing 737 MAX, il chatbot avrebbe restituito un passaggio di 88 parole dell’articolo quasi alla lettera. L’esempio compare in una denuncia depositata il 4 settembre presso un tribunale federale da The Seattle Times Company e Newsday contro OpenAI, Microsoft e nove entità societarie di OpenAI.

I due giornali accusano le aziende di aver copiato i loro articoli senza autorizzazione, di averli usati nei dataset e nei modelli alla base di prodotti tra cui ChatGPT, Copilot e Bing Chat e di generare risposte che fanno concorrenza alle pubblicazioni originali. La denuncia chiede un processo con giuria, un risarcimento economico e un provvedimento che imponga la distruzione o il sequestro di copie, dataset di addestramento e modelli che, secondo gli editori, violano il diritto d’autore.

OpenAI non ha risposto pubblicamente al deposito della denuncia nelle fonti esaminate per questo articolo. Un portavoce di Microsoft ha dichiarato a GeekWire che l’azienda era «sorpresa dalla causa», ma è «sempre disponibile a sedersi a un tavolo ed esplorare soluzioni per questo tipo di controversia».

L’esempio delle 88 parole al centro della denuncia

La causa, avviata presso il Tribunale distrettuale federale del Distretto meridionale di New York, sostiene che OpenAI e Microsoft abbiano acquisito grandi quantità di articoli del Seattle Times e di Newsday tramite scraping automatizzato. Secondo gli editori, le aziende hanno aggirato i paywall, ignorato le condizioni d’uso dei siti e incorporato copie in dataset derivati da WebText, WebText2, Common Crawl e dall’indice di ricerca Bing di Microsoft.

Si tratta di accuse, non di conclusioni del tribunale. La denuncia afferma che il materiale copiato è stato usato per addestrare i modelli linguistici di grandi dimensioni, sottoporli a fine-tuning e ancorarli alle fonti, sostenendo inoltre che le aziende abbiano conservato copie per la generazione aumentata dal recupero e per rispondere alle richieste degli utenti.

L’esempio del Boeing 737 MAX è l’illustrazione più chiara, nella denuncia, della tesi degli editori sugli output. Secondo l’atto, un prompt contenente il titolo e l’URL dell’articolo ha prodotto una sequenza di 88 parole tratta dagli articoli del Seattle Times sugli incidenti. Il giornale afferma che l’esempio dimostra come la controversia non riguardi soltanto la questione astratta della liceità dell’addestramento su opere protette dal diritto d’autore, ma anche ciò che i sistemi commerciali di IA restituiscono agli utenti.

La denuncia sostiene che ChatGPT e i prodotti di Microsoft facciano più che analizzare o riassumere gli articoli. Afferma che possono riprodurli, parafrasarli da vicino e rielaborarli in risposte che sostituiscono le visite a seattletimes.com o newsday.com, contendendo ai giornali lettori, pubblicità e ricavi dagli abbonamenti.

Una causa congiunta fondata su sette contestazioni giuridiche

Il registro del tribunale indica The Seattle Times Company e Newsday LLC come parti attrici nella causa numero 1:26-cv-07644. I convenuti sono Microsoft Corporation e OpenAI, Inc., OpenAI GP, LLC, OpenAI, LLC, OpenAI OpCo, LLC, OpenAI Global LLC, OAI Corporation, OpenAI Holdings, LLC, OpenAI Foundation e OpenAI Group PBC.

La denuncia contiene sette capi di accusa. Comprendono la violazione diretta e la violazione per responsabilità indiretta del diritto d’autore, due contestazioni ai sensi del Digital Millennium Copyright Act riguardanti la presunta rimozione e distribuzione delle informazioni sulla gestione del diritto d’autore, e contestazioni relative alla diluizione dei marchi ai sensi delle leggi federali, dello Stato di Washington e di New York.

Le contestazioni sui marchi offrono ai giornali una seconda strada, oltre alla controversia sull’addestramento. Gli editori sostengono che i prodotti di IA possano associare i loro nomi a materiale generato che non hanno pubblicato, inclusi contenuti inesatti o inventati. Affermano che tale associazione possa indebolire il valore dei marchi Seattle Times e Newsday anche quando un output non riproduce un articolo completo.

La denuncia individua opere registrate appartenenti a entrambi i giornali negli allegati. Non indica un’unica cifra in dollari per i danni. Gli editori chiedono invece il risarcimento dei danni effettivi, la restituzione degli utili, i rimedi previsti dalla legge ove disponibili, provvedimenti inibitori, il rimborso delle spese legali e altri rimedi consentiti dalla legge.

Microsoft citata in giudizio dal giornale della sua città

La causa del Seattle Times presenta un rapporto aziendale insolito. Microsoft ha sede a Redmond, nello Stato di Washington, mentre The Seattle Times è il più grande quotidiano della regione e segue l’azienda da decenni.

Microsoft Philanthropies ha sostenuto alcuni progetti giornalistici del Seattle Times e, nel 2024, Microsoft e OpenAI hanno contribuito insieme a finanziare una fellowship sull’IA del valore di 10 milioni di dollari, gestita dal Lenfest Institute. The Seattle Times e Newsday figuravano tra le prime redazioni partecipanti alla fellowship. Il giornale ha dichiarato che questi rapporti non compromettono la sua indipendenza editoriale.

Alan Fisco, presidente e amministratore delegato di The Seattle Times Company, ha descritto la decisione in una comunicazione interna citata da GeekWire: «Non è stata una decisione facile. Tuttavia, siamo fermamente convinti di dover difendere i nostri contenuti — che ci costano milioni di dollari all’anno per essere prodotti — dall’uso senza il nostro consenso o senza un compenso».

The Seattle Times Union, che rappresenta più di 160 dipendenti del giornale, ha dichiarato di sostenere la causa. Durante le trattative contrattuali, il sindacato ha anche criticato l’azienda per essersi rifiutata di garantire che non avrebbe sostituito con l’IA i posti di lavoro in redazione diversi da quelli dei reporter, affiancando all’azione legale una controversia interna su come il giornale stesso userà la tecnologia.

Due editori regionali contestano l’economia delle risposte dell’IA

La denuncia presenta entrambi i giornali come imprese che dipendono da lettori paganti e da rapporti diretti con il proprio pubblico. The Seattle Times afferma che il suo sito riceve circa 6 milioni di visitatori unici al mese e 29 milioni di visualizzazioni di pagina mensili, con circa 108.000 abbonati solo digitali e circa 100.000 abbonati all’edizione cartacea. Newsday dichiara di avere più di 60.000 abbonati digitali, una tiratura cartacea quotidiana superiore a 60.000 copie e circa 51 milioni di visualizzazioni di pagina al mese in media.

Entrambi gli editori applicano paywall significativi ai contenuti digitali. The Seattle Times afferma che i lettori possono visualizzare gratuitamente una pagina prima che sia richiesto il pagamento. Newsday dichiara di mantenere un blocco totale dell’accesso ai suoi testi editoriali per chi non paga dall’agosto 2022.

La denuncia sostiene che questi sistemi di abbonamento rendano particolarmente dannosa la copia non autorizzata. Un lettore che riceve da un chatbot il contenuto sostanziale di un articolo giornalistico può avere meno motivi per aprire la pagina dell’editore, vedere la sua pubblicità o pagare per accedere al contenuto. Gli editori descrivono le risposte generate dall’IA come prodotti informativi concorrenti, anziché come un tradizionale indice di ricerca che indirizza gli utenti alla fonte originale.

È un argomento centrale per la probabile disputa sul fair use. In altre cause, OpenAI e Microsoft hanno sostenuto che usare materiale protetto dal diritto d’autore per addestrare modelli possa servire a uno scopo diverso, trasformativo. The Seattle Times e Newsday replicano che i prodotti riproducono o imitano da vicino le stesse opere espressive e forniscono le stesse informazioni allo stesso pubblico potenziale.

La denuncia si aggiunge a una disputa più ampia a Manhattan

La nuova causa arriva mentre altre testate giornalistiche portano avanti contestazioni analoghe contro OpenAI e Microsoft nello stesso distretto federale. The New York Times ha intentato la sua causa nel 2023, mentre New York Daily News, Ziff Davis e il Center for Investigative Reporting figurano tra gli editori coinvolti in procedimenti collegati riuniti davanti al giudice distrettuale federale Sidney H. Stein.

Il 4 settembre, le parti di quei procedimenti riuniti hanno presentato anche istanze di giudizio sommario. Una decisione in quel caso potrebbe influenzare il modo in cui i tribunali valutano l’uso degli articoli giornalistici nell’addestramento dei modelli, anche se non risolverebbe automaticamente tutte le questioni di fatto o di diritto sollevate da The Seattle Times e Newsday.

Il Dipartimento di Giustizia ha recentemente depositato una memoria a sostegno delle argomentazioni di OpenAI e Microsoft nella causa del New York Times, avvertendo che una decisione favorevole agli editori potrebbe ostacolare lo sviluppo dell’IA negli Stati Uniti. La nuova denuncia espone in termini diretti la risposta degli editori: sostengono che le aziende abbiano costruito prodotti di valore copiando il materiale che le testate giornalistiche spendono milioni di dollari per produrre, per poi usare quei prodotti per contendersi lo stesso pubblico.

OpenAI ha firmato accordi di licenza con diverse organizzazioni giornalistiche, tra cui Associated Press, News Corp e Axel Springer. La denuncia del Seattle Times afferma che le condizioni rese pubbliche di tre di questi accordi ammontano complessivamente a più di 300 milioni di dollari, ma sostiene che ottenere licenze da editori selezionati non risolva la questione del presunto uso dei propri contenuti e di quelli di Newsday.

Per ora, nessun giudice ha ordinato a OpenAI o Microsoft di distruggere un modello o un dataset, e la denuncia non è ancora stata sottoposta alla fase di acquisizione delle prove né a un processo. La questione giuridica immediata è se i due giornali riusciranno a portare le loro accuse relative a scraping, addestramento, recupero delle informazioni e output generati oltre le prime istanze dei convenuti. Il punto di partenza sarà la denuncia di 38 pagine depositata a Manhattan il 4 settembre 2026.

Fonte

Esplora

Altri articoli