The Pulse
Il DOJ sostiene la difesa di OpenAI basata sul fair use nella causa del New York Times
La memoria del Dipartimento di Giustizia sostiene l’argomentazione di OpenAI sul fair use nella controversia sul copyright con The New York Times, in cui le parti hanno presentato istanze di giudizio sommario il 4 settembre.

AI.info Team ·
«Sia l’IA sia i creatori possono prosperare: le aziende di IA devono semplicemente pagare un compenso equo per i contenuti che rendono possibili i loro prodotti, come richiede la legge sul copyright.»
Graham James, portavoce di The New York Times
Il Dipartimento di Giustizia si è schierato dalla parte di OpenAI nella causa per violazione del copyright intentata da The New York Times, esortando un tribunale federale di Manhattan a stabilire che addestrare modelli di intelligenza artificiale su testi protetti dal copyright non viola, di per sé, la legge sul copyright.
Il governo ha depositato una memoria il 1° settembre nell’ambito delle cause riunite davanti al giudice federale distrettuale Sidney H. Stein. La memoria sostiene che l’addestramento dei grandi modelli linguistici costituisce un uso trasformativo di materiale protetto dal copyright e afferma che i benefici creativi e pubblici della tecnologia superano il danno alla concorrenza lamentato dagli editori.
L’intervento offre a OpenAI e Microsoft il sostegno del governo federale mentre le istanze di giudizio sommario delle parti passano all’esame del tribunale. Non decide l’esito della causa, e il Dipartimento di Giustizia non è parte del procedimento.
Washington presenta l’addestramento come una questione di sicurezza nazionale
Gli avvocati del Dipartimento di Giustizia sostengono che lo sviluppo dell’intelligenza artificiale risponde a un interesse nazionale che va oltre la controversia commerciale tra OpenAI, Microsoft e The Times. Una sentenza che assoggettasse in modo ampio l’addestramento dei modelli alla responsabilità per violazione del copyright, hanno scritto, potrebbe ostacolare il progresso scientifico, la mobilità economica e la capacità degli Stati Uniti di competere nelle tecnologie avanzate.
La memoria collega inoltre le capacità dell’IA alle attività legate alla sicurezza nazionale. Gli avvocati del governo affermano che i modelli possono aiutare i funzionari ad analizzare fatti del mondo reale e a trarne deduzioni, compresi quelli riportati negli articoli di giornale. Sostengono che imporre una licenza per ogni opera protetta dal copyright usata nell’addestramento potrebbe far salire i costi al punto da limitare la concorrenza alle sole aziende tecnologiche più grandi.
«Sarebbe problematico — e giuridicamente errato — imporre una responsabilità così ampia per violazione del copyright da rendere in generale inammissibile l’addestramento dei modelli di IA senza licenza», ha scritto il dipartimento nella memoria.
Il DOJ distingue l’addestramento da ciò che i modelli producono
La posizione del governo si concentra sul processo di addestramento, non su ogni possibile risposta di un chatbot. OpenAI sostiene che l’addestramento trasforma le opere scritte in informazioni statistiche utilizzate per prevedere il linguaggio, anziché conservare gli articoli come farebbe un database tradizionale in cui è possibile effettuare ricerche. The Times sostiene che OpenAI abbia copiato milioni di articoli senza autorizzazione, li abbia usati per sviluppare prodotti commerciali e abbia talvolta generato passaggi che riproducevano fedelmente i suoi articoli.
Questa distinzione lascia spazio a controversie separate sulle risposte che riproducono contenuti protetti. Il sostegno del Dipartimento di Giustizia all’addestramento non equivale a stabilire che ogni risposta prodotta da ChatGPT o da un altro modello sia lecita.
OpenAI e Microsoft hanno respinto le accuse di The Times. Sostengono che il loro uso di materiale pubblicato dia vita a nuovi sistemi e rientri nella dottrina del fair use, che tiene conto dello scopo dell’uso, della natura dell’opera, della quantità copiata e dell’effetto sul mercato dell’originale.
The Times sostiene che la sentenza potrebbe indebolire il giornalismo
The New York Times ha fatto causa a OpenAI e Microsoft nel dicembre 2023, sostenendo che le aziende abbiano usato i suoi contenuti giornalistici per sviluppare ChatGPT e altri sistemi di IA senza autorizzazione. Il giornale afferma che questi sistemi possono sostituire i suoi articoli, compromettere gli abbonamenti e le opportunità pubblicitarie e riprodurre parti degli articoli in risposta ai prompt degli utenti.
Graham James, portavoce di The Times, ha dichiarato che l’amministrazione si stava schierando con «una manciata di aziende di IA che valgono migliaia di miliardi di dollari» anziché con i creatori americani. Ha affermato che permettere alle aziende di appropriarsi di opere protette dal copyright senza autorizzazione né pagamento danneggerebbe il materiale creato dagli esseri umani da cui dipendono i sistemi di IA.
La causa di The Times rientra ora in un gruppo più ampio di cause sul copyright che coinvolgono OpenAI, Microsoft, autori e altri editori. Diverse testate giornalistiche hanno avanzato contestazioni analoghe, mentre alcuni scrittori hanno sostenuto separatamente che i loro libri siano stati copiati per addestrare i modelli.
Il giudice Stein esamina le tesi contrapposte dopo il deposito delle istanze di giudizio sommario
Le parti nelle cause riunite, tra cui The Times e le altre testate ricorrenti, hanno depositato istanze di giudizio sommario il 4 settembre. Con queste istanze chiedono al tribunale di decidere se le questioni giuridiche centrali possano essere risolte senza un processo.
The Times chiede di accertare che l’uso dei suoi articoli da parte di OpenAI e Microsoft fosse illecito. Le società convenute sostengono che la loro difesa basata sul fair use debba essere accolta e che l’addestramento dei modelli non comporti una responsabilità generalizzata ogni volta che opere protette dal copyright compaiono in un dataset.
La memoria del Dipartimento di Giustizia rafforza questa difesa, ma non vincola il giudice Stein. Il giudice deve ancora valutare le condotte specifiche contestate da The Times, tra cui i materiali originali utilizzati, il funzionamento dei modelli e le prove che alcune risposte abbiano riprodotto articoli del giornale.
Un sostegno federale, con dei limiti
Le argomentazioni del Dipartimento di Giustizia offrono a OpenAI un potente alleato in tribunale e affiancano la sicurezza nazionale ai tradizionali criteri del fair use.
Per gli editori, la preoccupazione immediata non riguarda soltanto l’eventualità che OpenAI vinca questa causa. Una sentenza di ampia portata favorevole all’azienda potrebbe indebolire la minaccia di cause per violazione del copyright come strumento per imporre accordi di licenza, lasciando al Congresso o alle trattative private il compito di stabilire se i creatori riceveranno un compenso per i dati usati nell’addestramento.
Le istanze di giudizio sommario depositate il 4 settembre sono ora all’esame del Tribunale distrettuale federale per il Distretto meridionale di New York.