Vai al contenuto
AI.info

The Pulse

Anthropic perde il tentativo di far archiviare la causa di Reddit sullo scraping dell’IA

Un giudice di San Francisco ha respinto in larga misura la richiesta di Anthropic di archiviare la causa intentata da Reddit, che accusa la società di IA di aver raccolto contenuti degli utenti per addestrare i propri modelli. Il giudice ha

Anthropic perde il tentativo di far archiviare la causa di Reddit sullo scraping dell’IA

AI.info Team ·

«Ciascuna di queste rivendicazioni si fonda in parte su rilevanti interessi di diritto statale estranei all’ambito della legge sul copyright»

Harold E. Kahn, giudice della Corte superiore di San Francisco

Un giudice di San Francisco ha respinto in larga misura la richiesta di Anthropic di archiviare la causa intentata da Reddit, che accusa la società di IA di aver raccolto contenuti degli utenti per addestrare i propri modelli, consentendo alla controversia di proseguire in base alla legge della California.

La decisione del giudice Harold E. Kahn lascia in piedi le rivendicazioni di Reddit per violazione del contratto e concorrenza sleale. Kahn ha stabilito che tali rivendicazioni comprendono elementi che vanno oltre la copia di opere espressive, tra cui le accuse secondo cui Anthropic avrebbe avuto accesso a Reddit violando le restrizioni contrattuali e avrebbe addestrato modelli senza predisporre una procedura per dare seguito alle richieste degli utenti di cancellare i propri contenuti.

L’ordinanza non mette fine alla causa. Anthropic ha ottenuto l’archiviazione di alcune rivendicazioni, restringendo la causa di Reddit ma lasciando in piedi le sue principali argomentazioni basate sul diritto statale. L’esito è favorevole in parte a entrambe le parti, non una vittoria completa per nessuna delle due.

Perché la legge sul copyright non ha chiuso il caso

Anthropic ha sostenuto che la causa di Reddit fosse in sostanza una controversia sul copyright, perché riguardava la copia e l’uso dei post di Reddit nell’addestramento dell’IA. L’argomento mirava a far rientrare le rivendicazioni di Reddit basate sul diritto statale tra quelle precluse dalla legge federale sul copyright, il che avrebbe escluso dal caso le argomentazioni contrattuali e relative alla privacy.

Kahn ha respinto questa tesi per le rivendicazioni ancora in piedi. Le accuse di Reddit riguardano non solo i contenuti in sé, ma anche le modalità con cui Anthropic avrebbe avuto accesso alla piattaforma, le finalità per cui avrebbe utilizzato i dati e gli obblighi previsti dall’Accordo con gli utenti di Reddit. Il giudice ha inoltre richiamato le accuse secondo cui il processo di addestramento di Anthropic non prevedeva un meccanismo per rispettare le successive richieste di cancellazione degli utenti di Reddit.

Questo ragionamento segue una precedente decisione federale relativa alla stessa controversia. A marzo, la giudice distrettuale federale Trina Thompson ha rinviato il caso alla Corte superiore di San Francisco, dopo aver stabilito che le rivendicazioni di Reddit includevano «elementi aggiuntivi» qualitativamente diversi dai diritti tutelati dalla legge sul copyright. Nell’ordinanza di rinvio, Thompson ha citato come esempi le restrizioni contrattuali all’accesso, le misure di salvaguardia tecniche, gli obblighi in materia di privacy e le presunte dichiarazioni ingannevoli.

Le accuse di Reddit su ClaudeBot

Reddit ha intentato la causa presso la Corte superiore di San Francisco il 4 giugno 2025. La società sostiene che Anthropic abbia avuto accesso a Reddit, o abbia tentato di farlo, più di 100.000 volte dopo aver dichiarato di aver smesso, e che tale attività abbia fornito dati per Claude e altri prodotti di IA correlati.

Secondo la denuncia di Reddit, Anthropic avrebbe iniziato a raccogliere dati dalla piattaforma già nel 2021 e avrebbe continuato almeno fino ad aprile 2024, per ottenere i dati usati per addestrare Claude. La società sostiene inoltre che Anthropic si sia rifiutata di sottoscrivere un accordo di licenza, mentre Reddit negoziava accordi di partnership a pagamento per i dati con altre società di IA.

Si tratta di accuse contenute nella denuncia di Reddit, non di fatti accertati al termine di un processo. Nell’atto si sostiene che l’attività di Anthropic abbia aggirato i controlli tecnici, sottoposto l’infrastruttura di Reddit a un carico aggiuntivo e privato la società dei ricavi derivanti dalle licenze. Reddit chiede un risarcimento danni, la restituzione dei proventi e un’ingiunzione che vieti ad Anthropic di utilizzare i dati di Reddit nelle proprie offerte commerciali.

La strategia di Reddit sulle licenze al centro della causa

La causa mette alla prova una tesi giuridica che pone al centro della controversia l’accesso e le regole della piattaforma, anziché una rivendicazione diretta sul copyright. Reddit sostiene di poter controllare l’uso commerciale dei post dei propri utenti attraverso l’Accordo con gli utenti e il sistema di licenze, anche se in genere i singoli utenti detengono i diritti sui contenuti che creano.

La denuncia di Reddit fa riferimento alla sua Compliance API, che può avvisare i licenziatari quando gli utenti cancellano post o commenti. La società sostiene che i partner autorizzati possano essere tenuti a rispettare tali modifiche, mentre chi raccoglie dati senza autorizzazione potrebbe conservare i contenuti dopo la cancellazione senza offrire una protezione equivalente.

Reddit ha annunciato un accordo di licenza dei dati con Google nel febbraio 2024 e una partnership separata con OpenAI nel maggio 2024. Questi accordi fanno parte dell’argomentazione della società secondo cui gli sviluppatori di IA che intendono accedere commercialmente ai contenuti di Reddit dovrebbero negoziare le condizioni, invece di raccogliere i dati al di fuori del suo sistema di licenze.

Una causa più circoscritta, non conclusa

Il successo parziale di Anthropic lascia a Reddit una causa incentrata sulle condizioni di accesso, gli impegni contrattuali, la privacy degli utenti e il funzionamento stesso della piattaforma. La decisione non stabilisce se Anthropic abbia effettivamente violato l’Accordo con gli utenti di Reddit, se la raccolta dei dati contestata sia avvenuta nei termini descritti o quale risarcimento possa ottenere Reddit.

La causa si avvia ora verso la fase di acquisizione delle prove e il processo davanti al tribunale statale. L’esito giuridico immediato è più circoscritto: Anthropic è riuscita a far archiviare alcune rivendicazioni, ma non è riuscita a far passare l’intera causa per un’azione basata sul copyright.

Fonte

Esplora

Altri articoli