Libri moderni impilati su scrivania bianca con tablet e dati astratti, formazione dell'intelligenza artificiale

Anthropic paga 1,5 miliardi per i libri pirata: l’AI non ha un precedente

L’accordo da record tra Anthropic e un gruppo di autori ed editori chiude una controversia da 1,5 miliardi di dollari, ma lascia il settore dell’intelligenza artificiale senza un punto fermo sul fair use. Il maxi-risarcimento è stato approvato in via definitiva il 21 luglio 2026 dal giudice federale Araceli Martínez-Olguín ed è già il più grande recupero per violazione del copyright nella storia degli Stati Uniti. Eppure proprio la scelta di patteggiare prima di un processo d’appello impedisce che la sentenza sulla liceità dell’addestramento diventi un precedente vincolante per gli altri colossi dell’AI.

Come sono nate le accuse: 7 milioni di libri pirata e il nodo del fair use

Nel 2024 tre autori — Andrea Bartz, Charles Graeber e Kirk Wallace Johnson — avevano fatto causa ad Anthropic sostenendo che la società, sostenuta da Amazon e Alphabet, avesse usato copie non autorizzate dei loro libri per addestrare il chatbot Claude. Il giudice William Alsup, oggi in pensione, ha però distinto due piani: addestrare un modello su testi protetti può rientrare nel fair use, ma ottenere quei testi attraverso siti pirata è illegale. Anthropic aveva costruito la propria libreria di training attingendo a circa 7 milioni di opere scaricate da piattaforme come Library Genesis e Pirate Library Mirror, comportamento giudicato illecito.

Per evitare un processo da cui sarebbero potuti scaturire danni ben più alti — la sola udienza per il risarcimento era fissata a dicembre 2025 — l’azienda ha raggiunto un accordo extragiudiziale nel settembre 2025, ottenendo poi l’approvazione preliminare dallo stesso giudice Alsup e quella definitiva dal suo successore Martínez-Olguín.

Cosa prevede l’accordo: 3.000 dollari a libro e rate da 900 milioni

Il maxi-fondo da 1,5 miliardi di dollari viene distribuito tra i titolari dei diritti su circa 500.000 opere, per un importo medio di 3.000 dollari a libro. L’91% degli autori e degli editori coperti dall’intesa ha già reclamato la propria quota, come ha dichiarato il general counsel di Anthropic, Aparna Sridhar: «Siamo lieti che più del 91% degli autori e editori coinvolti abbia richiesto la propria quota. Non vediamo l’ora di chiudere la vicenda». Ai tre autori principali spettano 15.000 dollari ciascuno.

Libri moderni impilati su scrivania bianca con tablet e dati astratti, formazione dell'intelligenza artificiale
L'accordo da 1,5 miliardi per violazione del copyright nell'addestramento AI non stabilisce un precedente vincolante.

I tempi di pagamento sono già scattati: 300 milioni versati prima dell’approvazione, altri 300 milioni attesi entro la settimana, e i restanti 900 milioni dilazionati in due tranche — settembre 2026 e settembre 2027. Il tribunale ha inoltre autorizzato 101 milioni di dollari di parcelle legali, tagliando la richiesta iniziale di 187,5 milioni, oltre a 20 milioni di spese legali aggiuntive. Restano fuori dall’accordo alcuni autori ed editori che hanno avviato cause separate, tra cui Chicken Soup for the Soul, e continuano a ritenere il risarcimento per opera insufficiente.

Perché il fair use resta in bilico: nessun precedente, cause aperte per Google, Meta e OpenAI

La vera posta in gioco giuridica non sono i 1,5 miliardi, ma la portata del fair use applicato all’addestramento dell’AI. La sentenza Alsup aveva riconosciuto che l’utilizzo di libri per allenare modelli linguistici può essere lecito, ma proprio perché Anthropic ha scelto di patteggiare la decisione non è mai arrivata in corte d’appello e non costituisce un precedente vincolante. Altri giudici potranno quindi valutare diversamente in cause analoghe.

E le cause non mancano: restano aperti procedimenti contro Google, Meta, OpenAI e Midjourney, tutti accusati di aver impiegato opere protette senza licenza. Solo nei giorni scorsi, un gruppo di editori e autori — tra cui Hachette, Cengage, Elsevier, Scott Turow e S.C.R.I.B.E. — ha depositato una nuova class action contro Google per l’addestramento del modello Gemini.

Analisi: un costo certo per Anthropic, un vuoto normativo per l’industria

Il costo medio di 3.000 dollari a opera è poco più di una frazione del valore commerciale di un libro, ma il totale di 1,5 miliardi segna comunque un nuovo massimo storico per il copyright. Se si guarda alla proporzione delle parcelle, i 101 milioni accordati rappresentano circa il 6,7% del risarcimento principale, anche se il tribunale ha approvato poco più della metà della richiesta iniziale di parcelle (187,5 milioni), riducendo così il costo legale della causa. Anthropic ha potuto limitare i danni comprando certezza, ma l’intero settore resta senza una linea giuridica chiara. Per chi sviluppa modelli, questo significa che la strada del fair use è percorribile solo in un quadro di assenza di pirateria, mentre basta un diverso collegio giudicante per ribaltare tutto. In attesa di una pronuncia definitiva, ogni nuovo addestramento su dati testuali protetti rimane un azzardo legale da miliardi di dollari.

Fonti

Francesco Leone
Francesco Leone

Francesco Leone è un esperto in Intelligenza Artificiale con una profonda conoscenza in Machine Learning e Deep Learning. Attraverso la sua esperienza, ha contribuito allo sviluppo di soluzioni innovative in ambito di elaborazione del linguaggio naturale e visione artificiale, mirando a trasformare il modo in cui interagiamo con la tecnologia. Attivo nel settore con pubblicazioni e progetti su https://ital-ia.it/, Francesco si dedica alla ricerca e all'applicazione di algoritmi avanzati per rendere i sistemi più intelligenti e accessibili.

Articoli: 567

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *