È stata, per prima, un’inchiesta del Washington Post a rivelare che aziende tech acquistano milioni di libri fisici, li scannerizzano per addestrare i loro modelli linguistici e poi li distruggono
L’Intelligenza Artificiale ha fame. Ha fame di energia. Ha fame di informazioni. Ha fame, soprattutto, di libri. E della carta su cui sono stampati. E l’Intelligenza Artificiale acquista vagoni di libri, centinaia di quintali di carta stampata, li scansiona, li legge, se ne ciba. E poi li distrugge. L’Intelligenza Artificiale è la più grande divoratrice e distruttrice di libri cartacei del secolo. Forse di sempre.
E ancora una volta, quello che sembra l’inizio di un romanzo di fantascienza distopico e angosciante, è la realtà. Anzi, la realtà è anche peggio: perché l’Intelligenza Artificiale non agisce da sola, l’Intelligenza Artificiale non ha elaborato un programma in autonomia per distruggere la letteratura mondiale e farsene pasto. Sono state le Big Tech che hanno in mano l’AI a farlo. Sono state loro ad acquistare, reperire, e anche trafugare, milioni di libri con cui nutrire i propri, voracissimi, figli. E a distruggerli.
È stata, per prima, un’inchiesta del Washington Post a rivelarlo, a scoperchiare il vaso di Pandora delle aziende tech che acquistano milioni di libri fisici, li scannerizzano per addestrare i loro modelli linguistici e poi li distruggono. A gennaio 2026, il Washington Post pubblica l’inchiesta basata su documenti giudiziari non ancora secretati, rivelando l’esistenza di un’operazione segreta in seno ad Anthropic, battezzata con il nome in codice di “Progetto Panama”, che si poneva l’obiettivo di “scansionare in modo distruttivo tutti i libri del mondo”. Secondo il rapporto del Washington Post, Anthropic ha speso decine di milioni di dollari per acquistare milioni di libri usati. I volumi venivano privati della copertina e del dorso, le pagine venivano fatte scorrere in scanner industriali ad alta velocità e, una volta digitalizzate, le copie fisiche venivano mandate al macero. Per guidare questa operazione, l’azienda aveva assunto Tom Turvey, un ex dirigente di Google che aveva contribuito a creare il progetto Google Books più di vent’anni prima.
Poi, le rivelazioni hanno preso a inseguirsi a un ritmo vertiginoso. Anthropic non era sola, documenti legali riguardanti cause contro Meta, OpenAI e Google hanno evidenziato come anche questi colossi stessero cercando di assicurarsi l’accesso a milioni di libri per migliorare i loro modelli, sebbene con metodi diversi e il sito di giornalismo tecnologico 404 Media ha approfondito il fenomeno, scoprendo che la pratica è ormai talmente diffusa da aver creato un mercato parallelo.
Aziende come ISBNdb, che si presenta come il “più grande database di libri al mondo”, offrono ora servizi di intermediazione per l’acquisto di massa di libri, promettendo alle società di AI di mantenere segreti gli acquisti per evitare scandali, giustificando la pratica affermando che “i libri stampati dell’era pre-LLM sono strutturalmente garantiti per essere privi di contaminazione” da testi generati dall’IA.
È tutto legale? Le aziende sfruttano la “dottrina della prima vendita” (first-sale doctrine), che consente all’acquirente di un libro fisico di farne ciò che vuole, senza il permesso del detentore del copyright. Quindi, distruggere l’originale dopo la scansione rappresenta una “conversione di formato” e non una “copia” illegale, aggirando di fatto l’obbligo di pagare i diritti d’autore, interpretazione in parte avallata da un tribunale federale della California settentrionale, quando il giudice William Alsup ha stabilito che l’uso di libri acquistati legalmente per addestrare l’IA costituisce un “fair use” (uso corretto) “estremamente trasformativo” e quindi protetto dalla legge.
Ma al di là della legge, c’è la credibilità. E il rischio che una nuova sentenza possa ribaltare la situazione. Ecco che allora Anthropic ha preferito a luglio 2026 pagare 1,5 miliardi di dollari per risolvere una class action intentata da tre autori, perché giudicata colpevole di aver violato il copyright di milioni di libri scaricandoli illegalmente da biblioteche digitali pirata, un reato distinto dalla distruzione di copie fisiche. Perché la fame di libri dell’AI non si è fermata (o non è stata fatta fermare) neanche di fronte a pratiche di pirateria, e c’è il rischio che nel fagocitante ventre dell’Intelligenza Artificiale non finiscano solamente copie di tutti i libri del mondo, ma che, come riportato dal Telegraph, vengano distrutte perfino copie uniche o estremamente rare. L’inchiesta del giornale britannico ha rivelato infatti che tra i libri acquistati e triturati c’erano volumi di cui esistevano globalmente solo cinque copie, mentre librai di tutto il mondo confermavano di aver ricevuto ordini sospetti di grandi quantità di volumi, spesso testi accademici e universitari, con la prospettiva della monopolizzazione di libri rari e fondamentali per la ricerca da parte di quelle stesse Big Tech che, come sappiamo, non ritengono produttiva nel loro business la realizzazione di pubblicazioni scientifiche.
Senza dimenticare la prospettiva che introiettare tutti i libri nel mondo in una mente artificiale incapace di comprenderne il valore tutto umano di bellezza, emozione, creazione di mondi e di universi, ricerca e studio, rischia di attribuire, in futuro, il medesimo valore a ogni pubblicazione, studio e opera letteraria senza discernimento e discrimine. Basterà far rientrare ogni testo nelle categorie preimpostate dall’AI secondo genere, numero e argomento. Senza ricordare che la scrittura è quanto di più umano esiste e che nessuna intelligenza, se non la nostra, sarà mai in grado di comprenderla in tutte le sue meravigliose sfumature.

