Per anni i libri rimasti sugli scaffali delle librerie dell’usato hanno rappresentato soprattutto un problema commerciale: titoli difficili da vendere, manuali ormai superati, raccolte specialistiche e pubblicazioni fuori catalogo che potevano trascorrere decenni senza trovare un nuovo proprietario. Ora, però, alcuni librai stanno osservando un fenomeno completamente diverso. Ordini molto grandi, spesso composti da titoli apparentemente senza alcun legame tra loro, stanno facendo aumentare la domanda di libri vecchi e difficili da reperire. Le segnalazioni arrivano da diversi venditori e hanno alimentato il sospetto che una parte di queste operazioni possa rientrare nella nuova corsa delle aziende di intelligenza artificiale alla ricerca di materiale testuale da utilizzare per l’addestramento dei propri modelli.
Il fenomeno ha attirato l’attenzione anche perché gli acquirenti mostrano caratteristiche insolite. Non cercano necessariamente bestseller o opere particolarmente conosciute, ma possono acquistare manuali tecnici, libri di storia locale, pubblicazioni specialistiche e volumi stampati molti anni fa. In alcuni casi gli ordini riguardano quantità enormi e arrivano attraverso procedure automatizzate. La logica sembra quindi diversa da quella di un normale collezionista o di un lettore: l’interesse riguarda soprattutto il contenuto che ogni volume può offrire. La situazione ha spinto diversi operatori del settore a chiedersi quale destinazione possano avere quelle copie una volta acquistate.
La nuova corsa al patrimonio cartaceo
Un’indagine pubblicata da 404 Media ha raccontato proprio questa trasformazione del mercato. Secondo quanto emerso, società che lavorano nella fornitura di libri per l’addestramento dei sistemi di intelligenza artificiale stanno cercando grandi quantità di pubblicazioni cartacee. Il motivo riguarda la qualità dei dati. Internet offre una quantità sterminata di testi, ma una parte crescente dei contenuti online presenta duplicazioni, errori, materiale generato automaticamente oppure informazioni difficili da verificare. I libri possono invece offrire testi strutturati, lunghi, organizzati e spesso più ricchi dal punto di vista linguistico.
La disponibilità fisica di un volume permette inoltre di recuperare opere che non compaiono facilmente nei normali archivi digitali. Manuali tecnici, pubblicazioni regionali, saggi specialistici e libri esauriti possono contenere informazioni praticamente assenti dal web. Per un’azienda che sviluppa modelli linguistici, ogni nuovo testo può quindi rappresentare una fonte aggiuntiva di dati. La ricerca non riguarda necessariamente un singolo argomento: un sistema automatizzato può cercare migliaia di ISBN e individuare libri che mancano ancora all’interno di una determinata raccolta digitale.
Il caso Anthropic e il progetto Project Panama
Il caso più significativo riguarda Anthropic, la società che sviluppa il chatbot Claude. Documenti emersi nell’ambito delle controversie giudiziarie hanno rivelato l’esistenza di Project Panama, un progetto che prevedeva la scansione di grandi quantità di libri fisici per trasformarli in materiale digitale destinato alla ricerca e all’addestramento dei sistemi di IA. Il procedimento prevedeva anche una tecnica particolarmente drastica: rimuovere la rilegatura, separare le pagine e utilizzare scanner ad alta velocità per acquisire il contenuto.
La vicenda ha assunto una dimensione ancora più delicata perché Anthropic ha affrontato una causa collettiva intentata da autori e titolari di diritti. Nel 2025 l’azienda ha raggiunto un accordo da 1,5 miliardi di dollari con i rappresentanti dei detentori dei diritti per chiudere le contestazioni legate all’utilizzo di libri ottenuti da fonti illecite. La società non ha ammesso responsabilità con l’accordo. La vicenda ha comunque mostrato quanto sia diventato centrale il tema della provenienza dei dati utilizzati per costruire i grandi modelli linguistici.
La questione presenta una distinzione fondamentale. Un conto riguarda i libri acquistati fisicamente e successivamente digitalizzati; un altro riguarda invece le copie digitali ottenute da archivi pirata. Nel caso Anthropic, il procedimento giudiziario ha distinto questi aspetti e ha considerato legittima, nell’ambito esaminato dal tribunale, la trasformazione in formato digitale di copie acquistate legalmente, mentre la controversia relativa alle copie provenienti da fonti pirata ha portato al successivo accordo economico. Questa differenza giuridica spiega perché l’acquisto di copie fisiche possa diventare particolarmente interessante per le aziende che vogliono costruire archivi interni di testi.
Perché distruggere un libro dopo averlo scansionato
La distruzione fisica del volume può sembrare assurda, soprattutto in un’epoca nella quale esistono scanner capaci di acquisire libri senza danneggiarli. Tuttavia, nel caso di enormi quantità di materiale, la velocità assume un peso decisivo. La cosiddetta scansione distruttiva elimina la rilegatura e trasforma il libro in una sequenza di fogli separati. Gli operatori possono quindi alimentare rapidamente gli scanner automatici senza dover girare manualmente ogni pagina.
Il procedimento sacrifica inevitabilmente la copia cartacea, ma consente di ottenere molto più rapidamente un file digitale. Per una società interessata a milioni di pagine, il fattore tempo può incidere pesantemente sui costi complessivi dell’operazione. Il libro, in questa prospettiva, smette di rappresentare un oggetto da conservare e diventa un contenitore temporaneo di informazioni. Una volta acquisito il testo, la copia fisica perde gran parte della sua utilità per chi gestisce il processo.
Questo meccanismo alimenta però una questione culturale che supera il semplice dibattito sull’intelligenza artificiale. Un volume fuori catalogo può avere un valore commerciale minimo e, nello stesso tempo, possedere un enorme valore storico. Un libro dedicato alla storia di una piccola comunità, una ricerca tecnica ormai introvabile o una raccolta di testimonianze locali possono contenere informazioni che nessun altro testo conserva nello stesso modo. Distruggere una copia può quindi significare eliminare un oggetto materiale che rappresenta una parte irripetibile della memoria editoriale.
Il mercato dei libri dimenticati cambia volto
Le recenti segnalazioni dei librai mostrano dunque un mercato nel quale anche i volumi più improbabili possono acquisire improvvisamente valore. Per chi vende libri usati, gli ordini di grandi dimensioni rappresentano naturalmente un’opportunità economica importante, soprattutto quando riguardano giacenze che da anni occupano spazio nei magazzini. Tuttavia, molti operatori hanno espresso anche preoccupazione per la destinazione finale delle opere.
La crescita della domanda non riguarda soltanto una singola azienda. Il settore tecnologico sta cercando nuove fonti di dati mentre i modelli linguistici diventano sempre più grandi e complessi. Le società devono trovare quantità enormi di materiale per continuare ad addestrare e migliorare i propri sistemi e, allo stesso tempo, devono affrontare un numero crescente di discussioni legali sul copyright. In questo scenario, i libri fisici possono offrire una strada alternativa: l’azienda acquista una copia, la digitalizza e conserva il contenuto secondo le modalità consentite dalla legge applicabile.
La vicenda riporta inevitabilmente alla mente le atmosfere di Ray Bradbury e del suo celebre romanzo Fahrenheit 451. Il paragone, però, richiede cautela. Nel romanzo la società elimina deliberatamente i libri per impedire alle persone di leggerli; nel caso della scansione distruttiva, invece, l’obiettivo consiste nell’acquisire il contenuto prima di eliminare il supporto fisico. Il risultato materiale può comunque apparire inquietante: un libro viene acquistato, aperto, trasformato in dati e infine avviato al macero.
Il vero interrogativo riguarda quindi il rapporto tra conoscenza, tecnologia e proprietà intellettuale. L’intelligenza artificiale ha bisogno di enormi quantità di informazioni per crescere, ma la disponibilità dei dati non elimina automaticamente i diritti di chi li ha prodotti. Allo stesso tempo, la digitalizzazione può permettere di conservare e analizzare contenuti che altrimenti rischierebbero di scomparire dagli archivi accessibili. La sfida dei prossimi anni consisterà nel trovare un equilibrio tra innovazione tecnologica, tutela degli autori e conservazione del patrimonio librario.
La corsa ai vecchi libri dimostra così che, nell’era dell’intelligenza artificiale, la carta non ha perso il proprio valore. Al contrario, proprio mentre il mondo digitale sembra dominare ogni settore, le aziende tecnologiche stanno tornando a cercare conoscenza negli scaffali, nei magazzini e nei fondi di catalogo dimenticati. La differenza è che questa volta quei libri potrebbero non tornare sugli scaffali dopo aver svolto la loro funzione: il loro contenuto potrebbe continuare a vivere all’interno delle macchine, mentre l’oggetto che lo custodiva scompare per sempre.
ExtraRem: tutto il resto, senza filtri.
Clicca qui per iscriverti al canale Whatsapp!
Table of Contents

