Passa al contenuto principale
ULTIMA ORA:
Post title marquee scroll
Due americani e un Papa: Vance e Rubio tra fede, potere e la corsa alla Casa Bianca-Inter, quanto vale lo scudetto? L'incasso dei nerazzurri con il tricolore-Tumori: in Italia l'immunoterapia sottocute, si somministra in pochi minuti-Prevenzione melanoma, al via campagna Unicoop Firenze e Imi per controllo nei-Russia, più sicurezza e meno contatti: così Putin gestisce l'aumentato rischio attentato-Iran, Trump lancia 'Project Freedom' a Hormuz: Teheran alza livello dello scontro-Mattarella accoglie gli azzurri del tennis al Quirinale e ricorda Zanardi: "Grande spessore umano e sportivo"-Leroy Merlin, con Talent Lab obiettivo 60% manager interni-Rubio a Roma, incontrerà Papa Leone XIV: Vaticano ufficializza-Scudetto Inter, da Amadeus a Tananai: chi c'era alla festa in piazza Duomo-David di Donatello, 'Una battaglia dopo l'altra' vince il premio per il Miglior film internazionale-Nuoto, nel fondo a Golfo Aranci trionfo azzurro nella staffetta e il sigillo di Paltrinieri-Flotilla, procura Roma apre nuova inchiesta per sequestro di persona-FenealUil, Franzolini: "A congresso dal 13 al 15 maggio, insieme per costruire"-Casa, Franzolini (FenealUil): "Serve piano strutturale"-Scudetto Inter, Bonolis: "Vittoria della rinascita". Gianfelice Facchetti: "Chivu bella sorpresa"-Ucraina, attacco russo su Merefa: morti e feriti. Zelensky: “Putin deciderà tra guerra e diplomazia”-Energia, Franzolini (FenealUil): "Paese troppo dipendente da fossili, serve Piano"-Mathew Knowles al Wmf 2026, a Bologna il 25 giugno-BolognaFiere-Sig, accordo strategico per sviluppo di Iuc

Il nostro DNA culturale e’ nei libri, e ora e’ online

Condividi questo articolo:

Per la sua affinità alla genomica, i ricercatori lo hanno denominato ’culturomics’, vale a dire genoma culturale. Ora, dopo quattro anni di lavoro, i frutti di questo ambizioso progetto, nato dalla collaborazione tra Università di Harvard, Google, Encyclopaedia Britannica e American Heritage Dictionary, sono stati descritti in un articolo apparso sull’ultimo numero di Science. Si tratta di un set di dati estremamente potente, costruito a partire da 5,2 milioni di volumi e ben 500 miliardi di parole: pari a circa il 4% dei libri ad oggi pubblicati.
“Questo patrimonio digitale – spiegano gli autori – verrà utilizzato secondo criteri quantitativi ripresi, appunto, dalla genomica: servirà per studiare l’evoluzione di una serie di fenomeni culturali e storici, sulla base dei cambiamenti nella frequenza dei termini usati nel corso di secoli e decenni”. Con una metafora, è possibile paragonarlo a un “reperto fossile” della cultura umana, riportato in vita grazie alla digitalizzazione dei testi.

“L’interesse per gli approcci computazionali alle scienze umane e sociali risale agli anni Cinquanta”, ha detto Jean-Baptiste Michel, ricercatore presso il Dipartimento di Psicologia e Programmazione per le Dinamiche Evoluzionare di Harvard. “Finora, però, i tentativi di utilizzare i metodi quantitativi nello studio della cultura sono stati ostacolati dalla mancanza di dati appropriati. Adesso, grazie a questo lavoro, abbiamo un grande set di dati, disponibile tramite una interfaccia che è al tempo stesso facile da usare e disponibile gratuitamente a tutti”.

A realizzare questo strumento sono stati gli ingegneri di Google: essenzialmente si tratta di un’interfaccia che consente agli utenti di digitare una parola o una frase, per poi vedere come è cambiata la sua frequenza durante i secoli. “La culturomica estende i confini dell’indagine quantitativa a un ampio spettro di nuovi fenomeni nelle scienze umane e sociali”, ha aggiunto Erez Lieberman Aiden, l’altro autore dell’articolo. “Navigare tra questo patrimonio di dati è un’esperienza affascinante per chiunque sia interessato a capire ciò che ha interessato le persone nei secoli. Inoltre, speriamo che gli accademici delle discipline umanistiche lo trovino uno strumento utile ed efficiente”.

L’insieme dei dati digitali è migliaia di volte più grande rispetto a ogni altro corpus storico collezionato finora. Circa il 72 per cento del testo è in inglese, il resto si divide tra francese, spagnolo, tedesco, cinese, russo ed ebraico. Messe insieme, tutte le lettere compongono una sequenza 1.000 volte più lunga del genoma umano. Se tutti i caratteri venissero disposti in linea retta, si otterrebbe una linea pari a dieci volte la distanza tra il nostro pianeta e la Luna. “Ora che una frazione significativa dei libri del mondo è stata digitalizzata, è possibile per i programmi di analisi computerizzata rivelare trend nascosti in campi come la storia, la cultura, il linguaggio e il pensiero filosofico”, ha concluso Jon Orwant, ingegnere e manager di Google Books.

Questo articolo è stato letto 9 volte.

I commenti sono chiusi.