Passa al contenuto principale
ULTIMA ORA:
Post title marquee scroll
Quali ortaggi idratano la pelle? acqua, nutrienti e cosa dice la scienza-Bollette della luce in aumento del 4,6% dal 1° luglio 2026: chi riguarda, perché e cosa fare-Cosa c'è nel gelato che mangi oggi: ingredienti, additivi, aria (come scegliere quello buono)-Prezzi del vino 2026: perché in Italia scendono mentre i dazi pesano ancora sui produttori?-Liquid Nano Clay: come funziona l'argilla liquida che promette di far rifiorire il deserto-Bandiere Blu 2026: tutte le 257 località premiate e cosa garantisce davvero il riconoscimento-Pulire facciate degli edifici con un drone: come funziona, quanto costa e perché è più sostenibile-ISTAT e Euromonitor: 5,8 milioni rinunciano a curarsi mentre il wellness è in boom-Se il termometro diventa una pillola: il sensore ingeribile del MIT che misura la febbre dall'interno-Ecobonus auto elettrica: cosa sapere prima della scadenza del 30 giugno 2026-Foreste in Italia 2026: i boschi dove trovare il fresco (e come visitarli in totale sicurezza)-Friggitrice ad aria d'estate: 7 ricette veloci e leggere (lascia il forno spento)-Antartide, il ghiaccio cresce o si scioglie? Dipende-Il ventilatore portatile rinfresca davvero contro il caldo? E quando le temperature diventano estreme?-Quanto paghi davvero una birra? Fino al 40% sono imposte-7 semi di frutti da non buttare: sai come farli germogliare?-Moka, il caffè perfetto? È una questione di chimica-I coralli sono spacciati? Un nuovo studio mappa le barriere che resistono al cambiamento climatico-Terremoto in Venezuela: la vicinanza di Ecoseven al popolo venezuelano e come aiutare chi ha perso tutto-Prezzi carburanti oggi 26 giugno 2026: benzina e diesel ancora in calo, ma dal 4 luglio rischio rincaro

Il nostro DNA culturale e’ nei libri, e ora e’ online

Condividi questo articolo:

Per la sua affinità alla genomica, i ricercatori lo hanno denominato ’culturomics’, vale a dire genoma culturale. Ora, dopo quattro anni di lavoro, i frutti di questo ambizioso progetto, nato dalla collaborazione tra Università di Harvard, Google, Encyclopaedia Britannica e American Heritage Dictionary, sono stati descritti in un articolo apparso sull’ultimo numero di Science. Si tratta di un set di dati estremamente potente, costruito a partire da 5,2 milioni di volumi e ben 500 miliardi di parole: pari a circa il 4% dei libri ad oggi pubblicati.
“Questo patrimonio digitale – spiegano gli autori – verrà utilizzato secondo criteri quantitativi ripresi, appunto, dalla genomica: servirà per studiare l’evoluzione di una serie di fenomeni culturali e storici, sulla base dei cambiamenti nella frequenza dei termini usati nel corso di secoli e decenni”. Con una metafora, è possibile paragonarlo a un “reperto fossile” della cultura umana, riportato in vita grazie alla digitalizzazione dei testi.

“L’interesse per gli approcci computazionali alle scienze umane e sociali risale agli anni Cinquanta”, ha detto Jean-Baptiste Michel, ricercatore presso il Dipartimento di Psicologia e Programmazione per le Dinamiche Evoluzionare di Harvard. “Finora, però, i tentativi di utilizzare i metodi quantitativi nello studio della cultura sono stati ostacolati dalla mancanza di dati appropriati. Adesso, grazie a questo lavoro, abbiamo un grande set di dati, disponibile tramite una interfaccia che è al tempo stesso facile da usare e disponibile gratuitamente a tutti”.

A realizzare questo strumento sono stati gli ingegneri di Google: essenzialmente si tratta di un’interfaccia che consente agli utenti di digitare una parola o una frase, per poi vedere come è cambiata la sua frequenza durante i secoli. “La culturomica estende i confini dell’indagine quantitativa a un ampio spettro di nuovi fenomeni nelle scienze umane e sociali”, ha aggiunto Erez Lieberman Aiden, l’altro autore dell’articolo. “Navigare tra questo patrimonio di dati è un’esperienza affascinante per chiunque sia interessato a capire ciò che ha interessato le persone nei secoli. Inoltre, speriamo che gli accademici delle discipline umanistiche lo trovino uno strumento utile ed efficiente”.

L’insieme dei dati digitali è migliaia di volte più grande rispetto a ogni altro corpus storico collezionato finora. Circa il 72 per cento del testo è in inglese, il resto si divide tra francese, spagnolo, tedesco, cinese, russo ed ebraico. Messe insieme, tutte le lettere compongono una sequenza 1.000 volte più lunga del genoma umano. Se tutti i caratteri venissero disposti in linea retta, si otterrebbe una linea pari a dieci volte la distanza tra il nostro pianeta e la Luna. “Ora che una frazione significativa dei libri del mondo è stata digitalizzata, è possibile per i programmi di analisi computerizzata rivelare trend nascosti in campi come la storia, la cultura, il linguaggio e il pensiero filosofico”, ha concluso Jon Orwant, ingegnere e manager di Google Books.

I commenti sono chiusi.