Calcolatore di diversità lessicale
Misura la varietà del vocabolario della tua scrittura con il rapporto tipo-token (TTR) e il TTR radice, e vedi quali parole ripeti di più.
Domande frequenti
- Cos'è il rapporto tipo-token (TTR)?
- Il TTR è il numero di parole uniche (tipi) diviso per il numero totale di parole (token). Un testo di 100 parole contenente 60 parole diverse ha un TTR di 0,60, ovvero il 60%. Valori più alti significano un vocabolario più vario.
- Cos'è il TTR radice e perché mostrarlo?
- Il TTR radice (indice di Guiraud) divide le parole uniche per la radice quadrata del numero totale di parole. Poiché il TTR semplice diminuisce sempre man mano che un testo si allunga, il TTR radice corregge parzialmente per la lunghezza ed è più stabile quando i testi differiscono moderatamente in dimensione.
- Posso confrontare il TTR di due testi?
- Solo se hanno una lunghezza simile. Il TTR dipende fortemente dalla lunghezza del testo — ogni testo ripete di più parole funzionali come "il" e "di" man mano che si allunga, quindi un saggio di 2.000 parole otterrà quasi sempre un punteggio più basso di un paragrafo di 200 parole, indipendentemente dalla qualità della scrittura.
- Qual è un buon punteggio di diversità lessicale?
- Non esiste un obiettivo universale — varia con lunghezza, genere e pubblico. Come guida approssimativa per brani di poche centinaia di parole, un TTR sotto il 40% suggerisce una ripetizione evidente, il 40-60% è tipico di una prosa chiara, e sopra il 60% indica un vocabolario vario.
- Come vengono contate le parole?
- Il testo viene reso minuscolo e diviso in token di parole (lettere, cifre e apostrofi interni), quindi "Il" e "il" contano come un solo tipo. La punteggiatura viene ignorata. Tutto avviene localmente nel tuo browser.