Saltar al contenido

Calculadora de diversidad léxica

Mide la variedad de vocabulario de tu escritura con la razón tipo-token (TTR) y la TTR raíz, y descubre qué palabras repites más.

Preguntas frecuentes

¿Qué es la razón tipo-token (TTR)?
La TTR es el número de palabras únicas (tipos) dividido entre el número total de palabras (tokens). Un texto de 100 palabras con 60 palabras distintas tiene una TTR de 0,60, o 60 %. Los valores más altos significan un vocabulario más variado.
¿Qué es la TTR raíz y por qué se muestra?
La TTR raíz (índice de Guiraud) divide las palabras únicas entre la raíz cuadrada del total de palabras. Como la TTR simple siempre baja a medida que un texto se alarga, la TTR raíz corrige parcialmente la longitud y es más estable cuando los textos difieren moderadamente en tamaño.
¿Puedo comparar la TTR de dos textos?
Solo si tienen aproximadamente la misma longitud. La TTR depende en gran medida de la longitud del texto: todo texto repite más palabras funcionales como "the" y "of" a medida que crece, así que un ensayo de 2000 palabras casi siempre obtendrá una puntuación más baja que un párrafo de 200 palabras, sin importar la calidad de la escritura.
¿Qué es una buena puntuación de diversidad léxica?
No hay un objetivo universal: varía según la longitud, el género y el público. Como guía aproximada para fragmentos de unos cientos de palabras, una TTR por debajo del 40 % sugiere una repetición notable, del 40 al 60 % es típico de una prosa clara, y por encima del 60 % indica un vocabulario variado.
¿Cómo se cuentan las palabras?
El texto se convierte a minúsculas y se divide en tokens de palabras (letras, dígitos y apóstrofos internos), así que "The" y "the" cuentan como un solo tipo, y "don't" es una sola palabra. La puntuación se ignora. Todo se ejecuta localmente en tu navegador.

Herramientas relacionadas