Calculadora de diversidad léxica
Mide la variedad de vocabulario de tu escritura con la razón tipo-token (TTR) y la TTR raíz, y descubre qué palabras repites más.
Preguntas frecuentes
- ¿Qué es la razón tipo-token (TTR)?
- La TTR es el número de palabras únicas (tipos) dividido entre el número total de palabras (tokens). Un texto de 100 palabras con 60 palabras distintas tiene una TTR de 0,60, o 60 %. Los valores más altos significan un vocabulario más variado.
- ¿Qué es la TTR raíz y por qué se muestra?
- La TTR raíz (índice de Guiraud) divide las palabras únicas entre la raíz cuadrada del total de palabras. Como la TTR simple siempre baja a medida que un texto se alarga, la TTR raíz corrige parcialmente la longitud y es más estable cuando los textos difieren moderadamente en tamaño.
- ¿Puedo comparar la TTR de dos textos?
- Solo si tienen aproximadamente la misma longitud. La TTR depende en gran medida de la longitud del texto: todo texto repite más palabras funcionales como "the" y "of" a medida que crece, así que un ensayo de 2000 palabras casi siempre obtendrá una puntuación más baja que un párrafo de 200 palabras, sin importar la calidad de la escritura.
- ¿Qué es una buena puntuación de diversidad léxica?
- No hay un objetivo universal: varía según la longitud, el género y el público. Como guía aproximada para fragmentos de unos cientos de palabras, una TTR por debajo del 40 % sugiere una repetición notable, del 40 al 60 % es típico de una prosa clara, y por encima del 60 % indica un vocabulario variado.
- ¿Cómo se cuentan las palabras?
- El texto se convierte a minúsculas y se divide en tokens de palabras (letras, dígitos y apóstrofos internos), así que "The" y "the" cuentan como un solo tipo, y "don't" es una sola palabra. La puntuación se ignora. Todo se ejecuta localmente en tu navegador.