La escala de Likert es un instrumento de medición de actitudes y opiniones formado por una serie de afirmaciones, llamadas ítems, ante las que la persona encuestada indica su grado de acuerdo en una escala ordenada, normalmente de cinco opciones: totalmente en desacuerdo, en desacuerdo, ni de acuerdo ni en desacuerdo, de acuerdo y totalmente de acuerdo. Cada respuesta recibe un número, y la suma o el promedio de los ítems da una puntuación global de la actitud. Es el formato más usado en los cuestionarios de las ciencias sociales, la educación, la salud y los estudios de mercado, y casi cualquier tesis que mida satisfacción, clima laboral, motivación o percepción acaba usando una.
Conviene distinguir dos cosas que el uso cotidiano mezcla. Un ítem tipo Likert es una sola pregunta con opciones de acuerdo graduadas. Una escala de Likert en sentido estricto es el conjunto de varios ítems que miden la misma actitud y cuyas respuestas se suman. La distinción importa porque las propiedades estadísticas de la suma de diez ítems son muy distintas de las de un ítem aislado.
El psicólogo estadounidense Rensis Likert la presentó en 1932 como una simplificación del método de Louis Thurstone, que exigía que un grupo de jueces clasificara cientos de afirmaciones antes de poder usarlas. Likert mostró que se obtenía una fiabilidad comparable pidiendo directamente a los encuestados que graduaran su acuerdo y sumando las respuestas, y por eso su método se llama también de puntuaciones sumadas.

Un ejemplo completo muestra cómo se construye y se puntúa. Para medir la satisfacción con la enseñanza virtual en una facultad se podrían redactar seis ítems: las clases virtuales me permiten aprender tanto como las presenciales; los docentes responden a mis dudas en un plazo razonable; la plataforma es fácil de usar; me cuesta concentrarme durante las clases virtuales; los materiales del curso están bien organizados; y preferiría no volver a tener clases virtuales. Cuatro están redactados en sentido favorable y dos, el cuarto y el sexto, en sentido desfavorable. Con cinco opciones puntuadas de 1 a 5, los ítems desfavorables se invierten antes de sumar: un 5 pasa a valer 1, un 4 pasa a valer 2 y así sucesivamente, es decir, se calcula 6 menos la respuesta. Un estudiante que responde 4, 5, 3, 2, 4 y 1 obtiene, tras invertir el cuarto y el sexto ítem, 4 + 5 + 3 + 4 + 4 + 5 = 25 puntos sobre un máximo de 30 y un mínimo de 6. Si la tesis necesita niveles, se fijan antes de recoger los datos, por ejemplo baja satisfacción de 6 a 14, media de 15 a 22 y alta de 23 a 30.
La redacción de los ítems decide la calidad del instrumento, y los defectos se ven mejor corregidos. Los docentes son puntuales y explican bien contiene dos ideas; hay que separarlas en dos ítems. No es cierto que la plataforma no funcione mal es una doble negación que nadie entiende a la primera. ¿Está de acuerdo en que la excelente plataforma facilita el aprendizaje? sugiere la respuesta con el adjetivo. La metodología sincrónica favorece la autorregulación usa términos que muchos encuestados no conocen. Y uso la plataforma no es una afirmación de actitud sino de frecuencia, que pide otra escala (nunca, a veces, a menudo, siempre).
El proceso completo tiene pasos bien establecidos: definir el constructo y sus dimensiones, que es la parte de la operacionalización; redactar más ítems de los necesarios, favorables y desfavorables; someterlos a juicio de expertos para la validez de contenido; probarlos en una muestra piloto; eliminar los que no se correlacionan con el resto; y calcular la fiabilidad, habitualmente con el alfa de Cronbach. Siempre que exista un instrumento ya validado para la misma población, es preferible usarlo, citarlo y no inventar uno nuevo.
Sobre el formato, cinco o siete opciones son lo habitual: menos pierde información, y más apenas mejora la fiabilidad y cansa. La opción central neutra permite expresar indiferencia real, pero también ofrece un refugio a quien no quiere pensar. Conviene etiquetar todas las opciones con palabras. Los ítems invertidos ayudan a detectar la aquiescencia, la tendencia a estar de acuerdo con todo, una de las formas del satisficing que Jon Krosnick describió en 1991: dar una respuesta suficiente en lugar de la mejor cuando la tarea exige demasiado esfuerzo. Un cuestionario de 80 ítems al final de una clase es la receta para obtenerla.
La cuestión estadística más debatida es qué tipo de datos produce una escala de Likert. Según los niveles de medida de S. S. Stevens (1946), las respuestas a un ítem son ordinales: se sabe que de acuerdo está por encima de indiferente, pero no que las distancias sean iguales. Susan Jamieson defendió en 2004 que, en consecuencia, se describan con la mediana y los porcentajes y se analicen con pruebas no paramétricas. James Carifio y Rocco Perla (2007) y Geoff Norman (2010) respondieron que la suma de varios ítems se comporta de forma muy aproximada a una variable de intervalo y que las pruebas paramétricas son robustas. La práctica aceptada combina ambas posturas. Un ítem suelto se informa así: el 62 % de los estudiantes se mostró de acuerdo o totalmente de acuerdo con que la plataforma es fácil de usar (mediana = 4). La puntuación total se informa así: la satisfacción media fue de 19,4 puntos sobre 30 (DE = 4,1), sin diferencias significativas entre primer y segundo año.
Los errores más comunes en una tesis son olvidar invertir los ítems desfavorables antes de sumar, calcular medias de un único ítem con dos decimales como si fueran medidas exactas, cambiar el número de opciones de un instrumento validado sin volver a validarlo, presentar la opción neutra como opinión favorable o desfavorable y construir los niveles de la variable a posteriori, mirando los datos.
Cuestionario – Alfa de Cronbach – Escala de valoración – Validez de contenido – Operacionalización – Encuesta
Fuentes
- Louis L. Thurstone y E. J. ChaveThe Measurement of Attitude: A Psychophysical Method and Some Experiments with a Scale for Measuring Attitude Toward the ChurchUniversity of Chicago Press, Chicago1929
- Rensis LikertA Technique for the Measurement of AttitudesArchives of Psychology 140, 1-551932
- S. S. StevensOn the Theory of Scales of MeasurementScience 103 (2684), 677-6801946enlace
- Jon A. KrosnickResponse Strategies for Coping with the Cognitive Demands of Attitude Measures in SurveysApplied Cognitive Psychology 5 (3), 213-2361991enlace
- Susan JamiesonLikert Scales: How to (Ab)use ThemMedical Education 38 (12), 1217-12182004enlace
- James Carifio y Rocco J. PerlaTen Common Misunderstandings, Misconceptions, Persistent Myths and Urban Legends about Likert Scales and Likert Response Formats and their AntidotesJournal of Social Sciences 3 (3), 106-1162007enlace
- Geoff NormanLikert Scales, Levels of Measurement and the “Laws” of StatisticsAdvances in Health Sciences Education 15 (5), 625-6322010enlace