Cómo Diseñar una Escala de Likert 2026: Puntos, Anclajes y Puntuación (con Ejemplos)
Decidiste medir actitudes, percepciones o grados de acuerdo en tu tesis y la escala de Likert parece la opción ideal. El problema aparece cuando tenés que elegir cuántos puntos usar, qué palabras poner en los extremos, cómo manejar los ítems invertidos y si podés calcular una media o solo la mediana. Saber cómo diseñar una escala de Likert correctamente —desde la redacción de los ítems hasta la puntuación sumativa— determina si tu instrumento va a sobrevivir la revisión del jurado o va a generar observaciones difíciles de responder.
En esta guía encontrás todas las decisiones de diseño clave, ejemplos concretos aplicables a tesis argentinas y los errores más frecuentes que señalan los directores al revisar capítulos metodológicos.
¿Qué es la escala de Likert?
Rensis Likert propuso este instrumento en su trabajo de 1932 “A Technique for the Measurement of Attitudes” (Archives of Psychology) como una alternativa más sencilla y confiable a los métodos de medición de actitudes vigentes en la época. La idea central es que una actitud o percepción no se puede capturar con una sola pregunta: se necesita un conjunto de ítems relacionados que, al sumarse, midan la variable latente con mayor precisión.
Conviene distinguir dos conceptos que muchas tesis confunden:
- Ítem de Likert: una sola afirmación con categorías de respuesta ordenadas (por ejemplo, de “Totalmente en desacuerdo” a “Totalmente de acuerdo”).
- Escala de Likert: el instrumento completo, formado por varios ítems que miden el mismo constructo y cuyas respuestas se combinan en un puntaje total.
Cuando tu técnica de recolección de datos es la encuesta, la escala de Likert es la herramienta más usada para medir variables como satisfacción, motivación, actitudes, percepciones de calidad o grado de acuerdo con afirmaciones teóricas.
¿Cuántos puntos elegir? 5, 7 u otro número
La pregunta más frecuente al diseñar una escala de Likert es cuántas categorías de respuesta incluir. No existe una respuesta única, pero hay criterios claros para decidir según el contexto de tu investigación.
Escala de 5 puntos
Es el formato más difundido en investigación académica y social. Ofrece suficiente discriminación para la mayoría de los constructos, reduce la fatiga de los participantes y facilita el análisis estadístico. Es la opción recomendada cuando la muestra incluye respondentes con menor escolaridad o cuando el cuestionario es extenso.
Escala de 7 puntos
Aporta mayor precisión discriminativa, lo que puede ser valioso cuando se miden diferencias sutiles entre grupos o cuando los participantes tienen alta familiaridad con el tema. Se usa frecuentemente en psicología, economía del comportamiento y estudios organizacionales avanzados.
Par vs. impar: el punto neutro
La cantidad de puntos también define si la escala tiene un punto medio neutro:
- Impar (3, 5, 7 puntos): incluye un punto central explícito (“Ni de acuerdo ni en desacuerdo”), lo que permite que los respondentes expresen ambivalencia o indiferencia genuina.
- Par (4, 6 puntos): elimina el punto medio y obliga a posicionarse de un lado. Se utiliza cuando querés evitar respuestas evasivas por aquiescencia central, aunque puede generar incomodidad en participantes realmente indecisos.
Cómo redactar los ítems
La calidad de cada ítem determina la validez de contenido del instrumento. Antes de armar tu cuestionario de investigación, revisá estos principios fundamentales:
- Una sola idea por ítem. Los ítems dobles (“El programa es útil y bien organizado”) producen respuestas ambiguas porque el participante puede estar de acuerdo con una parte y en desacuerdo con la otra.
- Oraciones claras y directas. Evitá el vocabulario técnico que no sea estrictamente necesario. Si el ítem requiere explicación, el ítem está mal redactado.
- Sin dobles negaciones. “No creo que el sistema no sea confiable” confunde en lugar de medir.
- Relevancia para el constructo. Cada ítem debe relacionarse directamente con la variable que medís.
- Redacción en primera persona o impersonal. “Considero que…”, “Estoy satisfecho/a con…”, “El servicio…”.
Ejemplos de ítems bien y mal redactados
| Ítem problemático | Ítem mejorado | Problema resuelto |
|---|---|---|
| “El docente explica bien y cumple con el horario” | “El docente explica los temas con claridad” | Doble idea |
| “No me parece que el sistema no facilite el aprendizaje” | “El sistema facilita mi aprendizaje” | Doble negación |
| “La infraestructura es óptima para el desarrollo de competencias metacognitivas” | “El aula cuenta con los recursos necesarios para aprender” | Vocabulario innecesariamente técnico |
Anclajes balanceados: las etiquetas que definen la escala
Los anclajes son las etiquetas textuales asignadas a cada punto de la escala. Un anclaje mal elegido introduce sesgo de respuesta y afecta la validez del instrumento. El criterio central es que los intervalos semánticos entre categorías sean percibidos como equivalentes por los respondentes.
Tipos de anclajes según el constructo medido
| Constructo | 1 | 2 | 3 | 4 | 5 |
|---|---|---|---|---|---|
| Acuerdo | Totalmente en desacuerdo | En desacuerdo | Ni de acuerdo ni en desacuerdo | De acuerdo | Totalmente de acuerdo |
| Frecuencia | Nunca | Casi nunca | A veces | Casi siempre | Siempre |
| Satisfacción | Muy insatisfecho/a | Insatisfecho/a | Ni satisfecho/a ni insatisfecho/a | Satisfecho/a | Muy satisfecho/a |
| Importancia | Nada importante | Poco importante | Moderadamente importante | Importante | Muy importante |
Regla de oro: no mezcles tipos de anclaje dentro de la misma escala. Si empezás con acuerdo/desacuerdo, usá ese formato para todos los ítems del constructo. Mezclar tipos distintos dentro de un mismo instrumento genera confusión y aumenta el error de medición.
Ítems invertidos: para qué sirven y cómo usarlos
Un ítem invertido es un enunciado cuya dirección semántica es opuesta al constructo medido. Si tu escala mide motivación académica intrínseca, un ítem directo sería “Dedico tiempo extra a comprender el material de estudio”. Un ítem invertido sería “Hago el mínimo esfuerzo necesario para aprobar”.
¿Por qué incluirlos?
- Detectan respondentes distraídos o inconsistentes: alguien que marca siempre 5 en ítems directos y siempre 5 en ítems invertidos está respondiendo sin leer el contenido.
- Reducen el sesgo de aquiescencia: la tendencia a estar de acuerdo con cualquier afirmación independientemente de su contenido, muy frecuente en encuestas largas o cuando los participantes quieren complacer al investigador.
Cómo recodificarlos antes de puntuar
Antes de calcular el puntaje total, convertí los valores de los ítems invertidos aplicando la siguiente fórmula:
Valor recodificado = (número de puntos + 1) − valor original
Para una escala de 5 puntos: si el participante marcó 2, el valor recodificado es (5+1)−2 = 4. Así, una respuesta “negativa” en el ítem invertido queda alineada con las respuestas “positivas” en los ítems directos, y el puntaje total refleja correctamente el nivel del constructo.
Puntuación sumativa: cómo calcular el puntaje final
El puntaje de una escala de Likert se obtiene sumando los valores de todos los ítems —una vez recodificados los invertidos. Este procedimiento sumativo fue el que Likert describió en su trabajo de 1932 y sigue siendo el estándar metodológico en ciencias sociales.
Cómo definir e interpretar el rango de puntaje
- Puntaje mínimo: cantidad de ítems × 1
- Puntaje máximo: cantidad de ítems × cantidad de puntos
Luego dividí el rango en intervalos iguales para crear categorías interpretativas. Por ejemplo, con 10 ítems de 5 puntos, el rango es 10–50. Si dividís en tres niveles: 10–23 (bajo), 24–37 (medio), 38–50 (alto). Describí los criterios de interpretación explícitamente en tu sección metodológica para que el jurado entienda cómo operacionalizás la variable.
Escala ordinal vs. de intervalo: ¿media o mediana?
Este es el debate más frecuente en los coloquios de tesis. Desde un punto de vista estrictamente estadístico, los datos de una escala de Likert son ordinales: los números representan un orden pero no garantizan que los intervalos entre categorías sean iguales. Esto implicaría usar mediana y moda como medidas de tendencia central, y pruebas no paramétricas (Mann-Whitney, Kruskal-Wallis) para comparar grupos.
Sin embargo, existe una posición ampliamente aceptada en la literatura metodológica que admite tratar las escalas de 5 o más puntos como si fueran de intervalo —especialmente cuando se trabaja con el puntaje sumado de múltiples ítems en lugar de ítems individuales. Bajo este enfoque, es válido calcular medias, desviaciones estándar y utilizar pruebas paramétricas.
Para el análisis estadístico de los datos de tu escala, podés apoyarte en el tutorial de cómo analizar datos en SPSS, que incluye los procedimientos para calcular el Alfa de Cronbach, estadística descriptiva y pruebas comparativas entre grupos.
Ejemplo completo de escala de Likert para una tesis
A continuación se presenta un ejemplo ilustrativo de escala de motivación académica intrínseca, diseñada para estudiantes universitarios argentinos (10 ítems, 5 puntos). Los ítems 3 y 7 son invertidos y deben recodificarse antes de sumar.
| # | Ítem | TD | D | N | A | TA |
|---|---|---|---|---|---|---|
| 1 | Estudio porque me interesa profundamente la carrera que elegí. | 1 | 2 | 3 | 4 | 5 |
| 2 | Busco material adicional más allá de lo que pide el docente. | 1 | 2 | 3 | 4 | 5 |
| 3 [I] | Estudio únicamente cuando hay una evaluación próxima. | 1 | 2 | 3 | 4 | 5 |
| 4 | Siento satisfacción cuando logro entender un tema difícil. | 1 | 2 | 3 | 4 | 5 |
| 5 | Me planteo preguntas nuevas cuando leo bibliografía de la carrera. | 1 | 2 | 3 | 4 | 5 |
| 6 | Participo activamente en clase porque me interesa el tema. | 1 | 2 | 3 | 4 | 5 |
| 7 [I] | Prefiero aprobar con el mínimo esfuerzo posible. | 1 | 2 | 3 | 4 | 5 |
| 8 | Relaciono espontáneamente los temas de la carrera con situaciones de la vida cotidiana. | 1 | 2 | 3 | 4 | 5 |
| 9 | Leo más de lo requerido cuando encuentro un tema interesante. | 1 | 2 | 3 | 4 | 5 |
| 10 | El aprendizaje en sí mismo me resulta gratificante, independientemente de la nota. | 1 | 2 | 3 | 4 | 5 |
TD = Totalmente en desacuerdo · D = En desacuerdo · N = Ni de acuerdo ni en desacuerdo · A = De acuerdo · TA = Totalmente de acuerdo · [I] = Ítem invertido (recodificar antes de sumar).
Una vez validada con juicio de expertos y calculado el Alfa de Cronbach para verificar la confiabilidad interna, esta escala está lista para aplicarse. Consultá nuestra guía sobre validez y confiabilidad de un instrumento para recorrer ese proceso paso a paso.
Errores comunes al diseñar la escala
- Incluir un solo ítem por constructo. Un solo ítem no es una escala de Likert; es una pregunta de valoración. Se necesitan al menos cuatro o cinco ítems para que el puntaje sumativo sea interpretable como variable latente.
- Mezclar distintos tipos de anclaje en un mismo constructo. Si un ítem usa “acuerdo/desacuerdo” y el siguiente usa “siempre/nunca”, el respondente pierde el marco de referencia y aumenta el error de medición.
- Omitir los ítems invertidos. Una escala sin ningún ítem invertido no puede detectar respondentes que marcan sistemáticamente el mismo valor sin leer el contenido.
- No verificar la unidimensionalidad. Si los ítems miden subconstructos diferentes, el puntaje sumativo carece de interpretación. Verificá la dimensionalidad con análisis factorial exploratorio antes de administrar el instrumento a tu muestra principal.
- Sumar sin recodificar. Si sumás los ítems invertidos con sus valores originales, el puntaje total es incorrecto y los resultados carecen de validez.
- No reportar la fuente del instrumento. Si adaptaste una escala existente, citá el instrumento original y describí cómo lo modificaste. Si la construiste vos, describí el proceso de validación completo.
Para una comparación más amplia entre la escala Likert y otras alternativas de medición —como el diferencial semántico o la escala de Guttman—, la guía sobre tipos de instrumentos de recolección de datos detalla cuándo conviene elegir cada uno según el constructo y el diseño de investigación.

Cómo presentar los resultados en tu tesis
La presentación de resultados de una escala de Likert incluye normalmente tres niveles:
- Análisis ítem por ítem: tabla de frecuencias y porcentajes para cada ítem. Permite identificar distribuciones asimétricas o efectos de techo y piso en ítems específicos que merezcan discutirse.
- Puntaje sumativo global: media (o mediana) y desviación estándar (o rango intercuartílico) del puntaje total, junto con la categoría interpretativa que le corresponde según los criterios que definiste en tu metodología.
- Comparaciones entre grupos: si tu diseño lo requiere, comparás los puntajes entre subgrupos —por género, carrera, año de cursada— usando la prueba estadística que corresponda al nivel de medición que adoptaste.
Incluí siempre el instrumento completo en un anexo de tu tesis: los ítems, los anclajes y las instrucciones que recibieron los respondentes. Esto permite que el jurado evalúe el instrumento y que futuros investigadores puedan replicar el estudio. Si necesitás organizar el resto del capítulo metodológico, la guía sobre población y muestra te ayuda a alinear el tamaño muestral con la potencia estadística que requiere el análisis de tu escala.
Preguntas frecuentes
¿Cuántos ítems debe tener una escala de Likert?
No existe un número fijo, pero la práctica metodológica sugiere un mínimo de cuatro o cinco ítems por constructo para que el puntaje sumativo sea interpretable. Escalas bien establecidas suelen tener entre seis y quince ítems. Más de veinte ítems por constructo puede generar fatiga en los respondentes y reducir la calidad de las respuestas.
¿Se puede calcular la media con datos de una escala de Likert?
Depende de la posición metodológica que adoptés y del consenso de tu director/a. La escala es técnicamente ordinal, lo que implicaría usar mediana y moda. Sin embargo, muchos investigadores calculan medias del puntaje sumativo argumentando que el conjunto de ítems aproxima un nivel de intervalo. Lo importante es justificar explícitamente en tu metodología qué decisión tomaste y por qué.
¿Cómo valido una escala de Likert que construí yo?
La validación incluye al menos dos dimensiones: validez de contenido —juicio de expertos que evalúan si los ítems representan el constructo— y confiabilidad —Alfa de Cronbach calculado en una muestra piloto. Valores de Alfa por encima de 0,70 son generalmente aceptados en investigación académica. Si el tiempo lo permite, podés añadir un análisis factorial exploratorio para verificar la unidimensionalidad del instrumento.
¿Qué diferencia hay entre escala de Likert y escala de valoración?
Una escala de valoración puede incluir cualquier rango numérico (del 1 al 10, estrellas, etc.) y puede aplicarse a un solo ítem. La escala de Likert, en sentido estricto, es un conjunto de ítems redactados como afirmaciones con categorías de respuesta ordenadas que, al sumarse, miden una variable latente única. El puntaje de una valoración no es sumativo; el de una escala de Likert sí lo es.
¿Es obligatorio incluir ítems invertidos?
No existe una norma que los exija en términos absolutos, pero la mayoría de los manuales de psicometría los recomiendan para reducir el sesgo de aquiescencia y mejorar la calidad de los datos. Si aplicás la escala a una muestra pequeña o con tiempo de respuesta muy limitado, podés no incluirlos, pero deberías justificarlo en tu sección metodológica.
