La validez de contenido por juicio de expertos es el procedimiento por el cual un grupo de personas con conocimiento del tema evalúa, ítem por ítem, si tu instrumento cubre de verdad lo que dice medir. No es una firma de aval: es un dato que se recoge con una plantilla, se cuantifica con un coeficiente —normalmente la V de Aiken— y se reporta en el capítulo metodológico junto con los cambios que produjo.
Casi todos los trabajos de grado que aplican un cuestionario propio dicen que fue «validado por expertos». Muy pocos explican con qué criterios, cuántos expertos, con qué escala, con qué resultado numérico y qué ítems cambiaron. Esa diferencia es exactamente la que el jurado va a preguntar en la sustentación. Aquí está el procedimiento completo.
Qué resuelve el juicio de expertos y qué no
Conviene ubicarlo antes de gastar tiempo. El juicio de expertos responde una sola pregunta: ¿los ítems que escribí representan bien el concepto que quiero medir? Eso es validez de contenido, y es un juicio humano sobre el contenido de cada pregunta.
No responde si tu escala es consistente —eso lo estima el alfa de Cronbach con datos reales— ni si mide el mismo constructo que otro instrumento ya aceptado. Si necesitas ubicar los tres tipos de validez y la fiabilidad antes de seguir, el panorama completo está en la guía para diseñar un cuestionario válido y fiable. Este artículo se ocupa solo del primero, que es el que se hace antes de aplicar nada.
Dos aclaraciones que ahorran discusiones con el director:
- Si vas a usar una escala ya publicada y validada, no necesitas juicio de expertos. Lo que necesitas es el permiso y, si la adaptas, documentar la adaptación.
- Si construiste tú los ítems —aunque sean quince preguntas sencillas—, sí lo necesitas. Es el mínimo que hace defendible un instrumento nuevo.
Paso 1: decide qué le vas a pedir a cada experto
El error más común es enviar el cuestionario con un correo que dice «por favor revíselo y déme su opinión». Vuelven cinco correos con comentarios incomparables entre sí y no se puede calcular nada. La solución es fijar de antemano criterios idénticos para todos los ítems y para todos los jueces. Los cuatro que se usan con más frecuencia en trabajos de grado colombianos son:
- Suficiencia. ¿Los ítems que pertenecen a esta dimensión alcanzan para medirla, o falta algo?
- Claridad. ¿La redacción es comprensible para la población a la que va dirigida, sin tecnicismos innecesarios ni ambigüedad?
- Coherencia. ¿El ítem corresponde a la dimensión donde lo pusiste?
- Relevancia. ¿Es esencial conservar el ítem, o se puede eliminar sin perder información?
Cada criterio se califica con una escala ordinal corta, casi siempre de 1 a 4 (1 = no cumple, 2 = bajo, 3 = moderado, 4 = alto). Cuatro categorías tienen una ventaja concreta: no hay punto medio, así que el experto está obligado a inclinarse hacia un lado.
Para que el juez pueda evaluar «coherencia», necesita ver a qué dimensión pertenece cada ítem. Eso significa que tu matriz de operacionalización de variables tiene que estar terminada antes de convocar el panel. Si todavía no sabes de qué dimensión cuelga cada pregunta, no estás listo para validar.

Paso 2: a quién invitas y cuántos
Un panel útil mezcla dos perfiles: expertos temáticos, que conocen el fenómeno, y expertos metodológicos, que conocen la construcción de instrumentos. Si tu población tiene una particularidad —adolescentes, personal de salud, población rural, hablantes de una lengua distinta—, incluye a alguien que la conozca de primera mano, porque los problemas de claridad los detecta esa persona y nadie más.
Sobre el número: en trabajos de grado se trabaja habitualmente con entre tres y cinco jueces, y esa cifra es suficiente para un instrumento corto. Hay dos razones prácticas para no bajar de tres: con dos, un desacuerdo deja el ítem empatado sin criterio de desempate, y con dos jueces el coeficiente pierde casi todo su poder para discriminar. Y hay una razón para no pasar de siete u ocho: la coordinación se vuelve el cuello de botella del cronograma.
Documenta el perfil de cada juez sin revelar su identidad si no tienes su autorización: título máximo, área, años de experiencia y vínculo institucional. Esa tabla va en el anexo y es lo primero que mira un lector que quiera saber si el panel era competente.
Paso 3: la plantilla que envías
El paquete que recibe cada experto tiene cinco piezas y ninguna sobra:
- Una carta breve que explica el objetivo del estudio, la población, para qué se usará el instrumento y cuánto tiempo le va a tomar la revisión.
- La definición conceptual y operacional de la variable y de cada dimensión. Sin esto el experto está calificando a ciegas.
- La matriz de ítems: número, dimensión a la que pertenece, redacción textual del ítem y las cuatro columnas de calificación.
- Una columna de observaciones por ítem, ancha. Ahí está el verdadero valor del ejercicio: la reescritura sugerida.
- Un bloque final con una valoración global del instrumento y espacio para proponer ítems faltantes.
Enviarlo en un formulario en línea acelera la consolidación y elimina errores de transcripción, pero pierde comodidad para el experto que quiere escribir al margen. Un buen término medio es enviar el documento editable y, cuando vuelva, vaciar las calificaciones a una hoja de cálculo con los ítems en filas y los jueces en columnas.
Paso 4: la V de Aiken, con un ejemplo completo
La V de Aiken convierte las calificaciones de los jueces en un número entre 0 y 1 por cada ítem y criterio. Su fórmula es:
V = S / [n · (c − 1)]
donde S es la suma de las puntuaciones asignadas menos el valor mínimo posible de la escala en cada caso, n es el número de jueces y c el número de categorías de la escala. El coeficiente fue propuesto por Lewis R. Aiken en Educational and Psychological Measurement (1980, vol. 40, núm. 4, pp. 955-959, DOI 10.1177/001316448004000419) y ampliado por el mismo autor en la misma revista cinco años después (1985, vol. 45, núm. 1, pp. 131-142, DOI 10.1177/0013164485451012).
Un ejemplo con cinco jueces y una escala de 1 a 4 (n = 5, c = 4, así que el denominador es 5 × 3 = 15):
- Ítem 7, criterio claridad. Calificaciones: 4, 4, 3, 4, 4. Se resta 1 a cada una: 3, 3, 2, 3, 3. Suma S = 14. V = 14 / 15 = 0,93.
- Ítem 12, criterio claridad. Calificaciones: 2, 3, 2, 4, 3. Restando 1: 1, 2, 1, 3, 2. Suma S = 9. V = 9 / 15 = 0,60.
El ítem 7 pasa. El 12 no, y además el patrón —dos jueces en 2 y uno en 4— dice que hay desacuerdo real, no ruido. Ese ítem hay que reescribirlo leyendo las observaciones, no eliminarlo de una vez.
En la práctica se suele adoptar V ≥ 0,80 como umbral de aceptación, y algunos programas usan 0,70. Es una convención, no una ley: si tu director te pide justificarlo con un criterio estadístico en lugar de una costumbre, Aiken publicó el coeficiente acompañado de valores críticos que permiten decidir con un nivel de significancia; la referencia exacta es la de 1980 que acabas de ver. Escribe en el capítulo cuál umbral usaste y por qué antes de calcular nada, no después de ver los resultados.
Existe una alternativa igual de aceptada: la razón de validez de contenido (CVR) de Lawshe, publicada en Personnel Psychology (1975, vol. 28, núm. 4, pp. 563-575, DOI 10.1111/j.1744-6570.1975.tb01393.x), que trabaja con una decisión de tres opciones —esencial, útil pero no esencial, no necesario— y tiene valores mínimos que dependen del número de jueces. Elige una y úsala en todo el instrumento; mezclar coeficientes en el mismo trabajo solo confunde al lector.

Paso 5: qué haces con los ítems que no pasaron
Hay tres salidas y la elección depende del criterio que falló, no del valor del coeficiente:
- Falló claridad. Reescribe con las palabras que sugirieron los jueces y vuelve a mostrarlo, aunque sea a dos de ellos. Casi nunca hay que eliminar un ítem por redacción.
- Falló coherencia. El ítem probablemente pertenece a otra dimensión. Muévelo antes de descartarlo.
- Falló relevancia o suficiencia. Aquí sí puede haber eliminación —o, al revés, hay que agregar ítems porque la dimensión quedó corta—. Si eliminas, revisa que la dimensión no se quede con dos preguntas: una dimensión con muy pocos ítems arrastra problemas después, cuando calcules consistencia interna.
Después de ajustar, lo que sigue no es aplicar el instrumento definitivo sino probarlo con un grupo pequeño de la población real. Es un paso distinto y no lo reemplaza el juicio de expertos: los jueces detectan problemas conceptuales y los participantes detectan que la pregunta 9 se entiende al revés.
Paso 6: qué se reporta en el capítulo metodológico
Un párrafo bien armado incluye seis datos y cabe en media página:
- Cuántos jueces participaron y con qué perfil (remitiendo al anexo).
- Qué criterios se evaluaron y con qué escala.
- Qué coeficiente se usó y qué umbral se fijó, con la referencia bibliográfica.
- El rango de valores obtenido y, si hay espacio, la tabla completa por ítem en anexos.
- Cuántos ítems se conservaron sin cambios, cuántos se reescribieron, cuántos se eliminaron y cuántos se agregaron.
- La versión final del instrumento como anexo.
Si el instrumento recoge datos de personas identificables, el juicio de expertos no sustituye ninguna autorización: la revisión ética es un trámite paralelo y anterior a la aplicación. Cómo clasificar el riesgo de tu estudio está explicado en la guía sobre el aval del comité de ética en Colombia.
Cuatro errores que restan puntos
- Decir «validado por expertos» sin número. Es la afirmación más fácil de desmontar en una sustentación.
- Escoger el umbral después de ver los resultados. Si fijas 0,70 porque con 0,80 se te caían cuatro ítems, eso se nota en la tabla.
- Calcular la V solo sobre el promedio general del instrumento. El coeficiente es por ítem y por criterio; un promedio global de 0,88 puede esconder tres ítems en 0,55.
- Perder las observaciones cualitativas. La columna de comentarios suele ser más valiosa que el coeficiente y muchos estudiantes la borran al vaciar los datos a Excel.
Preguntas frecuentes
¿Sirve el juicio de expertos para una guía de entrevista cualitativa?
Sí, con adaptaciones. En instrumentos cualitativos se evalúan sobre todo claridad, pertinencia y suficiencia de las preguntas frente a los objetivos, y muchas veces se reporta el resultado de forma descriptiva —qué se cambió y por qué— en lugar de con un coeficiente. Lo que no cambia es la exigencia de dejar constancia del procedimiento.
¿Mi director puede ser uno de los jueces?
Es preferible que no, porque quien orientó la construcción del instrumento difícilmente lo evalúa con distancia y un evaluador puede señalarlo. Si por disponibilidad no hay alternativa, decláralo explícitamente en el reporte.
¿Qué hago si un experto no me responde?
Fija un plazo desde el primer correo y contempla un reemplazo desde el inicio: invita a uno más de los que necesitas. Recalcular la V con un juez menos es posible —el denominador cambia—, pero si el que falta era el único con conocimiento de tu población, el panel pierde justo la competencia que lo hacía útil.
¿La V de Aiken se calcula en SPSS?
No hace falta: es una división y se resuelve en una hoja de cálculo en cinco minutos, con los ítems en filas, los jueces en columnas y una fórmula por criterio. Reserva el software estadístico para lo que viene después, cuando ya tengas datos y toque el análisis cuantitativo.
¿Cuántos ítems debería tener el instrumento antes de la validación?
Escribe más de los que piensas conservar. Es habitual llegar al panel con un 20 % o 30 % de ítems de sobra, precisamente porque parte se va a caer o se va a fusionar. Llegar con el número exacto te deja sin margen y empuja a conservar ítems malos para no quedarte corto en una dimensión.
Validar bien es lo que hace defendible tu instrumento
El juicio de expertos ocupa dos semanas de calendario y media página del documento, pero es la diferencia entre un cuestionario que se sostiene ante el jurado y uno que se cae con una sola pregunta. Planifícalo cuando estés escribiendo el capítulo metodológico, no cuando ya tengas encima la fecha de aplicación. Si quieres avanzar más rápido en la redacción de ese capítulo y dejar documentado el procedimiento con orden, puedes escribir tu trabajo de grado con Tesify.
