Tienes 18 entrevistas transcritas, o 40 documentos institucionales, o dos años de publicaciones de una alcaldía. Tu director dijo «haga un análisis de contenido» y tú abriste el primer archivo sin saber por dónde empezar. Lo que sigue no es codificar como en teoría fundamentada: el análisis de contenido tiene reglas propias, y la primera decisión —qué es exactamente lo que vas a contar— determina todo lo demás.

Qué es y en qué se diferencia de sus vecinos
El análisis de contenido es un procedimiento para clasificar de forma sistemática y replicable el contenido de un material comunicativo —textos, transcripciones, documentos, publicaciones, imágenes— en un conjunto de categorías definidas, con reglas explícitas de asignación.
La palabra que lo distingue de todo lo demás es replicable: otra persona con tu libro de códigos y tus reglas debería clasificar el mismo fragmento en la misma categoría. Esa exigencia empuja el análisis de contenido hacia el lado más estructurado de lo cualitativo, y es la razón por la que admite conteo.
| Análisis de contenido | Análisis temático | Teoría fundamentada | |
|---|---|---|---|
| Objetivo | Clasificar y describir qué hay y cuánto hay | Identificar patrones de significado transversales | Construir una teoría explicativa del fenómeno |
| Unidad | Definida de antemano y explícita | Flexible, el extracto significativo | El incidente |
| Categorías | Mutuamente excluyentes, con reglas | Temas que pueden solaparse | Categorías que evolucionan durante el proceso |
| Conteo | Habitual y legítimo | Poco frecuente | No pertinente |
| Muestreo | Corpus definido de antemano | Corpus definido de antemano | Teórico, guiado por la saturación |
Las tres son válidas. La que te toca depende de tu objetivo específico: si dice «caracterizar» o «identificar la presencia de», estás en análisis de contenido. Si dice «comprender el significado que atribuyen», estás en análisis temático. Si dice «construir un modelo explicativo», estás en teoría fundamentada. Para la mecánica de la codificación abierta, axial y selectiva, la guía es la de análisis de datos cualitativos; aquí desarrollamos la ruta propia del análisis de contenido.
Los tres enfoques (y por qué importa nombrar el tuyo)
Hsieh y Shannon distinguieron tres aproximaciones al análisis de contenido cualitativo en «Three Approaches to Qualitative Content Analysis», publicado en Qualitative Health Research en 2005 (15, 1277-1288; doi:10.1177/1049732305276687). La distinción es la respuesta más limpia que existe a la pregunta «¿de dónde salieron sus categorías?».
- Convencional (inductivo). Las categorías emergen del material. Se usa cuando la literatura sobre el fenómeno es escasa. Empiezas leyendo sin categorías previas y las construyes desde los datos.
- Dirigido (deductivo). Las categorías se derivan de una teoría o de un marco existente y se aplican al material, verificando o extendiendo ese marco. Se usa cuando hay teoría disponible y quieres ver cómo se comporta en tu contexto.
- Sumativo. Parte de contar la aparición de palabras o contenidos concretos, y después interpreta el significado subyacente de esos usos. Es el que más se acerca a lo cuantitativo, y el más expuesto a quedarse en el conteo sin interpretación.
El procedimiento inductivo clásico —preparación, organización y reporte— está descrito en detalle por Elo y Kyngäs en «The qualitative content analysis process», Journal of Advanced Nursing, 2008 (62, 107-115; doi:10.1111/j.1365-2648.2007.04569.x), la referencia más citada para el enfoque convencional en investigación en salud y educación.
Escribe cuál usas en la primera línea del apartado: «Se realizó un análisis de contenido dirigido, con categorías derivadas del modelo X y apertura a categorías emergentes». Esa frase contesta media docena de preguntas del jurado por adelantado.
Las dos unidades que hay que definir antes de leer nada

Unidad de muestreo
Qué documentos entran en el corpus. Una entrevista, un acta, una publicación, un artículo de prensa. Se define con criterios de inclusión y exclusión explícitos, igual que en una revisión.
Unidad de registro
El fragmento que se clasifica en una categoría, y por tanto lo que se cuenta. Puede ser la palabra, la frase, el párrafo o el tema. Esta es la decisión que más consecuencias tiene:
- Si la unidad es la palabra, el conteo es objetivo pero pierde matiz.
- Si es el párrafo, capturas más sentido pero un mismo párrafo puede tocar dos categorías.
- Si es el tema (una idea completa, sin importar su extensión), es lo más habitual en trabajos de grado y lo más defendible, pero exige una regla escrita sobre dónde empieza y dónde termina un tema.
Unidad de contexto
Cuánto texto alrededor lees para decidir en qué categoría va la unidad de registro. Si la unidad de registro es la frase, la unidad de contexto suele ser el párrafo. Sin esta definición, dos personas clasifican distinto la misma frase irónica o la misma respuesta que continúa la anterior.
Escríbelas las tres en el capítulo de método, en tres líneas. Es lo que separa un análisis de contenido de «leí las entrevistas y saqué unos temas».
Las reglas que deben cumplir tus categorías
- Exhaustivas. Toda unidad de registro relevante cabe en alguna categoría. La solución práctica es incluir una categoría «otros» y vigilarla: si crece por encima del 10 % de las asignaciones, tu sistema está incompleto.
- Mutuamente excluyentes. Cada unidad va en una sola categoría. Si dos categorías compiten por el mismo fragmento a menudo, están mal definidas o son la misma.
- Derivadas de un único criterio de clasificación. Este es el error silencioso: mezclar categorías por tema con categorías por actor o por valoración. Si necesitas clasificar por dos criterios, haz dos sistemas de categorías, no uno híbrido.
- Con definición y ejemplo. Cada categoría necesita un nombre, una definición de una o dos líneas, un ejemplo típico y —lo que más ayuda— un contraejemplo: un fragmento parecido que NO entra.
Ese conjunto es tu libro de códigos, y va como anexo. La regla es que se escribe antes de codificar el corpus completo y se congela después de la prueba, no que sea inmutable desde el minuto uno.
El procedimiento, en seis pasos
1. Define el corpus y descríbelo
Cuántos documentos, de qué tipo, en qué rango temporal, obtenidos cómo. Si son entrevistas propias, cuántas y de qué perfiles. Si son documentos institucionales, de qué entidad y descargados en qué fecha.
2. Prepara el material
Transcribe con convención uniforme, anonimiza y asigna un código a cada documento (E01, E02… o D01, D02…). Esos códigos son los que aparecerán junto a cada cita en el capítulo de resultados. La preparación de entrevistas está en la guía de cómo grabar y transcribir entrevistas.
3. Construye la primera versión del sistema de categorías
Con el 10-20 % del corpus, no con todo. En el enfoque convencional las lees y anotas; en el dirigido partes del marco teórico y ves qué falta.
4. Haz la prueba de codificación
Aplica el sistema a dos o tres documentos que no usaste para construirlo. Aquí aparecen los problemas reales: categorías que nunca se usan, fragmentos que no caben, categorías que compiten. Ajusta, y documenta el ajuste: «tras la prueba se fusionaron las categorías 3 y 5 por solapamiento».
5. Codifica el corpus completo con el sistema congelado
Si a mitad de camino aparece una categoría nueva imprescindible, la añades y vuelves atrás a revisar lo ya codificado. No hacerlo produce una matriz donde los primeros documentos están codificados con un sistema y los últimos con otro.
6. Construye la matriz y cuenta
Categorías en filas, documentos o casos en columnas, y en cada celda la frecuencia. Una hoja de cálculo basta para un corpus de trabajo de grado; un programa CAQDAS ayuda a partir de 30 o 40 documentos.
Cuantificar sin traicionar lo cualitativo

Contar es legítimo en análisis de contenido. Lo que no es legítimo es solo contar, ni presentar los conteos como si fueran resultados de una encuesta. Cuatro reglas:
- Reporta frecuencia de casos, no solo de menciones. «La categoría apareció 47 veces» dice poco si 40 de esas veces vienen de un solo entrevistado. «Apareció en 14 de las 18 entrevistas, con 47 menciones» dice mucho más.
- No calcules porcentajes sobre un corpus pequeño. Con 18 entrevistas, «el 61,1 %» sugiere una precisión que no existe. Escribe «11 de 18».
- Nunca inferencia estadística. Tu corpus no es una muestra probabilística de nada. Frecuencias y proporciones descriptivas, sí; pruebas de hipótesis, no. La distinción entre lo descriptivo y lo inferencial está en la guía de qué prueba estadística elegir.
- La frecuencia no es importancia. Lo mencionado una sola vez puede ser lo más revelador. Dilo cuando sea el caso, y argumenta por qué.
Cómo se presenta en el capítulo de resultados
El patrón que funciona repite tres movimientos por categoría:
- La cifra: «La categoría Sobrecarga administrativa apareció en 14 de las 18 entrevistas (52 unidades de registro), y fue la más frecuente del sistema.»
- La cita: uno o dos fragmentos textuales con el código del informante — «(E07)». Entrecomillados y sin retocar.
- La lectura: qué muestra ese conjunto, y qué matiz introduce quien dijo lo contrario.
Ese último punto es lo que distingue un buen capítulo: busca y presenta los casos discrepantes. Un análisis en el que todos los entrevistados coinciden en todo genera más sospecha que confianza. Para las convenciones de tablas y citas dentro del capítulo, la guía de cómo presentar los resultados cubre el formato.
La coherencia con el resto del trabajo
Si tu objetivo específico dice «caracterizar las percepciones de los docentes sobre X», la columna de análisis de tu matriz de consistencia no puede decir «interpretación». Debe decir «análisis de contenido dirigido con categorías derivadas del modelo X, unidad de registro: tema». Ese nivel de concreción es lo que el comité busca cuando dice que falta rigor metodológico.
Errores frecuentes
- Llamar análisis de contenido a una lectura temática sin unidades definidas. Si no puedes decir qué es una unidad de registro en tu estudio, no es análisis de contenido.
- Categorías con dos criterios mezclados. «Docentes», «Infraestructura» y «Opiniones negativas» no pueden convivir en un mismo sistema: la primera clasifica por actor, la segunda por tema y la tercera por valoración.
- Cambiar el sistema a mitad del corpus sin recodificar. Produce cifras que no significan nada.
- Presentar solo el conteo. Un capítulo de resultados que es una tabla de frecuencias sin citas ni interpretación no cumple el objetivo cualitativo.
- Elegir citas solo confirmatorias. Sesgo de selección, y el más fácil de detectar para un jurado que lea los anexos.
- No anonimizar bien. «El coordinador del área de calidad de la sede norte» identifica a una persona aunque no lleve nombre.
Preguntas frecuentes
¿Qué diferencia hay entre análisis de contenido y análisis temático?
El análisis de contenido define unidades de registro explícitas y categorías mutuamente excluyentes, con reglas de asignación que permiten replicar la clasificación y contar frecuencias. El análisis temático busca patrones de significado transversales con unidades flexibles y temas que pueden solaparse, y rara vez cuantifica. El primero describe qué hay y cuánto; el segundo interpreta qué significa.
¿Puedo contar en un análisis cualitativo?
Sí, y en análisis de contenido es habitual. Lo que debe evitarse es quedarse en el conteo sin interpretación, calcular porcentajes sobre corpus pequeños y aplicar pruebas de inferencia estadística a un corpus que no es una muestra probabilística. Reporta frecuencias absolutas y el número de casos en que aparece cada categoría.
¿Cuántos documentos o entrevistas necesito?
No hay un número fijo. En análisis de contenido el corpus se define por criterios de inclusión explícitos, no por saturación teórica, así que lo que hay que justificar es la pertinencia y la cobertura del corpus frente a tu objetivo, no un umbral numérico. Declara cuántos documentos hay, de qué tipo y por qué esos.
¿Necesito un programa como ATLAS.ti o NVivo?
No para un corpus pequeño. Una hoja de cálculo con las categorías en filas y los documentos en columnas resuelve un análisis de 15 o 20 documentos. El software ayuda a partir de treinta o cuarenta, sobre todo para recuperar citas por categoría. Usar un programa no vuelve más riguroso el análisis: lo riguroso es el libro de códigos.
¿Qué es la unidad de registro?
Es el fragmento de texto que se clasifica en una categoría y, por tanto, lo que se cuenta. Puede ser la palabra, la frase, el párrafo o el tema completo. Debe definirse antes de codificar y declararse en el capítulo de método, junto con la unidad de contexto, que es el texto circundante que se lee para decidir la clasificación.
¿Las categorías tienen que salir de la teoría o de los datos?
Pueden salir de cualquiera de las dos, y hay que decir de cuál. En el enfoque convencional emergen de los datos; en el dirigido se derivan de una teoría previa; en el sumativo se parte de la aparición de contenidos concretos y se interpreta su uso. Lo importante es nombrar el enfoque y ser consistente con él.
El siguiente paso
Con las unidades definidas y el libro de códigos escrito, el análisis deja de ser una lectura larga y se convierte en un procedimiento con final previsible. Escribe primero las tres líneas de definiciones en el capítulo de método; el resto se ordena solo.
Escribe tu capítulo cualitativo en Tesify y mantén categorías, citas y referencias en un mismo lugar mientras avanzas. Más de 9.000 estudiantes ya escriben así, y el texto sigue siendo cien por ciento tuyo.
