Carlos Isaac
Zainea Maya

Tunjos para la IA
Programa de cursos

Razonamiento, validación e inteligencia artificial en ciencias sociales y humanidades.

Curso 4 · Oficio · ocho sesiones · híbrido

Semana 1. Tres tradiciones de codificación y lo que exigen

Cuando un modelo de lenguaje propone códigos sobre un material cualitativo, ¿según qué tradición los propone, y qué exigiría esa tradición para darlos por buenos?

Pregunta de la semana

Cuando un modelo de lenguaje propone códigos sobre un material cualitativo, ¿según qué tradición los propone, y qué exigiría esa tradición para darlos por buenos?

Por qué esta semana

El curso empieza por una observación incómoda: el output de un modelo al que se le pide "codificar estas entrevistas" tiene la forma de un libro de códigos y no pertenece a ninguna tradición. Mezcla temas al estilo del análisis temático, categorías con el vocabulario de la teoría fundamentada y frecuencias como las del análisis de contenido, sin que ninguna de las tres haya sido elegida. Esa mezcla no es un defecto de calidad: es la ausencia de un método, y sin método no hay criterio para juzgar lo que salió.

Las tres tradiciones que el curso toma como referencia no son escuelas rivales que haya que elegir para siempre. Son tres respuestas distintas a las mismas cuatro preguntas: de dónde salen los códigos, cuándo un código está bien puesto, cuándo se termina y quién responde. El análisis temático de Braun y Clarke, la teoría fundamentada de Glaser, Strauss, Corbin y Charmaz, y el análisis de contenido de Krippendorff responden de manera distinta y, por eso mismo, exigen cosas distintas de quien codifica, sea una persona o un modelo. Esta semana reconstruye las tres respuestas. La semana 2 las ordena en cuatro tipos de enunciado metodológico que servirán de lista de verificación durante el resto del curso.

Contenido de la sesión

  1. Un modelo codifica en segundos lo que un equipo tarda semanas, y el resultado llega con definiciones, ejemplos y una tabla de frecuencias. La sesión abre con ese output sobre un conjunto breve de fragmentos que el grupo conoce, y con una sola pregunta: ¿qué habría que saber para decir si está bien? La respuesta de la sesión es que depende de la tradición, y que el output no declara ninguna.

  2. El análisis temático, en la formulación de Braun y Clarke (2006), es un método en seis fases: familiarización con los datos, generación de códigos iniciales, búsqueda de temas, revisión de temas, definición y nombre de los temas, y escritura del informe. Las autoras insisten en que los temas no "emergen" como si estuvieran esperando en los datos: los construye el analista, y por eso exigen que se declare si el análisis es inductivo o guiado por teoría, semántico o latente, y qué cuenta como tema.a Su lista de quince puntos de control es, de hecho, la primera lista de verificación del curso.

  1. La teoría fundamentada nace con Glaser y Strauss (1967) como un método para generar teoría a partir de los datos mediante comparación constante, muestreo teórico y saturación. Strauss y Corbin (1990) la convirtieron en un procedimiento con fases nombradas: codificación abierta, axial y selectiva, memos, matriz condicional. Glaser (1992) respondió que ese procedimiento fuerza los datos en lugar de dejar que las categorías emerjan. Charmaz (2014) propuso una versión constructivista en la que la codificación es inicial, focalizada y teórica, y en la que el investigador reconoce que las categorías son suyas. Tres versiones, y en las tres la misma estructura: una operación por fase, un criterio para esa operación, una condición para pasar a la siguiente.

  2. El análisis de contenido, en la formulación de Krippendorff (2018), va en la dirección contraria: el libro de códigos se escribe antes de codificar, las categorías deben ser exhaustivas y mutuamente excluyentes, las instrucciones de codificación deben poder ser seguidas por codificadores distintos con el mismo resultado, y la fiabilidad se mide. Lo que en la teoría fundamentada sería forzamiento es aquí la regla.b Krippendorff distingue además tres clases de fiabilidad: estabilidad (el mismo codificador en dos momentos), reproducibilidad (codificadores distintos) y exactitud (contra un estándar). La semana 6 vuelve sobre esa distinción.

  1. Las tres tradiciones difieren en el lugar donde ponen la validez. Para el análisis de contenido, un código está bien puesto si otro codificador lo habría puesto igual siguiendo las instrucciones. Para la teoría fundamentada, si se gana su lugar en los datos por comparación constante y no por venir de un marco previo. Para el análisis temático reflexivo, si el analista puede dar cuenta de por qué lo construyó así y el tema es coherente con los extractos que lo sostienen. Son tres criterios de validez distintos, y los tres exigen algo que el output de un modelo no trae: una regla declarada contra la cual juzgar.

  2. Las tres difieren también en la condición de terminación. El análisis de contenido termina cuando la muestra definida está codificada con fiabilidad suficiente. La teoría fundamentada termina por saturación teórica: cuando los datos nuevos no añaden propiedades a las categorías. El análisis temático termina cuando los temas revisados cuentan una historia coherente del conjunto. Ninguna de las tres termina cuando el modelo deja de producir códigos, que es la única condición de terminación que un modelo tiene por sí solo.

  3. Queda la cuarta pregunta, la de quién responde. En las tres tradiciones la respuesta es la misma y rara vez se escribe: el investigador que firma. Lo que cambia entre tradiciones es cuánto del proceso queda registrado para que esa firma pueda defenderse. El curso sostiene que ese registro es lo que hay que exigir cuando la mitad del proceso la ejecuta un modelo, y que la frontera entre lo que el modelo configuró y lo que el investigador decidió debe ser visible en el registro. Esa es la tesis del programa, leída con la triple mímesis de Ricœur (1995) en Agencia sin imputación (Zainea, 2026): la máquina configura, el investigador refigura, y la frontera se audita.

Análisis temático Teoría fundamentada Análisis de contenido DE DÓNDE SALEN los construye el analista emergen por comparación libro de códigos previo CUÁNDO ESTÁ BIEN coherencia tema-extractos se gana su lugar en datos otro codificador coincide CUÁNDO TERMINA temas cuentan una historia saturación teórica muestra codificada y fiable QUIÉN RESPONDE el analista reflexivo el investigador que compara quien escribió el libro OUTPUT DE UN MODELO no declara no declara no declara Lo que el curso exige: declarar la tradición y, con ella, las cuatro respuestas, antes de pedirle nada al modelo.
Figura 1. Tres tradiciones, cuatro preguntas. Lo que hay que ver: cada tradición responde las cuatro; el output de un modelo, ninguna, y por eso no puede juzgarse hasta que alguien elige por él.

IA y exigencia

Esta semana se le pide al modelo que codifique un conjunto breve de fragmentos tres veces, con tres instrucciones distintas, una por tradición, y que en cada caso diga qué regla siguió. El estudiante debe poder explicar sin el modelo en qué se diferencian las tres salidas, cuál de las tres instrucciones corresponde a su proyecto y qué exigiría esa tradición para dar por bueno un código: no "si suena bien", sino el criterio de la tradición elegida.

Lecturas

Central

  • Braun, V. y Clarke, V. (2006). "Using thematic analysis in psychology". Qualitative Research in Psychology 3(2), 77-101. https://doi.org/10.1191/1478088706qp063oa
  • Charmaz, K. (2014). Constructing Grounded Theory. 2.ª ed. Londres: Sage. Cap. 1, "An invitation to grounded theory".
  • Krippendorff, K. (2018). Content Analysis: An Introduction to Its Methodology. 4.ª ed. Thousand Oaks: Sage. Caps. 1 y 2. Hay traducción de la primera edición: Metodología de análisis de contenido, Paidós, 1990.

Complementaria

  • Braun, V. y Clarke, V. (2019). "Reflecting on reflexive thematic analysis". Qualitative Research in Sport, Exercise and Health 11(4), 589-597. https://doi.org/10.1080/2159676X.2019.1628806
  • Glaser, B. G. y Strauss, A. L. (1967). The Discovery of Grounded Theory: Strategies for Qualitative Research. Chicago: Aldine. Cap. 1.
  • Hsieh, H.-F. y Shannon, S. E. (2005). "Three approaches to qualitative content analysis". Qualitative Health Research 15(9), 1277-1288. https://doi.org/10.1177/1049732305276687
  • Gibbs, G. (2012). El análisis de datos cualitativos en investigación cualitativa. Madrid: Morata. Cap. 1.

Guía de lectura

  • Braun y Clarke dicen que los temas no emergen y que hablar así oculta el papel activo del analista. Si eso es cierto, también lo es para un modelo: sus temas no emergen, los produce un procedimiento que nadie declaró. ¿Qué tendría que declarar un modelo, o quien lo usa, para que su análisis temático fuera evaluable con la lista de quince puntos de las autoras?
  • Charmaz presenta la teoría fundamentada como un conjunto de principios flexibles y, a la vez, como un método con fases que no se pueden saltar. El capítulo insiste en que las categorías son construcciones del investigador que deben rendir cuentas ante los datos. ¿Qué pierde la teoría fundamentada si la comparación constante la hace un modelo que no recuerda qué comparó?
  • Krippendorff define el análisis de contenido como una técnica para hacer inferencias replicables y válidas de textos a sus contextos de uso. Replicable y válido son dos exigencias distintas, y el libro las separa desde el primer capítulo. ¿Cuál de las dos puede satisfacer un modelo que codifica con instrucciones fijas, y cuál no se decide con instrucciones?
  • Las tres lecturas describen una condición de terminación distinta. ¿Cuál es la de su proyecto, y quién la decidiría si la codificación la hiciera un modelo?

Taller de la segunda hora

Cada estudiante trae cinco fragmentos de su corpus, sin datos personales. Le pide a un modelo que los codifique tres veces, con las tres instrucciones de la tabla, y compara.

Instrucción Tradición Qué se le exige al output
"Identifica temas en estos fragmentos. Para cada tema, los extractos que lo sostienen y una definición. Declara si el análisis es semántico o latente." Análisis temático Temas con extractos; declaración del nivel
"Codifica línea por línea. Usa las palabras del hablante cuando sea posible. No uses categorías de la literatura. Para cada código, el fragmento literal." Teoría fundamentada Códigos in vivo; sin vocabulario importado
"Aplica este libro de códigos [se adjunta uno de tres categorías escritas por el estudiante]. Cada fragmento recibe exactamente una categoría. Justifica con la regla del libro." Análisis de contenido Categorías exhaustivas y excluyentes; regla citada

Luego llena, para cada fragmento, la ficha de la semana:

Fragmento Código temático Código abierto Categoría de contenido ¿Cuál se acerca a lo que mi proyecto necesita? ¿Qué exigiría esa tradición para darlo por bueno?

Guion de la sesión

Momento Qué hace el docente Qué hace el estudiante Material
0 a 15 min Muestra un output real de un modelo sobre fragmentos conocidos y pregunta qué haría falta para juzgarlo Anota las primeras respuestas; nota que ninguna cita una regla Output impreso o proyectado
15 a 40 min Expone las tres tradiciones y sus cuatro respuestas (figura 1) Completa la figura con su propio proyecto en una columna aparte Figura 1
40 a 60 min Discute las lecturas con la guía Interviene sobre la pregunta de terminación de su proyecto Guía de lectura
60 a 105 min Taller: tres instrucciones sobre cinco fragmentos Ejecuta, compara, llena la ficha Modelo en versión web, ficha
105 a 120 min Pone en común dos fichas y cierra con la pregunta de la semana 2 Registra su tradición de partida Bitácora

Notas para el docente. Suele fallar que el estudiante trae fragmentos con nombres de personas: revisar antes de la sesión. Suele fallar también que el modelo ignora la instrucción de no usar vocabulario de la literatura y el estudiante no lo nota; conviene señalar un ejemplo en voz alta. Y suele ocurrir que un estudiante concluye que la tradición "correcta" es la de contenido porque es la que da números: recordar que la pregunta de la semana es qué exige cada tradición, no cuál es mejor.

Bitácora

Registre las tres salidas del modelo con sus instrucciones literales, la ficha completa y una decisión: desde qué tradición va a codificar su corpus durante el curso, y por qué. Añada una pregunta que le haya quedado abierta. Esta bitácora es la primera página del registro de frontera.

Para la próxima semana

Leer la sección sobre criterio de validación y su tipología en Zainea (2026), el capítulo 11 de Lincoln y Guba y el capítulo de Denzin sobre triangulación. Traer, por escrito, la regla que siguió el modelo en la instrucción que eligió, tal como el estudiante la reconstruye.