Pregunta de la semana
Cuando una categoría aparece en el análisis, ¿cómo se sabe si salió del corpus o si la trajo quien codifica, y qué cambia cuando quien codifica es un modelo entrenado sobre la literatura?
Por qué esta semana
Es la semana central. La codificación abierta deja una lista de códigos; el paso siguiente es agruparlos en categorías con propiedades y dimensiones, y ese paso es donde la teoría fundamentada se dividió. Glaser (1992) acusó a Strauss y Corbin de forzar los datos con un esquema previo; Strauss y Corbin respondieron que sin instrumentos analíticos el investigador no ve nada. El curso toma esa disputa como el criterio de validez que más falla en los modelos: un modelo de lenguaje tiene en su entrenamiento las categorías de toda la literatura en ciencias sociales, y cuando se le pide agrupar códigos las trae de ahí con una naturalidad que no deja rastro. Esta semana enseña a notarlo, a escribir memos que lo registren, y a entregar el primer producto.
La herramienta de la semana es el memo analítico, que en la teoría fundamentada es el lugar donde el investigador piensa por escrito sobre sus códigos y deja constancia de por qué una categoría se llama como se llama. Para el curso el memo tiene una función adicional: es el documento donde se escribe de dónde vino cada categoría y qué habría que encontrar en el corpus para que se la gane.
Contenido de la sesión
-
Una categoría es un concepto que agrupa códigos y que tiene propiedades, los atributos que la caracterizan, y dimensiones, los rangos en que varían esas propiedades. Strauss y Corbin (2002) lo ilustran con el color: tiene las propiedades de tono, intensidad y matiz, y cada una varía en un rango. En un corpus sobre un mercado de barrio, "confianza con el vendedor" puede tener la propiedad de duración (de una compra a años), de dirección (del comprador al vendedor, del vendedor al comprador, mutua) y de prueba (qué hace el vendedor que la sostiene). Un código se convierte en categoría cuando se le pueden especificar propiedades y ubicar los fragmentos en sus dimensiones. Sin eso es un rótulo.
-
El memo es la escritura analítica que acompaña la codificación desde el primer día. Charmaz (2014) lo describe como el paso intermedio entre la recolección y la redacción: conversación del investigador consigo mismo sobre lo que ve. Strauss y Corbin (2002) distinguen memos de código, memos teóricos y memos operativos. Para el curso, cada memo tiene además una sección fija: la procedencia de la categoría. Si el nombre lo propuso el modelo, el memo lo dice y busca en el corpus los fragmentos que lo sostendrían. Si no los encuentra, la categoría queda en observación, no en el libro.a
- La disputa de 1992 tiene un contenido preciso. Strauss y Corbin (1990) habían propuesto el paradigma de codificación, un esquema de condiciones, acciones e interacciones y consecuencias que se aplica a toda categoría para relacionarla con otras. Glaser (1992) respondió en Emergence vs Forcing que ese esquema fuerza los datos: obliga a ver en cualquier material una estructura de condiciones y consecuencias aunque el material no la tenga, y sustituye la emergencia por comparación constante con la aplicación de un molde. Para Glaser, la única pregunta legítima es qué está pasando aquí; todo lo demás debe ganarse su lugar. Kelle (2005) muestra que la disputa esconde un problema real que ninguno de los dos resuelve: no hay observación sin conceptos previos, de modo que la cuestión no es si se usan categorías de fuera, sino cuáles, cuándo se declaran y cómo se controlan contra los datos.b
-
El curso toma partido en un punto distinto del de la disputa: no en si forzar es malo, sino en quién fuerza y si se nota. Cuando el investigador trae una categoría de su marco teórico, lo sabe, puede declararlo y puede ponerla a prueba. Cuando el modelo la trae, no hay sujeto que lo sepa. La prefiguración del modelo es su corpus de entrenamiento, que incluye miles de artículos en los que "resiliencia", "capital social", "empoderamiento" o "barreras de acceso" organizan materiales parecidos al del estudiante. El modelo produce esas categorías porque son las más probables dado el género, no porque el corpus del estudiante las sostenga. Es lo que Agencia sin imputación llama infortunio de prefiguración: el acto se ejecuta sobre condiciones de fondo ajenas al material que interpreta. El trabajo de Şahinol et al. (2026), que usa la distinción de Glaser como criterio de validez del output de modelos, encuentra que estos tienden al forzamiento de manera sistemática.
-
El forzamiento del modelo se nota con tres señales, que la mini app de la semana entrena. Primera: el código usa vocabulario de la literatura que no aparece en el fragmento ni en ninguna paráfrasis cercana. Segunda: el código cabría en casi cualquier fragmento del corpus, y aun en fragmentos de otro corpus; un código que no discrimina no ha salido de los datos. Tercera: el código responde a la pregunta de investigación, o a la instrucción que se le dio al modelo, en lugar de responder al fragmento; cuando la instrucción dice "sobre exclusión" y el modelo devuelve "exclusión política", el nombre viene de la instrucción. A las tres se añade una prueba de registro, que el modelo mismo puede ejecutar: pedirle, para cada categoría, los fragmentos literales que la sostienen y el término del fragmento del que sale el nombre. Si la respuesta es una paráfrasis, la categoría vino de fuera.
-
Lo anterior no implica que toda categoría de la literatura sea ilegítima. En un análisis de contenido dirigido, el libro de códigos viene de una teoría y la regla de generación es aplicarlo; ahí "barreras de acceso" no es forzamiento sino cumplimiento. En un análisis temático guiado por teoría, lo mismo. El forzamiento es un defecto relativo a la fase y a la tradición declarada en la semana 1: es forzamiento en codificación abierta, y es regla en codificación dirigida. Lo que el curso exige es que la tradición esté declarada y que la procedencia de cada categoría conste. Con eso, la misma categoría puede ser válida en un proyecto e inválida en otro, y en ambos casos alguien responde.
-
El primer producto se entrega hoy: el libro de códigos abierto con registro de frontera. Para cada código, su definición, sus fragmentos de anclaje, su origen, la decisión y el criterio. Para cada categoría que ya se perfile, un memo con su procedencia y, si vino del modelo, la prueba de anclaje. Se evalúa la precisión del registro, no la elegancia del libro. Un libro con doce códigos in vivo bien anclados y tres categorías en observación vale más que uno con treinta categorías de la literatura que nadie puso a prueba.
IA y exigencia
Esta semana se le pide al modelo que agrupe los códigos abiertos en categorías candidatas, que proponga propiedades y dimensiones para cada una, y que ejecute la prueba de anclaje sobre sus propias categorías: para cada nombre, el término del corpus del que sale. El estudiante debe poder, sin el modelo, señalar al menos una categoría forzada en la propuesta y explicar con cuál de las tres señales la detectó, y debe poder defender la procedencia de cada categoría de su libro de códigos abierto con un memo.
Lecturas
Central
- Glaser, B. G. (1992). Basics of Grounded Theory Analysis: Emergence vs Forcing. Mill Valley: Sociology Press. Caps. 1 a 3.
- Kelle, U. (2005). "'Emergence' vs. 'Forcing' of Empirical Data? A Crucial Problem of 'Grounded Theory' Reconsidered". Forum Qualitative Sozialforschung 6(2), art. 27. https://www.qualitative-research.net/index.php/fqs/article/view/467
- Strauss, A. y Corbin, J. (2002). Bases de la investigación cualitativa. Medellín: Universidad de Antioquia. Cap. 14, sobre memos y diagramas.
Complementaria
- Charmaz, K. (2014). Constructing Grounded Theory. 2.ª ed. Londres: Sage. Cap. 7, "Memo-writing".
- Glaser, B. G. (1978). Theoretical Sensitivity. Mill Valley: Sociology Press. Cap. 5, sobre memos.
- Timmermans, S. y Tavory, I. (2012). "Theory Construction in Qualitative Research: From Grounded Theory to Abductive Analysis". Sociological Theory 30(3), 167-186. https://doi.org/10.1177/0735275112457914
- Şahinol, M. et al. (2026). Machine-mediated theorizing. Preprint, Research Square. https://doi.org/10.21203/rs.3.rs-10526750/v1
- Zainea, C. I. (2026). "Agencia sin imputación: por qué «la máquina no comprende» no cierra la discusión". https://izainea.github.io/blog/agencia-sin-imputacion/
Guía de lectura
- Glaser escribe contra un libro concreto y con irritación visible. Debajo de la polémica hay una tesis metodológica: el paradigma de codificación obliga a ver una estructura que puede no estar. ¿Qué pasaría si la instrucción que usted le da al modelo incluyera el paradigma de Strauss y Corbin? ¿Vería el modelo condiciones y consecuencias en todos sus fragmentos?
- Kelle sostiene que la emergencia pura es imposible y que lo que importa es qué conceptos previos se usan y cómo se controlan. Aplicado al modelo: sus conceptos previos son su entrenamiento. ¿Cómo se declaran, si nadie los conoce, y cómo se controlan?
- En el capítulo sobre memos, fíjese en la recomendación de fechar cada memo y de no corregir los anteriores sino escribir otros. ¿Qué función cumple esa regla cuando parte del análisis la hace un sistema que no recuerda sus memos?
- Timmermans y Tavory sostienen que la teoría fundamentada es abductiva, y que la sorpresa exige trasfondo teórico. Si eso es cierto, ¿puede sorprenderse un modelo? ¿Y qué le ocurre a una categoría propuesta por quien no se sorprende?
Taller de la segunda hora
Revisión del libro de códigos abierto antes de entregarlo. En parejas, cada estudiante revisa el libro del otro con la lista de la semana.
| Categoría o código | Señal 1: vocabulario de la literatura ausente del fragmento | Señal 2: cabría en cualquier fragmento | Señal 3: responde a la instrucción, no al fragmento | Prueba de anclaje (término del corpus) | Veredicto del par | Decisión del autor |
|---|---|---|---|---|---|---|
Luego cada estudiante escribe, para la categoría más dudosa, un memo con la plantilla plantillas/memo-analitico.md, con la sección de procedencia completa. El memo se entrega con el libro.
Guion de la sesión
| Momento | Qué hace el docente | Qué hace el estudiante | Material |
|---|---|---|---|
| 0 a 15 min | Muestra una propuesta de categorías de un modelo sobre fragmentos conocidos y pide al grupo que señale las que vienen de fuera | Aplica las tres señales en voz alta | Output proyectado |
| 15 a 40 min | Expone propiedades y dimensiones, memos, y la disputa Glaser frente a Strauss y Corbin con Kelle (figura 4) | Identifica una propiedad y dos dimensiones de una categoría propia | Figura 4 |
| 40 a 55 min | Mini app emergencia o forzamiento, en grupo, con discusión de los pares 6 y 10 | Decide y discute el matiz de la tradición | Mini app |
| 55 a 105 min | Taller de revisión por pares y memo | Revisa el libro del par, escribe el memo | Lista de señales, plantilla de memo |
| 105 a 120 min | Recibe el producto 1 y explica la codificación axial de la semana 5 | Entrega | Plantilla del libro de códigos |
Notas para el docente. Suele fallar que el estudiante confunde el forzamiento con cualquier abstracción, y rechaza códigos abstractos bien anclados; la prueba es el anclaje, no el nivel. Suele fallar que, al ejecutar la prueba de anclaje, el modelo inventa un término que no está en el fragmento; hay que verificar la cita contra el corpus, y conviene mostrarlo con un caso. Y conviene no dejar que la sesión se vuelva una disputa sobre quién tenía razón en 1992: el curso usa la distinción, no la polémica.
Entrega
Libro de códigos abierto con registro de frontera, con la plantilla plantillas/libro-de-codigos.md en su versión preliminar, el registro por código y al menos un memo de procedencia. Rúbrica en evaluacion.md. Se evalúa que cada código tenga origen, anclaje, decisión y criterio, y que las categorías del modelo hayan pasado por la prueba de anclaje.
Para la próxima semana
Leer Strauss y Corbin (2002), capítulos 9 y 12, y Gibbs (2012), capítulos 4, 8 y 9. Elegir la categoría de su libro con más fragmentos y traer sus memos. La semana 5 relaciona categorías y compara consultas al corpus hechas con un programa y hechas con un modelo.