Carlos Isaac
Zainea Maya

Tunjos para la IA
Programa de cursos

Razonamiento, validación e inteligencia artificial en ciencias sociales y humanidades.

Curso 3 · Oficio · ocho sesiones · híbrido

Evaluación

Rúbricas de los productos y la bitácora.

El curso se evalúa por productos, no por exámenes. Los tres productos y la bitácora son evidencias verificables de las cuatro competencias. Cada uno tiene una rúbrica de cuatro niveles. La nota final es la suma ponderada.

Producto Peso Competencias
Ficha semiótica y registro de frontera visual, con protocolo de exhibición y presentación 40 % 2, 4
Descripciones por capas con auditoría de una muestra 25 % 2, 3
Catálogo visual con procedencia 20 % 1
Bitácora semanal 15 % 1 a 4

Ficha semiótica y registro de frontera visual (40 %)

Incluye la ficha de al menos tres imágenes representativas, el registro de frontera visual consolidado, el protocolo de exhibición del corpus y la presentación ante pares.

Criterio Insuficiente Básico Logrado Sobresaliente
Ficha: capas y modos Celdas vacías o mezcladas Capas llenas, modos sin distinguir Cada celda cruza una capa de Banks con un modo de Peirce y se sostiene con la imagen Además discute una celda en que dos modos son defendibles y dice cuál eligió y por qué
Ficha: autor por afirmación No se distingue qué escribió el modelo Se distingue en bloque, no por afirmación Cada afirmación lleva su autor: cartela, modelo o investigador Además señala afirmaciones del modelo que aceptó y explica por qué puede responder por ellas
Selección de imágenes Tres imágenes típicas sin razón Tres imágenes con razón genérica Una que el modelo describió bien, una que no vio, una que no cupo, con razón Además muestra qué cambia en el corpus si se cambia una de las tres
Registro de frontera visual Confunde lo descrito con lo decidido Distingue en la mayoría de decisiones Distingue en todas las decisiones de descripción, categoría y exhibición, con criterio Además detecta una decisión difícil de atribuir y la discute
Protocolo de exhibición Una política para todo el corpus sin razón Decisiones por grupo sin razón o con razón genérica Decisión por grupo homogéneo entre las cinco opciones, con derechos, pérdida declarada y razón Además muestra un grupo en que dudó entre dos opciones contiguas y qué lo decidió
Presentación No responde la pregunta obligatoria Responde con generalidades Responde con un caso concreto del registro Responde y reformula la pregunta de un par sobre su propio corpus

Descripciones por capas con auditoría de una muestra (25 %)

Criterio Insuficiente Básico Logrado Sobresaliente
Prompt por capas Prompt plano o capas mezcladas Capas presentes pero el modelo las mezcla sin que se note Cuatro capas en orden, adaptadas al corpus, con la salida en celdas separadas Además compara dos versiones del prompt y dice qué cambió en la auditabilidad
Metadatos de la descripción Sin modelo, fecha ni prompt Metadatos incompletos Modelo, versión, fecha, prompt literal y costo por imagen Además declara el costo extrapolado al corpus y la decisión que tomó por eso
Diseño de la muestra Muestra sin criterio Muestra por conveniencia declarada Muestra estratificada por escena o periodo, con tamaño y criterio escritos Además incluye a propósito las imágenes más locales y lo dice
Las tres columnas Columnas confundidas o solo una usada Columnas usadas pero la tercera es un cajón de "no sé" Cada afirmación en su columna; la tercera nombra qué contexto haría falta Además distingue, dentro de la tercera, lo que el investigador sabe de lo que tendría que preguntar a la comunidad
Resumen del sesgo Ausente Genérico, sin ejemplos Un párrafo con un ejemplo por columna y cifras sobre la muestra declaradas como tales Además relaciona el sesgo con la literatura (Pouget et al., Schneider et al.) sobre su corpus
Preclasificación Grupos presentados como categorías Grupos con códigos sin muestra mirada Grupos con código provisional, muestra mirada y razón para cada categoría propuesta Además la lista de lo que no cupo con por qué sorprende

Catálogo visual con procedencia (20 %)

Criterio Insuficiente Básico Logrado Sobresaliente
Esquema Faltan campos de procedencia Diez campos presentes, muchos vacíos Diez campos llenos en al menos 40 imágenes; descripción heredada con su origen Además campos adicionales justificados por el proyecto
Recolección Sin registro de cómo se obtuvo Registro parcial Lista de páginas fuente previa, procedimiento repetible, respeto a robots.txt declarado Además registra lo que no se pudo descargar y por qué
Deduplicación No se hizo o se borraron archivos Por nombre de archivo o a ojo Por hash perceptual con umbral declarado; grupos con distancia y ejemplar canónico Además discute un par en el límite del umbral y qué decidió
Validación Cifra sin validar Validación en una dirección Confrontación disco y catálogo en ambas direcciones, con discrepancias anotadas Además la cifra se da con su historia: cuántas se bajaron, cuántas se agruparon, cuántas quedaron
Derechos y escena Columnas ausentes Llenas con "desconocido" sin consulta Llenas con lo que se sabe y lo que no, tras consultar la página fuente Además marca las imágenes sensibles desde el catálogo

Bitácora semanal (15 %)

Criterio Insuficiente Básico Logrado Sobresaliente
Continuidad Menos de cinco semanas Cinco o seis semanas Siete u ocho semanas Ocho semanas con referencias cruzadas entre ellas
Registro del ejercicio Incompleto Completo Completo con una pregunta abierta por semana Completo, con preguntas abiertas y retomadas después
Honestidad Solo aciertos Menciona dudas Registra las imágenes que no supo describir y las afirmaciones que aceptó sin criterio Registra además cambios de opinión fechados sobre una imagen o una categoría
Uso declarado del modelo No declara Declara en bloque Declara por semana qué pidió, con qué prompt y qué tomó Además anota qué sesgo del modelo detectó esa semana

Política de integridad

El uso de modelos multimodales es obligatorio desde la semana 4 y declarado siempre. Lo que se sanciona no es usarlos sino presentar como observación propia lo que no se puede sostener: eso es lo que Validación del razonamiento con IA en ciencias sociales llama un infortunio de autoridad epistémica, un output que presenta una afirmación con la autoridad de quien procesó evidencia y llegó a una conclusión, autoridad que el modelo no puede respaldar, y es la lección del curso. Una entrega con uso no declarado se devuelve para que el estudiante escriba el registro de frontera visual que faltaba. Una entrega que exhibe material sensible sin fila en el protocolo se devuelve para que la decisión se tome y se escriba. El envío de imágenes con personas identificables a un modelo antes de la semana 7 se trata igual.

Certificación

Aprueba quien obtiene al menos el nivel Logrado en la ficha semiótica con registro de frontera y en las descripciones con auditoría, y un promedio ponderado de 3,5 sobre 5,0. La microcredencial certifica las cuatro competencias del syllabus.