Metodología

Defender una lectura hablando es la prueba más difícil de simular.

La metodología combina tres tradiciones probadas: la práctica de recuperación, el diálogo socrático con repregunta y la evaluación con rúbrica analítica anclada a evidencia. La IA opera dentro de esos límites; no los reemplaza.

Diálogo socrático estructurado

El examinador no pregunta al azar: recorre bloques derivados del material (tesis, mecanismo, evidencia, tensión, transferencia) y repregunta cuando la respuesta se queda en la superficie.

Recuperación oral, no reconocimiento

Hablar obliga a recuperar la información desde la memoria y organizarla en el momento, en lugar de reconocer la opción correcta en una lista.

Evidencia citable por cada puntaje

Cada dimensión se puntúa con una cita literal de la propia defensa. Esto convierte la calificación en algo discutible con datos, no en una opinión del modelo.

Decisión humana al final

La IA propone; el docente revisa, ajusta y libera. Ninguna calificación se publica sin que exista un camino de supervisión humana.

Sustento de la metodología

Cada decisión de diseño responde a evidencia publicada en investigación educativa y a marcos normativos vigentes.

Recuperar activamente lo aprendido mejora la retención más que releer.

Roediger & Karpicke (2006), "Test-Enhanced Learning", Psychological Science: la práctica de recuperación produce retención sustancialmente mayor a mediano plazo que el estudio repetido.

Explicar con las propias palabras profundiza la comprensión.

Chi et al. (1994), "Eliciting Self-Explanations Improves Understanding", Cognitive Science: pedir explicación genera mejor modelo mental que la exposición pasiva.

El tutor dialógico produce mejoras grandes frente a la clase expositiva.

Bloom (1984), "The 2 Sigma Problem", Educational Researcher, y VanLehn (2011), "The Relative Effectiveness of Human Tutoring...", Educational Psychologist: el diálogo con repregunta es el formato con mayor efecto documentado.

La retroalimentación funciona cuando es específica y referida a criterios.

Hattie & Timperley (2007), "The Power of Feedback", Review of Educational Research: la retroalimentación de nivel de tarea y proceso, anclada a criterios, es la de mayor efecto.

Los resultados deben leerse como niveles de complejidad, no como un número suelto.

Biggs & Collis (1982), taxonomía SOLO: distingue respuestas uniestructurales, multiestructurales, relacionales y de abstracción ampliada.

El uso de IA en educación requiere transparencia y supervisión humana.

UNESCO (2024), Marco de competencias de IA para docentes y estudiantes; y Reglamento (UE) 2024/1689 de Inteligencia Artificial, que clasifica la evaluación educativa como uso de alto riesgo sujeto a supervisión humana e información al usuario.

Beneficios para el curso

Integridad académica sin vigilancia invasiva

La defensa oral en vivo es difícil de delegar a un generador de texto: el estudiante debe sostener su lectura bajo repregunta. No se usa cámara, ni bloqueo de pantalla, ni análisis biométrico.

Menos tiempo de corrección

El docente recibe la transcripción completa, un puntaje propuesto por dimensión y la cita que lo sustenta. Su trabajo pasa de corregir desde cero a validar y matizar.

Criterios iguales para todo el curso

La misma rúbrica, el mismo nivel de exigencia y la misma secuencia de bloques para cada estudiante, con el registro completo para auditar cualquier diferencia.

Retroalimentación que el estudiante puede usar

El resultado muestra qué dimensión falló, con qué frase, y qué se esperaba en el nivel siguiente. Es accionable para la próxima lectura.

Apelación resuelta con evidencia

Ante un reclamo, el docente abre la transcripción y la rúbrica aplicada. El debate deja de ser sobre la percepción y pasa a ser sobre lo que efectivamente se dijo.

Inclusión y accesibilidad

Tiempo extendido configurable, transcripción visible en pantalla durante la defensa y posibilidad de regrabar una respuesta antes de enviarla.

Qué se mide

Seis dimensiones de contenido más dos dimensiones orales. Los pesos se ajustan según el nivel de exigencia que elige el docente y siempre son visibles para el estudiante.

DimensiónQué observaPeso sugerido
Recordación factualPrecisión sobre datos, definiciones y hechos del material.15%
Comprensión conceptualExplicación del mecanismo, no solo del resultado.25%
TransferenciaAplicación del concepto a un caso que no aparece en el material.20%
Estructura argumentativaOrden, encadenamiento y sostenimiento de una posición bajo contrapregunta.15%
Uso de evidenciaDensidad y pertinencia de referencias específicas al material.15%
Calibración epistémicaCorrespondencia entre la confianza expresada y el dominio real. Incluye reconocer lo que no se sabe.10%

Lectura del resultado según UNESCO (2024)

Adquisición

Reconoce y reproduce los contenidos centrales del material con apoyo del texto.

Profundización

Explica mecanismos, aplica el concepto a casos nuevos y sostiene su posición con evidencia.

Creación de conocimientos

Integra tensiones, anticipa límites y genera lecturas propias fundamentadas del material.

Límites que declaramos

  • No se infieren emociones, personalidad ni rasgos a partir de la voz.
  • No se emite una calificación final sin posibilidad de revisión del docente.
  • Las señales orales que se usan son objetivas y verificables: ritmo, tiempo hablado, muletillas y reinicios.
  • Los intentos de manipular al examinador quedan marcados y bloquean la liberación automática del resultado.