Estudio que compara la corrección de ensayos reflexivos hecha por tutores expertos con la de ChatGPT. Se analizaron 108 reflexiones anonimizadas de estudiantes de ingeniería, ya calificadas por 39 tutores formados con una rúbrica común (profundidad, análisis, lógica y claridad, y feedback); ChatGPT recibió las mismas instrucciones y rúbricas y puntuó los textos de forma independiente.
Resultados: el acuerdo entre ambos evaluadores fue moderado (ICC = 0,728), con diferencias significativas en las puntuaciones medias. ChatGPT se ciñó de forma más estricta a los criterios, mientras que los tutores mostraron más flexibilidad contextual. El autor concluye que ChatGPT puede servir para calificar ensayos con las instrucciones adecuadas, aunque sigue siendo aconsejable la moderación humana.
- Inicie sesión para enviar comentarios