Un chatbot de IA como cofacilitador de debates en línea — el ensayo controlado aleatorizado de la Universidad de Kioto con estudiantes afganos bajo la prohibición educativa talibán
Un ensayo de la Universidad de Kioto añadió un chatbot GPT-4 a debates en línea para 80 universitarios afganos (40 mujeres, 40 hombres) sin acceso presencial, elevando los mensajes por estudiante de 5,11 a 8,73 (p<0,01) y la confianza (p=0,037).
80 students (40 women, 40 men)
Participantes
8.73 vs 5.11 posts/student
Publicaciones por estudiante (facilitado por IA vs. control)
p=0.037
Confianza autodeclarada tras la sesion
2.88 vs 0.78 likes/post
'Me gusta' de companeros recibidos (control vs. tratamiento)
3,432 qualified applicants
Grupo de candidatos
d>=0.65
Tamano minimo de efecto detectable
Detalles
Madurez
Piloto
Promotor
Kyoto University Graduate School of Informatics (Hyper-Democracy platform)
Período
February 2024 (published 2025–2026)
Palabras clave
AI in education, online learning, gender equity, conversational AI, conflict-affected education
Contexto
Afganistan es el unico pais que prohibe sistematicamente a las mujeres y ninas el acceso a la educacion secundaria y superior bajo el regimen talibán desde 2021; muchas mujeres afganas dependen hoy del aprendizaje en linea impartido por organizaciones sin animo de lucro como su principal via de acceso a la educacion, pero las clases en linea numerosas suelen tener dificultades para mantener una interaccion significativa.
Objetivos
Investigadores de la Escuela de Posgrado en Informatica de la Universidad de Kioto pusieron a prueba si anadir un chatbot cofacilitador basado en GPT-4 a los debates en linea posteriores a la clase podia aumentar la participacion y la confianza de los estudiantes afganos.
Actividades
Se reclutaron 80 estudiantes universitarios de informatica (40 mujeres, 40 hombres, de entre 18 y 26 anos) de un grupo de 3.432 candidatos cualificados y se asignaron aleatoriamente a grupos de control o de tratamiento. Todos los estudiantes asistieron a una clase identica de 50 minutos por Zoom y, a continuacion, participaron en debates posteriores a la clase de 40 minutos en grupos equilibrados por genero de 10 personas, en la plataforma de codigo abierto basada en Discourse «Hyper-Democracy». En la condicion de tratamiento, los debates fueron ademas cofacilitados por un chatbot basado en GPT-4, alimentado con 17 instrucciones de facilitacion redactadas por personas, junto con el mismo instructor humano utilizado en la condicion de control.
Resultados
Los estudiantes del grupo facilitado por IA publicaron significativamente mas mensajes (media de 8,73 frente a 5,11 por estudiante, p<0,01) y declararon una confianza significativamente mayor en la materia tras la sesion (p=0,037). Las respuestas y el recuento de palabras tambien fueron mayores, pero sin significacion estadistica, y las publicaciones del grupo de control recibieron mas «me gusta» de sus companeros (2,88 frente a 0,78, p<0,001), un patron que los autores atribuyen a un efecto de arrastre que concentra los «me gusta» en un numero menor de publicaciones del grupo de control.
Conclusiones
El ensayo consistio en una intervencion de un solo dia en un unico curso, con potencia estadistica adecuada solo para efectos de gran magnitud (d de Cohen >= 0,65), y los autores piden replicas en cursos mas largos y otras materias antes de generalizar los resultados. El trabajo fue financiado por JSPS KAKENHI y JST CREST, y publicado bajo licencia CC-BY-4.0 con una declaracion publica de acceso a los datos.
Implementación
Coste indicativo
Bajo (< 50 000 €) — Funded by JSPS KAKENHI and JST CREST (Japanese research grants); no cost figure disclosed.
Tiempo hasta resultados
Corto (< 1 año) — Single 50-minute lecture plus 40-minute discussion session, February 2024; published 2025-2026.
Personal y competencias
Kyoto University research team, human instructor (retained in both conditions), GPT-4 chatbot seeded with 17 human-authored facilitation prompts
Condiciones para el éxito
Gender-balanced small discussion groups (10 students, 5 women/5 men)
Human instructor retained alongside the AI co-facilitator rather than replaced
Modos de fallo comunes
Single-session, single-course design is underpowered for medium or small effects
Peer 'like' dynamics (bandwagon effect) complicate interpretation of engagement measures
Dónde encaja
Tipo de gobernanza
university research pilot
Escala
single course, 80 students
Nivel de ingresos
n/a -- conflict-affected/refugee-context students accessing online learning
Habitualmente financiado por
National / regional programmes
Vías de financiación indicativas para prácticas de este tipo: compruebe siempre las convocatorias vigentes y las reglas de elegibilidad de cada programa.
¿Usted implementa esta práctica?
Reivindíquela —
los implementadores verificados obtienen un contacto público en la página y pueden proponer correcciones.
Fuentes de datos
De dónde se obtuvo la información de esta práctica, y cuándo.