evidoria

← Retour à la liste

Bonne pratique Importée

L'IA Générative Sans Garde-Fous Peut Nuire à l'Apprentissage — Un ECR dans un Lycée Turc avec des Tuteurs GPT

Turquie · Ankara (exact school undisclosed for participant privacy) · Voir le profil de Turquie

Preuves: Essai contrôlé randomisé Top 82% 33/100 · Demandez à Evidence Copilot à propos de cette pratique

Un essai randomisé auprès de près de 1 000 lycéens turcs montre qu'un accès non restreint à GPT-4 (« GPT Base ») a fait progresser les notes d'entraînement de 48 % mais a réduit de 17 % les résultats à l'examen sans assistance ; un « GPT Tutor » doté de garde-fous pédagogiques a fait progresser l'entraînement de 127 % sans nuire à l'examen.

+48%
Amélioration des notes pendant la pratique assistée, GPT Base (Fall 2023-2024)
+127%
Amélioration des notes pendant la pratique assistée, GPT Tutor (Fall 2023-2024)
-17%
Résultat de l'examen sans assistance, GPT Base vs témoin (Fall 2023-2024)

Détails

Promoteur
Wharton School, University of Pennsylvania (Bastani et al. research team)
Période
Fall semester 2023–2024
Mots-clés
K-12 education, mathematics, generative AI, learning science

Contexte

Dans un grand lycée turc, près de 1 000 élèves de la 9e à la 11e année ont été répartis de manière aléatoire en trois groupes sur quatre séances de 90 minutes durant le semestre d'automne 2023-2024 : un groupe témoin sans IA, « GPT Base » (accès sans restriction de type ChatGPT) et « GPT Tutor » (le même modèle avec des consignes conçues pour préserver l'apprentissage, telles que la non-divulgation des réponses directes et l'incitation au raisonnement).

Résultats

Pendant la pratique assistée, GPT Base a amélioré les notes de 48 % et GPT Tutor de 127 %, par rapport au groupe témoin. Mais lors d'un examen ultérieur sans assistance, les élèves du groupe GPT Base ont obtenu des résultats 17 % inférieurs à ceux du groupe témoin, tandis que les élèves du groupe GPT Tutor, qui n'avaient jamais pu s'appuyer sur des réponses directes, n'ont montré aucun préjudice significatif.

Conclusions

Évaluée par les pairs et publiée dans PNAS en 2025, cette étude figure parmi les premiers essais randomisés à grande échelle à montrer que l'IA générative peut se substituer à l'apprentissage plutôt que le soutenir lorsqu'elle est déployée sans garde-fous pédagogiques — et que de simples garde-fous au niveau des consignes (prompts) peuvent prévenir ce préjudice sans sacrifier les gains de performance immédiats.

Mise en œuvre

Coût indicatif
Faible (< 50 k€) — Classroom-based research trial; no separate implementation budget is published.
Délai jusqu’aux résultats
Court (< 1 an) — Four 90-minute sessions delivered during the Fall 2023-2024 semester.
Personnel et compétences
Wharton School, University of Pennsylvania (Bastani et al. research team)

Conditions de réussite

  • Prompt-level safeguards (withholding direct answers, prompting reasoning) prevent the AI from substituting for learning

Modes d’échec courants

  • Unrestricted chatbot access improved practice performance but harmed unassisted exam scores

Où cela s’applique

Type de gouvernance
university research study
Échelle
~1,000 students, one school
Niveau de revenu
upper-middle income

Vous portez cette pratique ? Revendiquez-la — les porteurs vérifiés obtiennent un contact public sur la page et peuvent proposer des corrections.

Sources de données

D'où proviennent les informations de cette pratique, et quand.

Pratiques similaires qui pourraient vous être utiles