Un essai randomisé auprès de près de 1 000 lycéens turcs montre qu'un accès non restreint à GPT-4 (« GPT Base ») a fait progresser les notes d'entraînement de 48 % mais a réduit de 17 % les résultats à l'examen sans assistance ; un « GPT Tutor » doté de garde-fous pédagogiques a fait progresser l'entraînement de 127 % sans nuire à l'examen.
+48%
Amélioration des notes pendant la pratique assistée, GPT Base (Fall 2023-2024)
+127%
Amélioration des notes pendant la pratique assistée, GPT Tutor (Fall 2023-2024)
-17%
Résultat de l'examen sans assistance, GPT Base vs témoin (Fall 2023-2024)
Détails
Promoteur
Wharton School, University of Pennsylvania (Bastani et al. research team)
Dans un grand lycée turc, près de 1 000 élèves de la 9e à la 11e année ont été répartis de manière aléatoire en trois groupes sur quatre séances de 90 minutes durant le semestre d'automne 2023-2024 : un groupe témoin sans IA, « GPT Base » (accès sans restriction de type ChatGPT) et « GPT Tutor » (le même modèle avec des consignes conçues pour préserver l'apprentissage, telles que la non-divulgation des réponses directes et l'incitation au raisonnement).
Résultats
Pendant la pratique assistée, GPT Base a amélioré les notes de 48 % et GPT Tutor de 127 %, par rapport au groupe témoin. Mais lors d'un examen ultérieur sans assistance, les élèves du groupe GPT Base ont obtenu des résultats 17 % inférieurs à ceux du groupe témoin, tandis que les élèves du groupe GPT Tutor, qui n'avaient jamais pu s'appuyer sur des réponses directes, n'ont montré aucun préjudice significatif.
Conclusions
Évaluée par les pairs et publiée dans PNAS en 2025, cette étude figure parmi les premiers essais randomisés à grande échelle à montrer que l'IA générative peut se substituer à l'apprentissage plutôt que le soutenir lorsqu'elle est déployée sans garde-fous pédagogiques — et que de simples garde-fous au niveau des consignes (prompts) peuvent prévenir ce préjudice sans sacrifier les gains de performance immédiats.
Mise en œuvre
Coût indicatif
Faible (< 50 k€) — Classroom-based research trial; no separate implementation budget is published.
Délai jusqu’aux résultats
Court (< 1 an) — Four 90-minute sessions delivered during the Fall 2023-2024 semester.
Personnel et compétences
Wharton School, University of Pennsylvania (Bastani et al. research team)
Conditions de réussite
Prompt-level safeguards (withholding direct answers, prompting reasoning) prevent the AI from substituting for learning
Modes d’échec courants
Unrestricted chatbot access improved practice performance but harmed unassisted exam scores
Où cela s’applique
Type de gouvernance
university research study
Échelle
~1,000 students, one school
Niveau de revenu
upper-middle income
Vous portez cette pratique ?
Revendiquez-la —
les porteurs vérifiés obtiennent un contact public sur la page et peuvent proposer des corrections.
Sources de données
D'où proviennent les informations de cette pratique, et quand.