evidoria

← Back to browse

Good practice

Système Unique Anti-Plagiat de Pologne (JSA) — Infrastructure Nationale de Détection de Texte Généré par l'IA pour les Thèses Universitaires

Poland · Warsaw · See the Poland profile

Depuis 2019, la Pologne impose la vérification des thèses via le JSA, système gratuit anti-plagiat utilisé par 400+ établissements et 100 000+ utilisateurs. Une mise à jour de fév. 2024 a ajouté la détection d'IA, sans remplacer le jugement du directeur de thèse.

1.5 million
Mémoires et thèses examinés (2019–2023 (four years))
320,000+
Mémoires signalés pour plagiat potentiel (2019–2023 (four years))
400+
Établissements utilisant le JSA
100,000+
Utilisateurs enregistrés
10 billion+
Microdocuments dans le corpus de comparaison
3 million+
Travaux dans le Répertoire national des mémoires et thèses
~900 million
Documents web polonais dans la base NEKST
11 PLN million
Financement pour la construction du JSA (2017–2019)
~1 in 5
Étudiants prévoyant d'utiliser des outils d'IA pour rédiger leur mémoire
68 %
Étudiants prévoyant d'utiliser des outils de type ChatGPT durant leurs études

Details

Maturity
Established
Promoter
National Information Processing Institute (OPI-PIB) / Polish Ministry of Science and Higher Education
Period
2017–ongoing (mandatory nationwide since Jan 2019; AI-detection module added Feb 2024)
Keywords
plagiarism detection, AI-text detection, higher education policy, academic integrity, national infrastructure

Context

La loi polonaise sur l'enseignement supérieur impose, depuis janvier 2019, que chaque université et école doctorale fasse vérifier les mémoires et thèses via un système national unique. Le JSA a été développé entre 2017 et 2019 par l'Institut national de traitement de l'information (OPI-PIB), sous la direction du Dr Marek Kozłowski, avec un financement de 11 millions de zlotys issu d'un programme opérationnel soutenu par l'UE.

Objectives

Fournir une infrastructure gratuite et obligatoire à l'échelle nationale pour la détection du plagiat, couvrant chaque mémoire soumis dans les universités polonaises, et, à partir de février 2024, y ajouter la détection de texte généré par IA, en réponse à l'usage croissant d'outils d'IA par les étudiants.

Activities

Le JSA compare les textes soumis à un corpus de plus de 10 milliards de « microdocuments », issus du Répertoire national des mémoires et thèses (plus de 3 millions de travaux), de la base NEKST comptant environ 900 millions de documents web polonais, de six éditions linguistiques de Wikipédia, de bases de données d'actes juridiques et de revues en libre accès, en décomposant les textes en ensembles de mots désordonnés pour résister au simple paraphrasage. En février 2024, l'OPI a ajouté un module de détection de texte généré par IA, motivé en partie par une enquête de Digital Care révélant qu'environ un étudiant sur cinq prévoyait d'utiliser des outils d'IA pour rédiger son mémoire.

Results

En quatre ans de fonctionnement, le JSA a examiné environ 1,5 million de mémoires et thèses dans plus de 400 établissements et auprès de plus de 100 000 utilisateurs enregistrés, signalant plus de 320 000 cas de plagiat potentiel — une nette progression par rapport aux quelque 30 à 40 % de mémoires ayant fait l'objet d'un contrôle antiplagiat avant que le JSA ne devienne obligatoire.

Conclusions

Le point fort documenté du JSA est administratif et institutionnel — couverture nationale, échelle et mandat légal — plutôt qu'un effet pédagogique ou d'apprentissage mesuré. Les autorités sont franches sur les limites du module de détection d'IA : le directeur adjoint Marek Michajłowicz a souligné qu'il est peu probable qu'un texte généré par IA puisse être reconnu de manière fiable, de sorte que le système appuie plutôt qu'il ne remplace le jugement du directeur de mémoire. Aucune validation indépendante et évaluée par des pairs du taux de faux positifs ou de faux négatifs du module de détection d'IA n'a été publiée.

Implementation

Indicative cost
Medium (€50k–€500k) — PLN 11 million (EU-backed Knowledge Education Development Operational Programme) for the 2017–2019 build; ongoing operating/maintenance costs and AI-detection module development not separately disclosed.
Time to results
Long (> 3 years) — Built 2017–2019, mandatory nationwide from January 2019, AI-text detection module added February 2024; ongoing.
Staffing & skills
National Information Processing Institute (OPI-PIB) technical team led by Dr Marek Kozłowski, University thesis supervisors and administrators using the system

Conditions for success

  • Legal mandate (Higher Education Law) requiring universal use
  • Centralised national corpus (theses repository, web database, Wikipedia, legal acts, journals) for comparison
  • Sustained public funding for corpus maintenance and updates (e.g., AI-detection module)

Common failure modes

  • AI-generated text is not reliably detectable by the module or the human eye, per OPI's own deputy director
  • No independent validation of false-positive/false-negative rates published

Where it fits

Governance type
national government / public research institute
Scale
national
Income level
high-income

Data sources

Where this practice's information was retrieved from, and when.

Similar practices you may find useful