evidoria

← Back to browse

Good practice

Sistema Único Antiplágio da Polónia (JSA) — Infraestrutura Nacional de Deteção de Texto Gerado por IA em Teses Universitárias

Poland · Warsaw · See the Poland profile

Desde 2019, a Polónia exige que as universidades verifiquem teses via JSA, sistema gratuito de deteção de plágio usado por 400+ instituições e 100 mil+ utilizadores. Uma atualização de fev. 2024 acrescentou deteção de IA, mas não substitui o julgamento do orientador.

1.5 million
Teses analisadas (2019–2023 (four years))
320,000+
Teses sinalizadas por potencial plágio (2019–2023 (four years))
400+
Instituições que utilizam o JSA
100,000+
Utilizadores registados
10 billion+
Microdocumentos no corpus de comparação
3 million+
Trabalhos no Repositório Nacional de Teses de Diploma
~900 million
Documentos web polacos na base de dados NEKST
11 PLN million
Financiamento para a construção do JSA (2017–2019)
~1 in 5
Estudantes que planeavam usar ferramentas de IA ao escrever a tese
68 %
Estudantes que pretendiam usar ferramentas do tipo ChatGPT ao longo dos estudos

Details

Maturity
Established
Promoter
National Information Processing Institute (OPI-PIB) / Polish Ministry of Science and Higher Education
Period
2017–ongoing (mandatory nationwide since Jan 2019; AI-detection module added Feb 2024)
Keywords
plagiarism detection, AI-text detection, higher education policy, academic integrity, national infrastructure

Context

A Lei do Ensino Superior da Polónia exige, desde janeiro de 2019, que todas as universidades e escolas doutorais verifiquem as teses através de um único sistema nacional. O JSA foi construído entre 2017 e 2019 pelo Instituto Nacional de Processamento de Informação (OPI-PIB), sob a direção do Dr. Marek Kozłowski, com um financiamento de 11 milhões de zlótis provenientes de um programa operacional apoiado pela UE.

Objectives

Disponibilizar uma infraestrutura gratuita e de âmbito nacional para deteção de plágio, cobrindo todas as teses submetidas nas universidades polacas, e, a partir de fevereiro de 2024, acrescentar a deteção de texto gerado por IA, em resposta ao crescente uso de ferramentas de IA por parte dos estudantes.

Activities

O JSA compara os textos submetidos com um corpus de mais de 10 mil milhões de "microdocumentos", provenientes do Repositório Nacional de Teses de Diploma (mais de 3 milhões de trabalhos), da base de dados NEKST com cerca de 900 milhões de documentos web polacos, de seis edições linguísticas da Wikipédia, de bases de dados de atos legais e de revistas de acesso aberto, decompondo os textos em coleções desordenadas de palavras para resistir a paráfrases simples. Em fevereiro de 2024, o OPI acrescentou um módulo para sinalizar texto gerado por IA, motivado em parte por um inquérito da Digital Care que revelou que cerca de um em cada cinco estudantes planeava usar ferramentas de IA ao escrever a tese.

Results

Em quatro anos de funcionamento, o JSA analisou cerca de 1,5 milhões de teses em mais de 400 instituições e mais de 100.000 utilizadores registados, sinalizando mais de 320.000 como contendo potencial plágio — um salto acentuado na cobertura face aos cerca de 30–40% das teses que recebiam algum tipo de verificação de plágio antes de o JSA se tornar obrigatório.

Conclusions

O ponto forte documentado do JSA é administrativo e institucional — cobertura nacional, escala e mandato legal — e não um efeito pedagógico ou de resultados de aprendizagem medido. As autoridades são francas quanto às limitações do módulo de deteção de IA: o diretor-adjunto Marek Michajłowicz observou que é pouco provável que o texto gerado por IA possa ser reconhecido de forma fiável, pelo que o sistema apoia, mas não substitui, o julgamento do orientador. Não foi publicada qualquer validação independente e revista por pares da taxa de falsos positivos ou falsos negativos do módulo de deteção de IA.

Implementation

Indicative cost
Medium (€50k–€500k) — PLN 11 million (EU-backed Knowledge Education Development Operational Programme) for the 2017–2019 build; ongoing operating/maintenance costs and AI-detection module development not separately disclosed.
Time to results
Long (> 3 years) — Built 2017–2019, mandatory nationwide from January 2019, AI-text detection module added February 2024; ongoing.
Staffing & skills
National Information Processing Institute (OPI-PIB) technical team led by Dr Marek Kozłowski, University thesis supervisors and administrators using the system

Conditions for success

  • Legal mandate (Higher Education Law) requiring universal use
  • Centralised national corpus (theses repository, web database, Wikipedia, legal acts, journals) for comparison
  • Sustained public funding for corpus maintenance and updates (e.g., AI-detection module)

Common failure modes

  • AI-generated text is not reliably detectable by the module or the human eye, per OPI's own deputy director
  • No independent validation of false-positive/false-negative rates published

Where it fits

Governance type
national government / public research institute
Scale
national
Income level
high-income

Data sources

Where this practice's information was retrieved from, and when.

Similar practices you may find useful