Avaliação 'two-lane' da Universidade de Sydney para a era da IA
Austrália
Em vez de uma corrida armamentista impossível de ganhar contra deteção de IA, Sydney redesenhou a avaliação em duas faixas …
África do Sul · Cape Town · Ver o perfil de África do Sul
Uma equipa liderada pela Universidade da Cidade do Cabo afinou modelos de reconhecimento de voz de código aberto para pontuar automaticamente a fluência de leitura oral no primeiro ciclo em isiXhosa, usando 14.971 gravações de alunos do 1.º ao 4.º ano na África do Sul, atingindo cerca de 91% de eficiência diagnóstica face a dados anotados por humanos.
As Avaliações de Leitura do Início da Escolaridade (EGRA, na sigla em inglês) — testes orais individuais que assinalam quais as crianças que estão a ficar para trás — são o instrumento padrão para medir a literacia em países de rendimento baixo e médio, mas a sua aplicação exige avaliadores humanos treinados e raramente é feita em línguas africanas fora das poucas já suportadas por reconhecimento de voz. Uma equipa de investigação liderada pela Universidade da Cidade do Cabo, com a Universidade de Pretória, a Western Sydney University, a Universidade Federal de Pernambuco e a Macquarie University, propôs-se automatizar a pontuação da EGRA para o isiXhosa, uma das línguas oficiais da África do Sul.
Ao longo de um esforço de recolha de dados de 8 meses, a equipa reuniu 14.971 gravações EGRA (mais de 19 horas de fala infantil) de alunos do 1.º ao 4.º ano em escolas sul-africanas, com apoio de uma bolsa Grand Challenges da Fundação Gates. Três avaliadores humanos independentes validaram primeiro a abordagem de pontuação face a um especialista em EGRA, alcançando 85% de concordância; os modelos de reconhecimento de voz afinados foram depois comparados com esses dados anotados por humanos, atingindo cerca de 91% de eficiência diagnóstica.
A avaliação publicada é invulgarmente franca quanto às limitações: os autores referem que nenhuma configuração de modelo minimizou simultaneamente as taxas de falsos positivos e falsos negativos, o que significa que qualquer implementação inicial trocaria um tipo de classificação incorreta por outro. O trabalho mantém-se uma validação em fase de investigação, e não um sistema de avaliação nacional em funcionamento.
Os detalhes de implementação (custo, prazo, equipa, condições de sucesso) ainda não estão disponíveis para esta prática.
Implementa esta prática? Reivindique-a — implementadores verificados obtêm um contacto público na página e podem propor correções.
De onde foi obtida a informação desta prática, e quando.
Austrália
Em vez de uma corrida armamentista impossível de ganhar contra deteção de IA, Sydney redesenhou a avaliação em duas faixas …
Reino Unido
Ferramenta gratuita de feedback de escrita por IA da Cambridge UP&A (set. 2016); atribui níveis CEFR A1–C2 a textos de …
Hong Kong
Em junho de 2023, o Senado da HKU designou a IA generativa "quinta literacia" e deu a todos acesso gratuito …
Reino Unido
A University of Bedfordshire realizou uma avaliação publicada comparando o seu serviço de escrita Studiosity, com tutores humanos, com uma …
Abrir o copiloto completo Baseado em práticas citadas — verifique sempre as fontes.