iFLYTEK — Avaliação de Inglês Oral por IA nos Exames Escolares da China
China
A IA de reconhecimento de voz da iFLYTEK avalia o inglês oral nos exames de zhongkao e gaokao da China, …
Filipinas · San Fernando (Pampanga) · Ver o perfil de Filipinas
Evidência: Quase-experimental Top 73% 40/100 · Pergunte a Evidence Copilot sobre esta prática
O piloto de 2022 da RTI (USAID/DepEd) testou pontuação por voz com IA da fluência de leitura oral em 42 escolas filipinas. A IA subestimou as palavras por minuto em 21,8 (inglês) e 25,1 (filipino) vs. avaliadores humanos, e o DepEd cancelou a expansão.
O CoBRA (Computer-Based Reading Assessment) foi uma ferramenta-piloto do programa All Children Reading da USAID nas Filipinas, combinando um plugin de gravação de voz, o Speech Recognition Engine da Google para filipino e um algoritmo de pontuação baseado em aprendizagem automática para calcular as palavras corretas por minuto e a precisão de leitura a partir das gravações da leitura oral dos alunos, tendo como referência o padrão Phil-IRI. A RTI International desenvolveu-a entre fevereiro e abril de 2022 e testou-a em regime piloto com o DepEd entre junho e julho de 2022, em 42 escolas.
Testar se a pontuação por reconhecimento de voz baseado em IA poderia substituir a avaliação humana da fluência de leitura oral em inglês e filipino, à escala nacional.
O projeto-piloto testou 1063 alunos em inglês e 933 em filipino, do 4.º ao 6.º ano, e formou ou orientou 145 professores e 67 coordenadores de TIC. O relatório final da RTI (apresentado em novembro de 2022) realizou uma análise de validade concorrente, reavaliando de forma independente e manual uma subamostra de 346 avaliações em inglês e 345 em filipino, comparando-as com as pontuações da IA.
A IA subestimou as palavras corretas por minuto em, em média, 21,8 em inglês e 25,1 em filipino, relativamente aos reavaliadores humanos, e assinalou incorretamente ou saltou 21% do texto em inglês e 60% do texto em filipino que os alunos realmente leram. A variância das pontuações por ano de escolaridade entre a IA e a avaliação humana variou entre 31-48% em inglês e 37-64% em filipino, agravando-se à medida que os textos se tornavam mais complexos. Mais de 90% dos 81 professores inquiridos consideraram a ferramenta fácil de utilizar e sentiram que a pontuação era 'geralmente exata' -- uma perceção que os dados quantitativos de validade não confirmaram.
O projeto-piloto de segunda fase, de maior dimensão, previsto pelo DepEd foi cancelado, oficialmente atribuído a uma reorganização institucional e a custos de licenciamento insustentáveis; o próprio relatório da RTI concluiu que a pontuação por IA 'não é suficientemente exata nem fiável para ser utilizada como meio independente de medir as competências de fluência de leitura oral dos alunos'. A prática está catalogada como um resultado negativo rigorosamente avaliado e reportado com honestidade.
Implementa esta prática? Reivindique-a — implementadores verificados obtêm um contacto público na página e podem propor correções.
De onde foi obtida a informação desta prática, e quando.
China
A IA de reconhecimento de voz da iFLYTEK avalia o inglês oral nos exames de zhongkao e gaokao da China, …
Estados Unidos da América
O Novo México exige o teste de leitura por voz com IA da Amira para todos os alunos do infantário …
Austrália
Em vez de uma corrida armamentista impossível de ganhar contra deteção de IA, Sydney redesenhou a avaliação em duas faixas …
Croácia
O projeto BrAIn da CARNET, financiado pelo FSE+, testou o primeiro currículo de IA da Croácia em escolas profissionais, abordando …
Abrir o copiloto completo Baseado em práticas citadas — verifique sempre as fontes.