Victor — IA do Supremo Tribunal Federal do Brasil para triagem de recursos extraordinários
Brasil
O Victor do STF classifica Recursos Extraordinários por tema de repercussão geral em ~5 segundos vs 44 minutos manualmente, processando …
Noruega · Oslo · Ver o perfil de Noruega · Ver o perfil de Oslo
Evidência: Descritivo / autorreportado Top 49% 60/100 · Pergunte a Evidence Copilot sobre esta prática
A Biblioteca Nacional da Noruega criou o NorHand, um modelo de IA de reconhecimento de escrita manual disponibilizado em aberto, treinado com cerca de 400 tipos de letra históricos (taxa de erro de caracteres de 4,0%), que já ajudou a digitalizar cerca de um quarto da sua coleção manuscrita digitalizada e foi adotado por outras instituições norueguesas.
A Biblioteca Nacional da Noruega (Nasjonalbiblioteket) tem vindo a digitalizar integralmente o seu acervo desde 2005, tendo digitalizado, em meados da década de 2020, quase todos os seus livros e mais de metade dos seus jornais. O seu laboratório de IA (AI-Lab) lançou uma família de modelos em língua norueguesa com licença aberta, incluindo o NB-BERT, o NB-GPT-J-6B (com 6 mil milhões de parâmetros) e os modelos de voz NB-Whisper.
Criar um modelo aberto de reconhecimento de texto manuscrito (HTR) para digitalizar manuscritos históricos e torná-los totalmente pesquisáveis em texto integral.
Em setembro de 2023, a Biblioteca publicou o NorHand, um modelo de HTR construído sobre a plataforma Transkribus e treinado com cerca de 400 caligrafias diferentes, incluindo manuscritos de autores como Sigrid Undset. Tanto o modelo como os dados de treino foram disponibilizados de forma aberta.
O NorHand atinge uma taxa de erro por carácter (CER) de cerca de 4,0% e, à data do lançamento, já tinha ajudado a processar e publicar cerca de um quarto dos documentos manuscritos digitalizados da Biblioteca como itens totalmente pesquisáveis. A Biblioteca refere que várias outras instituições norueguesas já o adotaram para as suas próprias necessidades de reconhecimento de escrita manual.
Estes números são auto-reportados pela Biblioteca e pelo seu parceiro tecnológico, e não foram objeto de auditoria independente; não foi encontrado nenhum estudo de referência externo ou avaliação académica da precisão real do NorHand nas várias instituições; a alegação de que "muitas" outras instituições o adotaram não está, em si, quantificada.
National / regional programmes
Vias de financiamento indicativas para práticas deste tipo — verifique sempre os avisos abertos e as regras de elegibilidade de cada programa.
Artefactos reutilizáveis desta prática — tal como publicados pelas suas fontes.
Implementa esta prática? Reivindique-a — implementadores verificados obtêm um contacto público na página e podem propor correções.
De onde foi obtida a informação desta prática, e quando.
Brasil
O Victor do STF classifica Recursos Extraordinários por tema de repercussão geral em ~5 segundos vs 44 minutos manualmente, processando …
Irlanda
O Arquivo Nacional da Irlanda usou OCR e automação robótica de processos para transcrever quase 3 milhões de registos do …
Portugal
A DRI da Madeira criou uma triagem BERT + Random Forest para 12.843 pedidos de assistência (2022-2024): 83% de precisão, …
Singapura
Plataforma NLP da GovTech Singapura: modelação de tópicos, sumarização, análise do Hansard e Q&A sobre normas TIC (IM8). 1.680 utilizadores …
Abrir o copiloto completo Baseado em práticas citadas — verifique sempre as fontes.