Victor — IA del Supremo Tribunal Federal de Brasil para la clasificación de recursos extraordinarios
Brasil
El Victor del STF clasifica recursos extraordinarios por tema de repercussão geral en ~5 segundos frente a 44 minutos manualmente, …
Noruega · Oslo · Ver el perfil de Noruega · Ver el perfil de Oslo
Evidencia: Descriptivo / autodeclarado Top 49% 60/100 · Pregunte a Evidence Copilot sobre esta práctica
La Biblioteca Nacional de Noruega creó NorHand, un modelo de IA de reconocimiento de escritura manuscrita publicado en abierto, entrenado con unas 400 grafías históricas (tasa de error de caracteres del 4,0%), que ya ha ayudado a digitalizar alrededor de una cuarta parte de su colección manuscrita digitalizada y ha sido adoptado por otras instituciones noruegas.
La Biblioteca Nacional de Noruega (Nasjonalbiblioteket) lleva digitalizando por completo sus fondos desde 2005, y a mediados de la década de 2020 había digitalizado casi todos sus libros y más de la mitad de sus periódicos. Su laboratorio de IA (AI-Lab) ha publicado una familia de modelos en noruego con licencia abierta, entre ellos NB-BERT, NB-GPT-J-6B (con 6.000 millones de parámetros) y los modelos de voz NB-Whisper.
Crear un modelo abierto de reconocimiento de texto manuscrito (HTR) para digitalizar manuscritos históricos y hacerlos totalmente buscables en texto completo.
En septiembre de 2023, la Biblioteca publicó NorHand, un modelo HTR construido sobre la plataforma Transkribus y entrenado con aproximadamente 400 caligrafías distintas, incluidos manuscritos de autores como Sigrid Undset. Tanto el modelo como sus datos de entrenamiento se publicaron de forma abierta.
NorHand alcanza una tasa de error por carácter (CER) de aproximadamente el 4,0% y, en el momento de su lanzamiento, ya había ayudado a procesar y publicar alrededor de una cuarta parte de los documentos manuscritos digitalizados de la Biblioteca como elementos totalmente buscables en texto completo. La Biblioteca informa de que varias otras instituciones noruegas lo han adoptado desde entonces para sus propias necesidades de reconocimiento de escritura manuscrita.
Estas cifras son autodeclaradas por la Biblioteca y su socio tecnológico, sin auditoría independiente; no se encontró ningún estudio de referencia externo ni evaluación académica de la precisión real de NorHand en las distintas instituciones; la afirmación de que "muchas" otras instituciones lo han adoptado no está, en sí misma, cuantificada.
National / regional programmes
Vías de financiación indicativas para prácticas de este tipo: compruebe siempre las convocatorias vigentes y las reglas de elegibilidad de cada programa.
Artefactos reutilizables de esta práctica — tal como los publican sus fuentes.
¿Usted implementa esta práctica? Reivindíquela — los implementadores verificados obtienen un contacto público en la página y pueden proponer correcciones.
De dónde se obtuvo la información de esta práctica, y cuándo.
Brasil
El Victor del STF clasifica recursos extraordinarios por tema de repercussão geral en ~5 segundos frente a 44 minutos manualmente, …
Irlanda
El Archivo Nacional de Irlanda usó OCR y automatización robótica de procesos para transcribir casi 3 millones de registros del …
Portugal
La DRI de Madeira creó una clasificación BERT + Random Forest para 12.843 solicitudes de soporte (2022-2024): 83% de precisión, …
Singapur
Plataforma NLP pangubernamental de Singapur: modelado de temas, resumen automático, análisis del Hansard y Q&A sobre normativa TIC (IM8). 1.680 …
Abrir el copiloto completo Basado en prácticas citadas: comprueba siempre las fuentes.