evidoria

← Volver al listado

Good practice

OpenEval — la plataforma de búsqueda asistida por IA de Finlandia para la evidencia de evaluación de la cooperación al desarrollo

Finlandia · Helsinki · Ver el perfil de Finlandia

El Ministerio de Asuntos Exteriores de Finlandia lanzó OpenEval, una herramienta de IA basada en Azure y desarrollada con CGI, que permite a los funcionarios públicos y al público buscar, resumir y cruzar cientos de informes de evaluación de la cooperación al desarrollo a la vez, en apoyo de la formulación de políticas basada en evidencia.

~9 months
Tiempo de desarrollo desde la prueba de concepto hasta el lanzamiento

Detalles

Promotor
Ministry for Foreign Affairs of Finland (Development Evaluation Unit), with CGI
Período
June 2025–present
Palabras clave
development cooperation evaluation, AI-assisted policy research, semantic search, natural language processing, evidence-based decision-making

Contexto

OpenEval es una plataforma de búsqueda asistida por IA creada por el Ministerio de Asuntos Exteriores de Finlandia (Unidad de Evaluación del Desarrollo) junto con el socio tecnológico CGI, que permite a los funcionarios públicos y al público en general buscar y sintetizar cientos de páginas de informes de evaluación de la cooperación para el desarrollo en inglés y finés. Utiliza Azure Document Intelligence, Azure AI Search y GPT-4o, y se lanzó el 18 de junio de 2025 tras aproximadamente nueve meses de desarrollo desde la prueba de concepto, incluidas tres rondas de pruebas de retroalimentación internas y externas.

Objetivos

Apoyar el diseño de políticas de desarrollo basadas en evidencia mediante la búsqueda semántica asistida por IA y la síntesis de evidencia de evaluación, manteniendo las decisiones sobre el uso de la información como una responsabilidad humana en lugar de delegarlas en la IA.

Actividades

Desarrollo de una plataforma de búsqueda semántica y síntesis en Azure (Document Intelligence, Azure AI Search, GPT-4o) que cubre informes de evaluación bilingües (inglés/finés); tres rondas de pruebas con usuarios internos y externos; lanzamiento público el 18 de junio de 2025 bajo la dirección de la líder del proyecto Nea-Mari Heinonen y el subsecretario de Estado Pasi Hellman.

Resultados

La herramienta ha estado operativa desde su lanzamiento el 18 de junio de 2025 y generó un interés internacional significativo por parte de la ONU, bancos multilaterales de desarrollo, la OCDE y redes de la UE, con varias organizaciones que, según se informa, están probando enfoques similares. Sin embargo, no se han publicado métricas cuantificadas de uso antes/después. La práctica obtuvo 53/100 en la evaluación del catálogo, con la dimensión 'Evidencia de Impacto' calificada solo con 1/3 por falta de métricas cuantificadas.

Conclusiones

OpenEval demuestra un modelo replicable de acceso asistido por IA a evidencia de evaluación, con un principio explícito de supervisión humana, pero su propia base de evidencia es limitada: no se han publicado métricas cuantificadas de uso o impacto, la transferibilidad más allá del ministerio piloto aún no está documentada, y la escalabilidad sigue calificada como baja (1/3) a la espera de la expansión iterativa planificada.

Implementación

Coste indicativo
Medium (€50k–€500k) — Built on Microsoft Azure Document Intelligence, Azure AI Search and GPT-4o with vendor partner CGI over roughly nine months from proof-of-concept to launch — a mid-scale managed-cloud AI platform rather than a low-cost internal script or a very large national infrastructure programme.
Tiempo hasta resultados
Medium (1–3 years) — Approximately nine months from proof-of-concept to launch (three rounds of testing), officially launched 18 June 2025 and operational since; no fixed end date reported.
Personal y competencias
Ministry for Foreign Affairs of Finland, Development Evaluation Unit, CGI (technology vendor/implementation partner), Project lead Nea-Mari Heinonen

Condiciones para el éxito

  • Three rounds of internal and external user feedback before release
  • Human-oversight design principle embedded (AI supports, does not replace, civil servants' judgment)
  • Bilingual (English/Finnish) semantic search built into the platform from the start

Modos de fallo comunes

  • No quantified before/after usage metrics have been published to demonstrate impact
  • Currently limited to a single ministry's evaluation reports, with scalability rated low (1/3) pending iterative expansion

Dónde encaja

Tipo de gobernanza
national ministry unit
Escala
single ministry, with reported international interest from UN/MDBs/OECD/EU
Nivel de ingresos
high income

Fuentes de datos

De dónde se obtuvo la información de esta práctica, y cuándo.

Prácticas similares que pueden serle útiles