evidoria

← Retour à la liste

Good practice

OpenEval — la plateforme de recherche assistée par IA de la Finlande pour les données d'évaluation de la coopération au développement

Finlande · Helsinki · Voir le profil de Finlande

Le ministère finlandais des Affaires étrangères a lancé OpenEval, un outil d'IA basé sur Azure et développé avec CGI, qui permet aux fonctionnaires et au public de rechercher, résumer et croiser des centaines de rapports d'évaluation de la coopération au développement à la fois, à l'appui d'une élaboration des politiques fondée sur des données probantes.

~9 months
Durée de développement, de la preuve de concept au lancement

Détails

Promoteur
Ministry for Foreign Affairs of Finland (Development Evaluation Unit), with CGI
Période
June 2025–present
Mots-clés
development cooperation evaluation, AI-assisted policy research, semantic search, natural language processing, evidence-based decision-making

Contexte

OpenEval est une plateforme de recherche assistée par IA développée par le ministère finlandais des Affaires étrangères (unité d'évaluation du développement) avec le partenaire technologique CGI, permettant aux fonctionnaires et au public de rechercher et de synthétiser des centaines de pages de rapports d'évaluation de la coopération au développement en anglais et en finnois. Elle utilise Azure Document Intelligence, Azure AI Search et GPT-4o, et a été lancée le 18 juin 2025 après environ neuf mois de développement depuis la preuve de concept, incluant trois cycles de tests de retours internes et externes.

Objectifs

Soutenir l'élaboration de politiques de développement fondées sur des données probantes grâce à la recherche sémantique assistée par IA et à la synthèse des données d'évaluation, tout en conservant les décisions relatives à l'utilisation de l'information comme une responsabilité humaine plutôt que de les déléguer à l'IA.

Activités

Développement d'une plateforme de recherche sémantique et de synthèse sur Azure (Document Intelligence, Azure AI Search, GPT-4o) couvrant des rapports d'évaluation bilingues (anglais/finnois) ; trois cycles de tests utilisateurs internes et externes ; lancement public le 18 juin 2025 sous la direction de la cheffe de projet Nea-Mari Heinonen et du secrétaire d'État Pasi Hellman.

Résultats

L'outil est opérationnel depuis son lancement le 18 juin 2025 et a suscité un intérêt international important de la part de l'ONU, des banques multilatérales de développement, de l'OCDE et de réseaux de l'UE, plusieurs organisations testant apparemment des approches similaires. Cependant, aucune métrique quantifiée d'utilisation avant/après n'a été publiée. La pratique a obtenu un score de 53/100 dans l'évaluation du catalogue, la dimension « Preuve d'impact » n'étant notée que 1/3 en raison de l'absence de métriques quantifiées.

Conclusions

OpenEval illustre un modèle reproductible d'accès assisté par IA aux données d'évaluation, avec un principe explicite de supervision humaine, mais sa propre base de données probantes reste limitée — aucune métrique quantifiée d'utilisation ou d'impact n'a été publiée, la transférabilité au-delà du ministère pilote n'est pas encore documentée, et l'évolutivité demeure notée faible (1/3) en attendant l'expansion itérative prévue.

Mise en œuvre

Coût indicatif
Medium (€50k–€500k) — Built on Microsoft Azure Document Intelligence, Azure AI Search and GPT-4o with vendor partner CGI over roughly nine months from proof-of-concept to launch — a mid-scale managed-cloud AI platform rather than a low-cost internal script or a very large national infrastructure programme.
Délai jusqu’aux résultats
Medium (1–3 years) — Approximately nine months from proof-of-concept to launch (three rounds of testing), officially launched 18 June 2025 and operational since; no fixed end date reported.
Personnel et compétences
Ministry for Foreign Affairs of Finland, Development Evaluation Unit, CGI (technology vendor/implementation partner), Project lead Nea-Mari Heinonen

Conditions de réussite

  • Three rounds of internal and external user feedback before release
  • Human-oversight design principle embedded (AI supports, does not replace, civil servants' judgment)
  • Bilingual (English/Finnish) semantic search built into the platform from the start

Modes d’échec courants

  • No quantified before/after usage metrics have been published to demonstrate impact
  • Currently limited to a single ministry's evaluation reports, with scalability rated low (1/3) pending iterative expansion

Où cela s’applique

Type de gouvernance
national ministry unit
Échelle
single ministry, with reported international interest from UN/MDBs/OECD/EU
Niveau de revenu
high income

Sources de données

D'où proviennent les informations de cette pratique, et quand.

Pratiques similaires qui pourraient vous être utiles