Le ministère finlandais des Affaires étrangères a lancé OpenEval, un outil d'IA basé sur Azure et développé avec CGI, qui permet aux fonctionnaires et au public de rechercher, résumer et croiser des centaines de rapports d'évaluation de la coopération au développement à la fois, à l'appui d'une élaboration des politiques fondée sur des données probantes.
~9 months
Durée de développement, de la preuve de concept au lancement
Détails
Promoteur
Ministry for Foreign Affairs of Finland (Development Evaluation Unit), with CGI
Période
June 2025–present
Mots-clés
development cooperation evaluation, AI-assisted policy research, semantic search, natural language processing, evidence-based decision-making
Contexte
OpenEval est une plateforme de recherche assistée par IA développée par le ministère finlandais des Affaires étrangères (unité d'évaluation du développement) avec le partenaire technologique CGI, permettant aux fonctionnaires et au public de rechercher et de synthétiser des centaines de pages de rapports d'évaluation de la coopération au développement en anglais et en finnois. Elle utilise Azure Document Intelligence, Azure AI Search et GPT-4o, et a été lancée le 18 juin 2025 après environ neuf mois de développement depuis la preuve de concept, incluant trois cycles de tests de retours internes et externes.
Objectifs
Soutenir l'élaboration de politiques de développement fondées sur des données probantes grâce à la recherche sémantique assistée par IA et à la synthèse des données d'évaluation, tout en conservant les décisions relatives à l'utilisation de l'information comme une responsabilité humaine plutôt que de les déléguer à l'IA.
Activités
Développement d'une plateforme de recherche sémantique et de synthèse sur Azure (Document Intelligence, Azure AI Search, GPT-4o) couvrant des rapports d'évaluation bilingues (anglais/finnois) ; trois cycles de tests utilisateurs internes et externes ; lancement public le 18 juin 2025 sous la direction de la cheffe de projet Nea-Mari Heinonen et du secrétaire d'État Pasi Hellman.
Résultats
L'outil est opérationnel depuis son lancement le 18 juin 2025 et a suscité un intérêt international important de la part de l'ONU, des banques multilatérales de développement, de l'OCDE et de réseaux de l'UE, plusieurs organisations testant apparemment des approches similaires. Cependant, aucune métrique quantifiée d'utilisation avant/après n'a été publiée. La pratique a obtenu un score de 53/100 dans l'évaluation du catalogue, la dimension « Preuve d'impact » n'étant notée que 1/3 en raison de l'absence de métriques quantifiées.
Conclusions
OpenEval illustre un modèle reproductible d'accès assisté par IA aux données d'évaluation, avec un principe explicite de supervision humaine, mais sa propre base de données probantes reste limitée — aucune métrique quantifiée d'utilisation ou d'impact n'a été publiée, la transférabilité au-delà du ministère pilote n'est pas encore documentée, et l'évolutivité demeure notée faible (1/3) en attendant l'expansion itérative prévue.
Mise en œuvre
Coût indicatif
Medium (€50k–€500k) — Built on Microsoft Azure Document Intelligence, Azure AI Search and GPT-4o with vendor partner CGI over roughly nine months from proof-of-concept to launch — a mid-scale managed-cloud AI platform rather than a low-cost internal script or a very large national infrastructure programme.
Délai jusqu’aux résultats
Medium (1–3 years) — Approximately nine months from proof-of-concept to launch (three rounds of testing), officially launched 18 June 2025 and operational since; no fixed end date reported.
Personnel et compétences
Ministry for Foreign Affairs of Finland, Development Evaluation Unit, CGI (technology vendor/implementation partner), Project lead Nea-Mari Heinonen
Conditions de réussite
Three rounds of internal and external user feedback before release
Human-oversight design principle embedded (AI supports, does not replace, civil servants' judgment)
Bilingual (English/Finnish) semantic search built into the platform from the start
Modes d’échec courants
No quantified before/after usage metrics have been published to demonstrate impact
Currently limited to a single ministry's evaluation reports, with scalability rated low (1/3) pending iterative expansion
Où cela s’applique
Type de gouvernance
national ministry unit
Échelle
single ministry, with reported international interest from UN/MDBs/OECD/EU
Niveau de revenu
high income
Sources de données
D'où proviennent les informations de cette pratique, et quand.