evidoria

← Voltar à navegação

Good practice

OpenEval — a plataforma de pesquisa assistida por IA da Finlândia para evidências de avaliação de cooperação para o desenvolvimento

Finlândia · Helsinki · Ver o perfil de Finlândia

O Ministério dos Negócios Estrangeiros da Finlândia lançou o OpenEval, uma ferramenta de IA baseada no Azure, desenvolvida com a CGI, que permite a funcionários públicos e ao público pesquisar, resumir e cruzar centenas de relatórios de avaliação da cooperação para o desenvolvimento de uma só vez, apoiando a formulação de políticas baseada em evidências.

~9 months
Tempo de desenvolvimento da prova de conceito ao lançamento

Detalhes

Promotor
Ministry for Foreign Affairs of Finland (Development Evaluation Unit), with CGI
Período
June 2025–present
Palavras-chave
development cooperation evaluation, AI-assisted policy research, semantic search, natural language processing, evidence-based decision-making

Contexto

O OpenEval é uma plataforma de pesquisa assistida por IA criada pelo Ministério dos Negócios Estrangeiros da Finlândia (Unidade de Avaliação do Desenvolvimento) em parceria com a empresa tecnológica CGI, que permite a funcionários públicos e ao público em geral pesquisar e sintetizar centenas de páginas de relatórios de avaliação da cooperação para o desenvolvimento em inglês e finlandês. Utiliza o Azure Document Intelligence, o Azure AI Search e o GPT-4o, e foi lançado em 18 de junho de 2025, após cerca de nove meses de desenvolvimento a partir de uma prova de conceito, incluindo três rondas de testes de feedback internos e externos.

Objetivos

Apoiar a conceção de políticas de desenvolvimento baseadas em evidências através de pesquisa semântica assistida por IA e síntese de evidências de avaliação, mantendo as decisões sobre o uso da informação como responsabilidade humana, em vez de as delegar à IA.

Atividades

Desenvolvimento de uma plataforma de pesquisa semântica e síntese no Azure (Document Intelligence, Azure AI Search, GPT-4o) que abrange relatórios de avaliação bilingues (inglês/finlandês); três rondas de testes de utilizadores internos e externos; lançamento público em 18 de junho de 2025, sob a liderança da responsável do projeto Nea-Mari Heinonen e do Secretário de Estado Adjunto Pasi Hellman.

Resultados

A ferramenta está operacional desde o seu lançamento em 18 de junho de 2025 e gerou um interesse internacional significativo por parte das Nações Unidas, bancos multilaterais de desenvolvimento, da OCDE e de redes da UE, com várias organizações a testarem, segundo consta, abordagens semelhantes. No entanto, não foram publicadas métricas quantificadas de utilização antes/depois. A prática obteve 53/100 na avaliação do catálogo, com a dimensão 'Evidência de Impacto' classificada apenas em 1/3 por falta de métricas quantificadas.

Conclusões

O OpenEval demonstra um modelo replicável de acesso assistido por IA a evidências de avaliação, com um princípio explícito de supervisão humana, mas a sua própria base de evidência é limitada — não foram publicadas métricas quantificadas de utilização ou impacto, a transferibilidade além do ministério piloto ainda não está documentada, e a escalabilidade permanece classificada como baixa (1/3), aguardando a expansão iterativa planeada.

Implementação

Custo indicativo
Medium (€50k–€500k) — Built on Microsoft Azure Document Intelligence, Azure AI Search and GPT-4o with vendor partner CGI over roughly nine months from proof-of-concept to launch — a mid-scale managed-cloud AI platform rather than a low-cost internal script or a very large national infrastructure programme.
Tempo até resultados
Medium (1–3 years) — Approximately nine months from proof-of-concept to launch (three rounds of testing), officially launched 18 June 2025 and operational since; no fixed end date reported.
Equipa e competências
Ministry for Foreign Affairs of Finland, Development Evaluation Unit, CGI (technology vendor/implementation partner), Project lead Nea-Mari Heinonen

Condições de sucesso

  • Three rounds of internal and external user feedback before release
  • Human-oversight design principle embedded (AI supports, does not replace, civil servants' judgment)
  • Bilingual (English/Finnish) semantic search built into the platform from the start

Modos de falha comuns

  • No quantified before/after usage metrics have been published to demonstrate impact
  • Currently limited to a single ministry's evaluation reports, with scalability rated low (1/3) pending iterative expansion

Onde se enquadra

Tipo de governação
national ministry unit
Escala
single ministry, with reported international interest from UN/MDBs/OECD/EU
Nível de rendimento
high income

Fontes de dados

De onde foi obtida a informação desta prática, e quando.

Práticas semelhantes que podem ser úteis