DFROG — De Nederlandsche Bank's Machine-Learning-Tested Nowcasting Model for GDP Growth
Netherlands
DNB's DFROG nowcasting model has tracked Dutch GDP growth in real time since 2024, publishing monthly estimates; a decade-long evaluation …
Canada · Ottawa · See the Canada profile
L'Agence des médicaments du Canada a mené une comparaison évaluée par des pairs, portant sur 7 projets, entre Lens.org, SpiderCite et Microsoft Copilot face à la recherche manuelle pour la synthèse de données probantes liées au remboursement des médicaments, concluant que les trois outils d'IA repéraient nettement moins d'études pertinentes que des chercheurs formés.
L'Agence des médicaments du Canada (CDA-AMC, anciennement ACMTS) a chargé son équipe de Services d'information de recherche d'évaluer trois outils de recherche documentaire et de synthèse de données probantes assistés par IA — Lens.org, SpiderCite et Microsoft Copilot (GPT-4) — par rapport aux méthodes de recherche standard des revues systématiques, dans le cadre des travaux d'évaluation des technologies de la santé (ETS) qui sous-tendent les recommandations de remboursement de médicaments et de technologies au Canada.
Évaluer si les outils de recherche assistés par IA peuvent égaler la performance de la recherche manuelle des revues systématiques pour la synthèse de données probantes en ETS.
Une comparaison rétrospective portant sur 7 projets d'ETS achevés par l'agence (août-novembre 2024) a évalué le rappel de recherche et le temps de recherche de chaque outil d'IA par rapport à la recherche manuelle de référence. Les résultats ont été publiés sous forme d'étude comparative évaluée par des pairs et intégrés dans une déclaration de position officielle de la CDA-AMC sur l'utilisation de l'IA en ETS.
La recherche manuelle de référence a atteint un rappel/une sensibilité de 0,986, contre 0,676 pour Lens.org, environ 0,23-0,26 pour SpiderCite, et 0,244 pour Copilot. Le temps de recherche est passé d'une moyenne de 2,88 heures pour la recherche manuelle à seulement 0,96 heure pour Copilot.
La conclusion de l'agence est prudente plutôt que promotionnelle : chaque outil a été jugé « adapté à l'usage » uniquement dans des rôles de soutien restreints — par exemple, Copilot pour le brainstorming de stratégies de recherche — et explicitement pas comme un remplacement de la recherche systématique standard sur des sujets d'ETS complexes.
Implementation detail (cost, timeline, staffing, conditions for success) is not yet available for this practice.
Where this practice's information was retrieved from, and when.
Netherlands
DNB's DFROG nowcasting model has tracked Dutch GDP growth in real time since 2024, publishing monthly estimates; a decade-long evaluation …
United Kingdom
Consult, built by the UK's i.AI unit with the Alan Turing Institute, uses generative AI to analyse tens of thousands …
Taiwan
AI-assisted civic deliberation platform run by Taiwan's PDIS, using open-source Polis AI to map consensus on ~30 policy issues since …
United Kingdom
The UK's ATRS is a public register documenting how government algorithmic tools work and affect people. World-first when launched in …
Open full copilot Grounded in cited practices — always check the sources.