evidoria

Comment le score de qualité est calculé

Chaque pratique dans Evidoria porte un unique score de qualité de 0 à 100. Il est calculé de la même façon dans tous les catalogues, de sorte que les scores sont comparables et explicables.

La méthode, en une ligne

score = 100 × la moyenne (pondérée) de chaque dimension d’évaluation, après remise à l’échelle de chaque dimension sur 0–1.

  1. Chaque catalogue possède une grille : un ensemble de dimensions d’évaluation (p. ex. transférabilité, impact, durabilité).
  2. La valeur brute de chaque dimension est normalisée sur une échelle de 0 à 1 : (valeur − min) / (max − min).
  3. Les valeurs normalisées sont additionnées sur l’ENSEMBLE des dimensions de la grille d’évaluation (chacune pondérée de manière égale, sauf indication contraire), divisées par le poids total de la grille, puis multipliées par 100. Une dimension qui n’a pas été évaluée compte pour zéro — l’absence de preuves ne vaut pas preuve de mérite.

Comme l’arithmétique est identique partout, un score de 80 signifie la même chose dans tout catalogue : la pratique remplit, en moyenne, 80% des critères d’évaluation de sa grille. Les catalogues ne diffèrent que par les dimensions qu’ils évaluent, car leurs données sources diffèrent.

Lire le score d’une pratique

Un seul chiffre cache beaucoup de choses. La plupart des pratiques obtiennent un score élevé (souvent 90 et plus) ; le chiffre principal seul les distingue donc à peine. Deux éléments, sur chaque page de pratique, replacent le score dans son contexte.

  • Le profil de score montre la répartition par dimension derrière le score, ce qui permet de voir une pratique est forte ou faible, et pas seulement sa moyenne.
  • La position dans le catalogue (p. ex. « Top 10% ») indique où se situe la pratique parmi ses homologues notés du même catalogue. Nous comptons combien d’homologues obtiennent un score inférieur ou égal (convention d’égalité « inférieur ou égal »). Elle n’est affichée que lorsqu’un catalogue compte au moins cinq pratiques notées, afin qu’une position ait du sens.

Les deux sont des manières de lire le score — ils ne modifient jamais la valeur enregistrée. Le score lui-même est toujours calculé exactement comme décrit ci-dessus.

Lire les chiffres des profils de lieux

Les profils de lieux (« ce qui fonctionne à … ») agrègent les pratiques situées dans un pays, une région ou une ville. Chaque chiffre affiché dérive des scores de grille décrits ci-dessus — rien n'est renoté pour le profil.

Score de qualité moyen

La moyenne des scores de qualité 0–100 des pratiques évaluées du lieu, en utilisant exactement l'arithmétique en haut de cette page. Une moyenne de 80 signifie que les pratiques du lieu satisfont, en moyenne, 80% des critères d'évaluation de leurs grilles. Le même score 0–100 apparaît à côté de chaque pratique dans « Meilleures bonnes pratiques ici ».

Part de preuves solides

La part des pratiques évaluées dont le plan d'étude se situe dans les niveaux supérieurs de l'échelle de preuves ci-dessous. Les pratiques dont la force des preuves n'a pas encore été évaluée sont exclues du dénominateur — un plan inconnu n'est pas traité comme une preuve faible.

Forces, faiblesses et le profil de scores (points)

Chaque dimension d'évaluation est d'abord ramenée à l'échelle commune de 0 à 100, afin que des grilles différentes soient comparables. Nous comparons ensuite la moyenne du lieu sur chaque dimension avec la moyenne de tous les lieux évalués : « +29 pts » signifie que le lieu est en moyenne 29 points au-dessus de cette référence sur la dimension. Les écarts inférieurs à ±8 points sont traités comme du bruit et ne comptent ni comme force ni comme faiblesse. Les barres appariées du profil de scores montrent les deux mêmes moyennes côte à côte.

Adéquation, sur les pratiques recommandées

L'adéquation est une estimation de 0 à 100 de la correspondance entre une pratique d'ailleurs et ce lieu, combinant transférabilité, correspondance de contexte, coût et délai, force des preuves et — lorsque disponible — similarité sémantique. La liste est ordonnée pour privilégier les pratiques qui répondent aussi aux dimensions faibles du lieu ; cette préférence ne modifie jamais l'adéquation affichée, elle est indiquée comme ligne de justification (« Répond aux dimensions faibles de ce lieu »).

Adoptions ailleurs

Un décompte des cas documentés où une pratique née dans ce lieu a été adoptée ou répliquée ailleurs, à partir des registres d'adoption affichés sur la page de chaque pratique.

Dimensions évaluées, par catalogue

AI in Education

Évalué par C-NAPSE

DimensionÉchellePoids
Evidence of learning impact0–31
Equity & inclusion0–31
Transparency, ethics & data protection0–31
Teacher capability & pedagogy0–31
Scalability & sustainability0–31

AI in the Public Sector

Évalué par C-NAPSE

DimensionÉchellePoids
Evidence of impact / measured public value0–31
Transparency, fairness & accountability0–31
Transferability / demonstrated replication0–31
Scalability beyond pilot0–31
Governance, capability & sustainability0–31

City Innovation Library

Évalué par C-NAPSE

DimensionÉchellePoids
Evidence of impact / measured results0–31
Transferability / demonstrated replication0–31
Scalability0–31
Sustainability / continuity0–31
Innovation0–31
Inclusiveness / equity0–31
Multi-stakeholder collaboration0–31

Digital Inclusion

Évalué par C-NAPSE

DimensionÉchellePoids
Innovation level0–51
Sustainability (ongoing)0–11
Evaluation evidence0–11
Demonstrated reach0–11
Documented learning0–11

Digital Inclusion

Évalué par MEDICI consortium

DimensionÉchellePoids
Innovation level0–51
Sustainability (ongoing)0–11
Evaluation evidence0–11
Demonstrated reach0–11
Documented learning0–11

Gender Equality

Évalué par ProPEGE consortium (Equal Leadership)

DimensionÉchellePoids
Transferability / replicability0–31
Impact on gender equality0–11
Effectiveness0–11
Efficiency0–11
Evaluated outcomes0–11
Sustainability0–11
Achievement / evidence0–11
Gender-mainstreaming embedding0–11
Curator validation0–11

Gender Equality

Évalué par C-NAPSE

DimensionÉchellePoids
Transferability / replicability0–31
Impact on gender equality0–11
Effectiveness0–11
Efficiency0–11
Evaluated outcomes0–11
Sustainability0–11
Achievement / evidence0–11
Gender-mainstreaming embedding0–11
Curator validation0–11

PES & Nature-Based Solutions

Évalué par C-NAPSE

DimensionÉchellePoids
Carbon — sequestration / storage, evidenced0–31
Biodiversity — conservation / improvement, evidenced0–31
Water & soil — retention, infiltration, erosion control0–31
Fire resilience — risk reduction, evidenced0–31
Governance, certification & transferability0–31

Une colonne vertébrale canonique, de nombreuses sources

La méthode de rubrique ci-dessus est la colonne vertébrale canonique de chaque score de cette plateforme. Plusieurs catalogues sont nés de l'importation de collections de pratiques constituées par des projets et consortiums antérieurs (par exemple ProPEGE pour l'égalité de genre, MEDICI pour l'inclusion numérique). Leurs évaluations d'origine sont respectées comme des a priori attribués : lorsqu'un consortium source a évalué une pratique, cette évaluation alimente les dimensions correspondantes de la rubrique et la source est créditée sur la page de la pratique — mais les dimensions, l'arithmétique et le score publié restent toujours ceux d'Evidoria. La provenance d'un contenu ne détermine jamais son organisation ni son classement : la provenance est une métadonnée, enregistrée par fiche — jamais une structure.

Niveaux de validation

Chaque page de pratique montre comment la fiche a été produite et vérifiée. L'échelle, du plus au moins validé :

Correspondance de notre échelle de preuves avec d'autres référentiels

Evidoria classe les preuves de chaque pratique par plan d'étude. Le tableau ci-dessous met cette échelle en correspondance avec trois cadres largement utilisés par les unités what-works — la Maryland Scientific Methods Scale, les Standards of Evidence de Nesta et EMMIE. Les correspondances sont indicatives (une étude donnée peut se situer plus haut ou plus bas), et EMMIE est multidimensionnel : seule sa dimension Effect correspond à une échelle de plan d'étude — ses lectures Mechanism, Moderators, Implementation et Economics correspondent au dossier de mise en œuvre de chaque page de pratique.

Force de preuve EvidoriaMaryland SMSNestaEMMIE
Essai contrôlé randomiséLevel 5 — randomised assignment to treatment and controlLevel 3–4 — causal impact demonstrated; 4 where independently replicatedStrong Effect evidence — direct estimate of impact with a credible counterfactual
Quasi expérimentalLevel 3–4 — comparison group without full randomisationLevel 3 — causal comparison against a control or matched groupModerate-to-strong Effect evidence — counterfactual present, selection risks remain
Observationnel / avant-aprèsLevel 2 — before/after measures without a comparison groupLevel 2 — data showing change among recipientsWeak Effect evidence — change observed, attribution not established
Descriptif / auto-déclaréLevel 1 — correlation or descriptive account onlyLevel 1–2 — a logical account of impact, possibly with descriptive dataNo Effect estimate — EMMIE's Mechanism/Implementation reading may still apply

D'où proviennent les données

Chaque pratique indique ses sources de données — le catalogue ou le site web d’où chaque information a été tirée — ainsi que la date de consultation. Vous les trouverez sur la page de chaque pratique, sous « Sources de données ».