Comment le score de qualité est calculé
Chaque pratique dans Evidoria porte un unique score de qualité de 0 à 100. Il est calculé de la même façon dans tous les catalogues, de sorte que les scores sont comparables et explicables.
La méthode, en une ligne
score = 100 × la moyenne (pondérée) de chaque dimension d’évaluation, après remise à l’échelle de chaque dimension sur 0–1.
- Chaque catalogue possède une grille : un ensemble de dimensions d’évaluation (p. ex. transférabilité, impact, durabilité).
- La valeur brute de chaque dimension est normalisée sur une échelle de 0 à 1 :
(valeur − min) / (max − min). - Les valeurs normalisées sont additionnées sur l’ENSEMBLE des dimensions de la grille d’évaluation (chacune pondérée de manière égale, sauf indication contraire), divisées par le poids total de la grille, puis multipliées par 100. Une dimension qui n’a pas été évaluée compte pour zéro — l’absence de preuves ne vaut pas preuve de mérite.
Comme l’arithmétique est identique partout, un score de 80 signifie la même chose dans tout catalogue : la pratique remplit, en moyenne, 80% des critères d’évaluation de sa grille. Les catalogues ne diffèrent que par les dimensions qu’ils évaluent, car leurs données sources diffèrent.
Lire le score d’une pratique
Un seul chiffre cache beaucoup de choses. La plupart des pratiques obtiennent un score élevé (souvent 90 et plus) ; le chiffre principal seul les distingue donc à peine. Deux éléments, sur chaque page de pratique, replacent le score dans son contexte.
- Le profil de score montre la répartition par dimension derrière le score, ce qui permet de voir où une pratique est forte ou faible, et pas seulement sa moyenne.
- La position dans le catalogue (p. ex. « Top 10% ») indique où se situe la pratique parmi ses homologues notés du même catalogue. Nous comptons combien d’homologues obtiennent un score inférieur ou égal (convention d’égalité « inférieur ou égal »). Elle n’est affichée que lorsqu’un catalogue compte au moins cinq pratiques notées, afin qu’une position ait du sens.
Les deux sont des manières de lire le score — ils ne modifient jamais la valeur enregistrée. Le score lui-même est toujours calculé exactement comme décrit ci-dessus.
Lire les chiffres des profils de lieux
Les profils de lieux (« ce qui fonctionne à … ») agrègent les pratiques situées dans un pays, une région ou une ville. Chaque chiffre affiché dérive des scores de grille décrits ci-dessus — rien n'est renoté pour le profil.
Score de qualité moyen
La moyenne des scores de qualité 0–100 des pratiques évaluées du lieu, en utilisant exactement l'arithmétique en haut de cette page. Une moyenne de 80 signifie que les pratiques du lieu satisfont, en moyenne, 80% des critères d'évaluation de leurs grilles. Le même score 0–100 apparaît à côté de chaque pratique dans « Meilleures bonnes pratiques ici ».
Part de preuves solides
La part des pratiques évaluées dont le plan d'étude se situe dans les niveaux supérieurs de l'échelle de preuves ci-dessous. Les pratiques dont la force des preuves n'a pas encore été évaluée sont exclues du dénominateur — un plan inconnu n'est pas traité comme une preuve faible.
Forces, faiblesses et le profil de scores (points)
Chaque dimension d'évaluation est d'abord ramenée à l'échelle commune de 0 à 100, afin que des grilles différentes soient comparables. Nous comparons ensuite la moyenne du lieu sur chaque dimension avec la moyenne de tous les lieux évalués : « +29 pts » signifie que le lieu est en moyenne 29 points au-dessus de cette référence sur la dimension. Les écarts inférieurs à ±8 points sont traités comme du bruit et ne comptent ni comme force ni comme faiblesse. Les barres appariées du profil de scores montrent les deux mêmes moyennes côte à côte.
Adéquation, sur les pratiques recommandées
L'adéquation est une estimation de 0 à 100 de la correspondance entre une pratique d'ailleurs et ce lieu, combinant transférabilité, correspondance de contexte, coût et délai, force des preuves et — lorsque disponible — similarité sémantique. La liste est ordonnée pour privilégier les pratiques qui répondent aussi aux dimensions faibles du lieu ; cette préférence ne modifie jamais l'adéquation affichée, elle est indiquée comme ligne de justification (« Répond aux dimensions faibles de ce lieu »).
Adoptions ailleurs
Un décompte des cas documentés où une pratique née dans ce lieu a été adoptée ou répliquée ailleurs, à partir des registres d'adoption affichés sur la page de chaque pratique.
Dimensions évaluées, par catalogue
AI in Education
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Evidence of learning impact | 0–3 | 1 |
| Equity & inclusion | 0–3 | 1 |
| Transparency, ethics & data protection | 0–3 | 1 |
| Teacher capability & pedagogy | 0–3 | 1 |
| Scalability & sustainability | 0–3 | 1 |
AI in the Public Sector
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Evidence of impact / measured public value | 0–3 | 1 |
| Transparency, fairness & accountability | 0–3 | 1 |
| Transferability / demonstrated replication | 0–3 | 1 |
| Scalability beyond pilot | 0–3 | 1 |
| Governance, capability & sustainability | 0–3 | 1 |
City Innovation Library
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Evidence of impact / measured results | 0–3 | 1 |
| Transferability / demonstrated replication | 0–3 | 1 |
| Scalability | 0–3 | 1 |
| Sustainability / continuity | 0–3 | 1 |
| Innovation | 0–3 | 1 |
| Inclusiveness / equity | 0–3 | 1 |
| Multi-stakeholder collaboration | 0–3 | 1 |
Digital Inclusion
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Innovation level | 0–5 | 1 |
| Sustainability (ongoing) | 0–1 | 1 |
| Evaluation evidence | 0–1 | 1 |
| Demonstrated reach | 0–1 | 1 |
| Documented learning | 0–1 | 1 |
Digital Inclusion
Évalué par MEDICI consortium
| Dimension | Échelle | Poids |
|---|---|---|
| Innovation level | 0–5 | 1 |
| Sustainability (ongoing) | 0–1 | 1 |
| Evaluation evidence | 0–1 | 1 |
| Demonstrated reach | 0–1 | 1 |
| Documented learning | 0–1 | 1 |
Gender Equality
Évalué par ProPEGE consortium (Equal Leadership)
| Dimension | Échelle | Poids |
|---|---|---|
| Transferability / replicability | 0–3 | 1 |
| Impact on gender equality | 0–1 | 1 |
| Effectiveness | 0–1 | 1 |
| Efficiency | 0–1 | 1 |
| Evaluated outcomes | 0–1 | 1 |
| Sustainability | 0–1 | 1 |
| Achievement / evidence | 0–1 | 1 |
| Gender-mainstreaming embedding | 0–1 | 1 |
| Curator validation | 0–1 | 1 |
Gender Equality
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Transferability / replicability | 0–3 | 1 |
| Impact on gender equality | 0–1 | 1 |
| Effectiveness | 0–1 | 1 |
| Efficiency | 0–1 | 1 |
| Evaluated outcomes | 0–1 | 1 |
| Sustainability | 0–1 | 1 |
| Achievement / evidence | 0–1 | 1 |
| Gender-mainstreaming embedding | 0–1 | 1 |
| Curator validation | 0–1 | 1 |
PES & Nature-Based Solutions
Évalué par C-NAPSE
| Dimension | Échelle | Poids |
|---|---|---|
| Carbon — sequestration / storage, evidenced | 0–3 | 1 |
| Biodiversity — conservation / improvement, evidenced | 0–3 | 1 |
| Water & soil — retention, infiltration, erosion control | 0–3 | 1 |
| Fire resilience — risk reduction, evidenced | 0–3 | 1 |
| Governance, certification & transferability | 0–3 | 1 |
Une colonne vertébrale canonique, de nombreuses sources
La méthode de rubrique ci-dessus est la colonne vertébrale canonique de chaque score de cette plateforme. Plusieurs catalogues sont nés de l'importation de collections de pratiques constituées par des projets et consortiums antérieurs (par exemple ProPEGE pour l'égalité de genre, MEDICI pour l'inclusion numérique). Leurs évaluations d'origine sont respectées comme des a priori attribués : lorsqu'un consortium source a évalué une pratique, cette évaluation alimente les dimensions correspondantes de la rubrique et la source est créditée sur la page de la pratique — mais les dimensions, l'arithmétique et le score publié restent toujours ceux d'Evidoria. La provenance d'un contenu ne détermine jamais son organisation ni son classement : la provenance est une métadonnée, enregistrée par fiche — jamais une structure.
Niveaux de validation
Chaque page de pratique montre comment la fiche a été produite et vérifiée. L'échelle, du plus au moins validé :
- Évaluée par un expert — un évaluateur identifié a rempli la grille du catalogue pour cette pratique.
- Relue par un curateur — un curateur a relu le contenu de la fiche.
- Enrichie par IA, en attente de relecture — le contenu structuré a été ajouté par la routine d'IA sans clé et attend la relecture d'un curateur.
- Importée — importée d'un catalogue source ; contenu tel que publié par la source.
- Ajoutée par un éditeur — créée directement par un éditeur et pas encore relue séparément.
Correspondance de notre échelle de preuves avec d'autres référentiels
Evidoria classe les preuves de chaque pratique par plan d'étude. Le tableau ci-dessous met cette échelle en correspondance avec trois cadres largement utilisés par les unités what-works — la Maryland Scientific Methods Scale, les Standards of Evidence de Nesta et EMMIE. Les correspondances sont indicatives (une étude donnée peut se situer plus haut ou plus bas), et EMMIE est multidimensionnel : seule sa dimension Effect correspond à une échelle de plan d'étude — ses lectures Mechanism, Moderators, Implementation et Economics correspondent au dossier de mise en œuvre de chaque page de pratique.
| Force de preuve Evidoria | Maryland SMS | Nesta | EMMIE |
|---|---|---|---|
| Essai contrôlé randomisé | Level 5 — randomised assignment to treatment and control | Level 3–4 — causal impact demonstrated; 4 where independently replicated | Strong Effect evidence — direct estimate of impact with a credible counterfactual |
| Quasi expérimental | Level 3–4 — comparison group without full randomisation | Level 3 — causal comparison against a control or matched group | Moderate-to-strong Effect evidence — counterfactual present, selection risks remain |
| Observationnel / avant-après | Level 2 — before/after measures without a comparison group | Level 2 — data showing change among recipients | Weak Effect evidence — change observed, attribution not established |
| Descriptif / auto-déclaré | Level 1 — correlation or descriptive account only | Level 1–2 — a logical account of impact, possibly with descriptive data | No Effect estimate — EMMIE's Mechanism/Implementation reading may still apply |
D'où proviennent les données
Chaque pratique indique ses sources de données — le catalogue ou le site web d’où chaque information a été tirée — ainsi que la date de consultation. Vous les trouverez sur la page de chaque pratique, sous « Sources de données ».