evidoria

Cómo se calcula la puntuación de calidad

Cada práctica en Evidoria tiene una única puntuación de calidad de 0 a 100. Se calcula de la misma manera en todos los catálogos, por lo que las puntuaciones son comparables y explicables.

El método, en una línea

puntuación = 100 × la media (ponderada) de cada dimensión de evaluación, tras reescalar cada dimensión a 0–1.

  1. Cada catálogo tiene una rúbrica: un conjunto de dimensiones de evaluación (p. ej. transferibilidad, impacto, sostenibilidad).
  2. El valor bruto de cada dimensión se normaliza a una escala de 0–1: (valor − mín) / (máx − mín).
  3. Los valores normalizados se suman sobre el conjunto COMPLETO de dimensiones de la rúbrica (cada una con el mismo peso salvo que se indique lo contrario), se dividen por el peso total de la rúbrica y se multiplican por 100. Una dimensión que no ha sido evaluada cuenta como cero — la ausencia de evidencia no es evidencia de mérito.

Como la aritmética es idéntica en todas partes, una puntuación de 80 significa lo mismo en cualquier catálogo: la práctica cumple, de media, el 80% de los criterios de evaluación de su rúbrica. Los catálogos solo difieren en qué dimensiones evalúan, porque sus datos de origen difieren.

Cómo leer la puntuación de una práctica

Un solo número oculta mucho. La mayoría de las prácticas obtienen puntuaciones altas (a menudo 90+), por lo que la cifra principal por sí sola apenas las diferencia. Dos elementos en cada página de práctica sitúan la puntuación en contexto.

  • El perfil de puntuación muestra el desglose por dimensión que hay detrás de la puntuación, de modo que se puede ver dónde una práctica es fuerte o débil, y no solo su media.
  • La posición en el catálogo (p. ej. «Top 10%») muestra dónde se sitúa la práctica entre sus pares puntuados del mismo catálogo. Contamos cuántos pares puntúan igual o por debajo (una convención de empate «igual o por debajo»). Solo se muestra cuando un catálogo tiene al menos cinco prácticas puntuadas, para que la posición sea significativa.

Ambos son formas de leer la puntuación: nunca cambian el valor almacenado. La puntuación en sí siempre se calcula exactamente como se describe arriba.

Cómo leer los números en los perfiles de lugar

Los perfiles de lugar (“qué funciona en …”) agregan las prácticas situadas en un país, región o ciudad. Todos los números mostrados derivan de las puntuaciones de rúbrica descritas arriba — nada se vuelve a puntuar para el perfil.

Puntuación media de calidad

La media de las puntuaciones de calidad de 0–100 de las prácticas evaluadas del lugar, usando exactamente la aritmética de la parte superior de esta página. Una media de 80 significa que las prácticas del lugar cumplen, de media, el 80% de los criterios de evaluación de sus rúbricas. La misma puntuación de 0–100 aparece junto a cada práctica en «Mejores buenas prácticas aquí».

Proporción de evidencia sólida

La proporción de prácticas evaluadas cuyo diseño de estudio se sitúa en los niveles superiores de la escalera de evidencia de abajo. Las prácticas aún no evaluadas en cuanto a la solidez de la evidencia quedan fuera del denominador — un diseño desconocido no se trata como evidencia débil.

Fortalezas, debilidades y el perfil de puntuación (puntos)

Cada dimensión de evaluación se reescala primero al rango común de 0–100, para que rúbricas distintas sean comparables. Después comparamos la media del lugar en cada dimensión con la media de todos los lugares evaluados: “+29 pts” significa que el lugar está, de media, 29 puntos por encima de esa referencia en la dimensión. Las diferencias menores de ±8 puntos se tratan como ruido y no cuentan ni como fortaleza ni como debilidad. Las barras emparejadas del perfil de puntuación muestran las mismas dos medias lado a lado.

Encaje, en las prácticas recomendadas

El encaje es una estimación de 0–100 de en qué medida una práctica de otro lugar se ajusta a este, combinando transferibilidad, correspondencia de contexto, coste y plazos, solidez de la evidencia y — cuando está disponible — similitud semántica. La lista está ordenada para favorecer prácticas que además abordan las dimensiones débiles del lugar; esa preferencia nunca cambia el encaje mostrado, se indica como línea de motivo (“Aborda las dimensiones débiles de este lugar”).

Adopciones en otros lugares

Un recuento de casos documentados en los que una práctica nacida en este lugar fue adoptada o replicada en otro sitio, a partir de los registros de adopción mostrados en la página de cada práctica.

Dimensiones evaluadas, por catálogo

AI in Education

Evaluado por C-NAPSE

DimensiónEscalaPeso
Evidence of learning impact0–31
Equity & inclusion0–31
Transparency, ethics & data protection0–31
Teacher capability & pedagogy0–31
Scalability & sustainability0–31

AI in the Public Sector

Evaluado por C-NAPSE

DimensiónEscalaPeso
Evidence of impact / measured public value0–31
Transparency, fairness & accountability0–31
Transferability / demonstrated replication0–31
Scalability beyond pilot0–31
Governance, capability & sustainability0–31

City Innovation Library

Evaluado por C-NAPSE

DimensiónEscalaPeso
Evidence of impact / measured results0–31
Transferability / demonstrated replication0–31
Scalability0–31
Sustainability / continuity0–31
Innovation0–31
Inclusiveness / equity0–31
Multi-stakeholder collaboration0–31

Digital Inclusion

Evaluado por C-NAPSE

DimensiónEscalaPeso
Innovation level0–51
Sustainability (ongoing)0–11
Evaluation evidence0–11
Demonstrated reach0–11
Documented learning0–11

Digital Inclusion

Evaluado por MEDICI consortium

DimensiónEscalaPeso
Innovation level0–51
Sustainability (ongoing)0–11
Evaluation evidence0–11
Demonstrated reach0–11
Documented learning0–11

Gender Equality

Evaluado por ProPEGE consortium (Equal Leadership)

DimensiónEscalaPeso
Transferability / replicability0–31
Impact on gender equality0–11
Effectiveness0–11
Efficiency0–11
Evaluated outcomes0–11
Sustainability0–11
Achievement / evidence0–11
Gender-mainstreaming embedding0–11
Curator validation0–11

Gender Equality

Evaluado por C-NAPSE

DimensiónEscalaPeso
Transferability / replicability0–31
Impact on gender equality0–11
Effectiveness0–11
Efficiency0–11
Evaluated outcomes0–11
Sustainability0–11
Achievement / evidence0–11
Gender-mainstreaming embedding0–11
Curator validation0–11

PES & Nature-Based Solutions

Evaluado por C-NAPSE

DimensiónEscalaPeso
Carbon — sequestration / storage, evidenced0–31
Biodiversity — conservation / improvement, evidenced0–31
Water & soil — retention, infiltration, erosion control0–31
Fire resilience — risk reduction, evidenced0–31
Governance, certification & transferability0–31

Una columna vertebral canónica, muchas fuentes

El método de rúbrica anterior es la columna vertebral canónica de todas las puntuaciones de esta plataforma. Varios catálogos nacieron de la importación de colecciones de prácticas creadas por proyectos y consorcios anteriores (por ejemplo, ProPEGE para la igualdad de género, MEDICI para la inclusión digital). Sus evaluaciones originales se respetan como priores atribuidos: cuando un consorcio de origen evaluó una práctica, esa evaluación alimenta las dimensiones correspondientes de la rúbrica y la fuente se acredita en la página de la práctica — pero las dimensiones, la aritmética y la puntuación publicada son siempre de Evidoria. El origen de un contenido nunca decide cómo se organiza o clasifica: la procedencia es metainformación, registrada por registro — nunca estructura.

Niveles de validación

Cada página de práctica muestra cómo se produjo y verificó el registro. La escala, de más a menos validado:

Cómo se corresponde nuestra escala de evidencia con otros estándares

Evidoria clasifica la evidencia de cada práctica por diseño de estudio. La tabla siguiente hace corresponder esa escalera con tres marcos ampliamente utilizados por las unidades what-works: la Maryland Scientific Methods Scale, los Standards of Evidence de Nesta y EMMIE. Las correspondencias son indicativas (un estudio concreto puede situarse más arriba o más abajo), y EMMIE es multidimensional: solo su dimensión Effect se corresponde con una escalera de diseño; sus lecturas Mechanism, Moderators, Implementation y Economics se corresponden con el dossier de implementación de cada página de práctica.

Fuerza de evidencia EvidoriaMaryland SMSNestaEMMIE
Ensayo controlado aleatorizadoLevel 5 — randomised assignment to treatment and controlLevel 3–4 — causal impact demonstrated; 4 where independently replicatedStrong Effect evidence — direct estimate of impact with a credible counterfactual
CuasiexperimentalLevel 3–4 — comparison group without full randomisationLevel 3 — causal comparison against a control or matched groupModerate-to-strong Effect evidence — counterfactual present, selection risks remain
Observacional / pre-postLevel 2 — before/after measures without a comparison groupLevel 2 — data showing change among recipientsWeak Effect evidence — change observed, attribution not established
Descriptivo / autodeclaradoLevel 1 — correlation or descriptive account onlyLevel 1–2 — a logical account of impact, possibly with descriptive dataNo Effect estimate — EMMIE's Mechanism/Implementation reading may still apply

De dónde provienen los datos

Cada práctica enumera sus fuentes de datos — el catálogo o el sitio web del que se obtuvo cada dato — junto con la fecha en que se consultó. Las encontrará en la página de cada práctica, en «Fuentes de datos».