Cómo se calcula la puntuación de calidad
Cada práctica en Evidoria tiene una única puntuación de calidad de 0 a 100. Se calcula de la misma manera en todos los catálogos, por lo que las puntuaciones son comparables y explicables.
El método, en una línea
puntuación = 100 × la media (ponderada) de cada dimensión de evaluación, tras reescalar cada dimensión a 0–1.
- Cada catálogo tiene una rúbrica: un conjunto de dimensiones de evaluación (p. ej. transferibilidad, impacto, sostenibilidad).
- El valor bruto de cada dimensión se normaliza a una escala de 0–1:
(valor − mín) / (máx − mín). - Los valores normalizados se suman sobre el conjunto COMPLETO de dimensiones de la rúbrica (cada una con el mismo peso salvo que se indique lo contrario), se dividen por el peso total de la rúbrica y se multiplican por 100. Una dimensión que no ha sido evaluada cuenta como cero — la ausencia de evidencia no es evidencia de mérito.
Como la aritmética es idéntica en todas partes, una puntuación de 80 significa lo mismo en cualquier catálogo: la práctica cumple, de media, el 80% de los criterios de evaluación de su rúbrica. Los catálogos solo difieren en qué dimensiones evalúan, porque sus datos de origen difieren.
Cómo leer la puntuación de una práctica
Un solo número oculta mucho. La mayoría de las prácticas obtienen puntuaciones altas (a menudo 90+), por lo que la cifra principal por sí sola apenas las diferencia. Dos elementos en cada página de práctica sitúan la puntuación en contexto.
- El perfil de puntuación muestra el desglose por dimensión que hay detrás de la puntuación, de modo que se puede ver dónde una práctica es fuerte o débil, y no solo su media.
- La posición en el catálogo (p. ej. «Top 10%») muestra dónde se sitúa la práctica entre sus pares puntuados del mismo catálogo. Contamos cuántos pares puntúan igual o por debajo (una convención de empate «igual o por debajo»). Solo se muestra cuando un catálogo tiene al menos cinco prácticas puntuadas, para que la posición sea significativa.
Ambos son formas de leer la puntuación: nunca cambian el valor almacenado. La puntuación en sí siempre se calcula exactamente como se describe arriba.
Cómo leer los números en los perfiles de lugar
Los perfiles de lugar (“qué funciona en …”) agregan las prácticas situadas en un país, región o ciudad. Todos los números mostrados derivan de las puntuaciones de rúbrica descritas arriba — nada se vuelve a puntuar para el perfil.
Puntuación media de calidad
La media de las puntuaciones de calidad de 0–100 de las prácticas evaluadas del lugar, usando exactamente la aritmética de la parte superior de esta página. Una media de 80 significa que las prácticas del lugar cumplen, de media, el 80% de los criterios de evaluación de sus rúbricas. La misma puntuación de 0–100 aparece junto a cada práctica en «Mejores buenas prácticas aquí».
Proporción de evidencia sólida
La proporción de prácticas evaluadas cuyo diseño de estudio se sitúa en los niveles superiores de la escalera de evidencia de abajo. Las prácticas aún no evaluadas en cuanto a la solidez de la evidencia quedan fuera del denominador — un diseño desconocido no se trata como evidencia débil.
Fortalezas, debilidades y el perfil de puntuación (puntos)
Cada dimensión de evaluación se reescala primero al rango común de 0–100, para que rúbricas distintas sean comparables. Después comparamos la media del lugar en cada dimensión con la media de todos los lugares evaluados: “+29 pts” significa que el lugar está, de media, 29 puntos por encima de esa referencia en la dimensión. Las diferencias menores de ±8 puntos se tratan como ruido y no cuentan ni como fortaleza ni como debilidad. Las barras emparejadas del perfil de puntuación muestran las mismas dos medias lado a lado.
Encaje, en las prácticas recomendadas
El encaje es una estimación de 0–100 de en qué medida una práctica de otro lugar se ajusta a este, combinando transferibilidad, correspondencia de contexto, coste y plazos, solidez de la evidencia y — cuando está disponible — similitud semántica. La lista está ordenada para favorecer prácticas que además abordan las dimensiones débiles del lugar; esa preferencia nunca cambia el encaje mostrado, se indica como línea de motivo (“Aborda las dimensiones débiles de este lugar”).
Adopciones en otros lugares
Un recuento de casos documentados en los que una práctica nacida en este lugar fue adoptada o replicada en otro sitio, a partir de los registros de adopción mostrados en la página de cada práctica.
Dimensiones evaluadas, por catálogo
AI in Education
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Evidence of learning impact | 0–3 | 1 |
| Equity & inclusion | 0–3 | 1 |
| Transparency, ethics & data protection | 0–3 | 1 |
| Teacher capability & pedagogy | 0–3 | 1 |
| Scalability & sustainability | 0–3 | 1 |
AI in the Public Sector
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Evidence of impact / measured public value | 0–3 | 1 |
| Transparency, fairness & accountability | 0–3 | 1 |
| Transferability / demonstrated replication | 0–3 | 1 |
| Scalability beyond pilot | 0–3 | 1 |
| Governance, capability & sustainability | 0–3 | 1 |
City Innovation Library
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Evidence of impact / measured results | 0–3 | 1 |
| Transferability / demonstrated replication | 0–3 | 1 |
| Scalability | 0–3 | 1 |
| Sustainability / continuity | 0–3 | 1 |
| Innovation | 0–3 | 1 |
| Inclusiveness / equity | 0–3 | 1 |
| Multi-stakeholder collaboration | 0–3 | 1 |
Digital Inclusion
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Innovation level | 0–5 | 1 |
| Sustainability (ongoing) | 0–1 | 1 |
| Evaluation evidence | 0–1 | 1 |
| Demonstrated reach | 0–1 | 1 |
| Documented learning | 0–1 | 1 |
Digital Inclusion
Evaluado por MEDICI consortium
| Dimensión | Escala | Peso |
|---|---|---|
| Innovation level | 0–5 | 1 |
| Sustainability (ongoing) | 0–1 | 1 |
| Evaluation evidence | 0–1 | 1 |
| Demonstrated reach | 0–1 | 1 |
| Documented learning | 0–1 | 1 |
Gender Equality
Evaluado por ProPEGE consortium (Equal Leadership)
| Dimensión | Escala | Peso |
|---|---|---|
| Transferability / replicability | 0–3 | 1 |
| Impact on gender equality | 0–1 | 1 |
| Effectiveness | 0–1 | 1 |
| Efficiency | 0–1 | 1 |
| Evaluated outcomes | 0–1 | 1 |
| Sustainability | 0–1 | 1 |
| Achievement / evidence | 0–1 | 1 |
| Gender-mainstreaming embedding | 0–1 | 1 |
| Curator validation | 0–1 | 1 |
Gender Equality
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Transferability / replicability | 0–3 | 1 |
| Impact on gender equality | 0–1 | 1 |
| Effectiveness | 0–1 | 1 |
| Efficiency | 0–1 | 1 |
| Evaluated outcomes | 0–1 | 1 |
| Sustainability | 0–1 | 1 |
| Achievement / evidence | 0–1 | 1 |
| Gender-mainstreaming embedding | 0–1 | 1 |
| Curator validation | 0–1 | 1 |
PES & Nature-Based Solutions
Evaluado por C-NAPSE
| Dimensión | Escala | Peso |
|---|---|---|
| Carbon — sequestration / storage, evidenced | 0–3 | 1 |
| Biodiversity — conservation / improvement, evidenced | 0–3 | 1 |
| Water & soil — retention, infiltration, erosion control | 0–3 | 1 |
| Fire resilience — risk reduction, evidenced | 0–3 | 1 |
| Governance, certification & transferability | 0–3 | 1 |
Una columna vertebral canónica, muchas fuentes
El método de rúbrica anterior es la columna vertebral canónica de todas las puntuaciones de esta plataforma. Varios catálogos nacieron de la importación de colecciones de prácticas creadas por proyectos y consorcios anteriores (por ejemplo, ProPEGE para la igualdad de género, MEDICI para la inclusión digital). Sus evaluaciones originales se respetan como priores atribuidos: cuando un consorcio de origen evaluó una práctica, esa evaluación alimenta las dimensiones correspondientes de la rúbrica y la fuente se acredita en la página de la práctica — pero las dimensiones, la aritmética y la puntuación publicada son siempre de Evidoria. El origen de un contenido nunca decide cómo se organiza o clasifica: la procedencia es metainformación, registrada por registro — nunca estructura.
Niveles de validación
Cada página de práctica muestra cómo se produjo y verificó el registro. La escala, de más a menos validado:
- Evaluada por experto — un evaluador identificado completó la rúbrica del catálogo para esta práctica.
- Revisada por curador — un curador revisó el contenido del registro.
- Enriquecida por IA, pendiente de revisión — el contenido estructurado fue añadido por la rutina de IA sin clave y espera la revisión de un curador.
- Importada — importada de un catálogo de origen; contenido tal como lo publicó la fuente.
- Añadida por editor — creada directamente por un editor y aún sin revisión separada.
Cómo se corresponde nuestra escala de evidencia con otros estándares
Evidoria clasifica la evidencia de cada práctica por diseño de estudio. La tabla siguiente hace corresponder esa escalera con tres marcos ampliamente utilizados por las unidades what-works: la Maryland Scientific Methods Scale, los Standards of Evidence de Nesta y EMMIE. Las correspondencias son indicativas (un estudio concreto puede situarse más arriba o más abajo), y EMMIE es multidimensional: solo su dimensión Effect se corresponde con una escalera de diseño; sus lecturas Mechanism, Moderators, Implementation y Economics se corresponden con el dossier de implementación de cada página de práctica.
| Fuerza de evidencia Evidoria | Maryland SMS | Nesta | EMMIE |
|---|---|---|---|
| Ensayo controlado aleatorizado | Level 5 — randomised assignment to treatment and control | Level 3–4 — causal impact demonstrated; 4 where independently replicated | Strong Effect evidence — direct estimate of impact with a credible counterfactual |
| Cuasiexperimental | Level 3–4 — comparison group without full randomisation | Level 3 — causal comparison against a control or matched group | Moderate-to-strong Effect evidence — counterfactual present, selection risks remain |
| Observacional / pre-post | Level 2 — before/after measures without a comparison group | Level 2 — data showing change among recipients | Weak Effect evidence — change observed, attribution not established |
| Descriptivo / autodeclarado | Level 1 — correlation or descriptive account only | Level 1–2 — a logical account of impact, possibly with descriptive data | No Effect estimate — EMMIE's Mechanism/Implementation reading may still apply |
De dónde provienen los datos
Cada práctica enumera sus fuentes de datos — el catálogo o el sitio web del que se obtuvo cada dato — junto con la fecha en que se consultó. Las encontrará en la página de cada práctica, en «Fuentes de datos».