evidoria

← Volver al listado

Buena práctica Importada

Project Euphonia — Entrenar el Reconocimiento de Voz en Habla Atípica Mediante una Recogida de Datos Co-Diseñada

Estados Unidos · Mountain View · Ver el perfil de Estados Unidos · Ver el perfil de Mountain View

Evidencia: Observacional / pre-post Top 9% 96/100 · Pregunte a Evidence Copilot sobre esta práctica

Google Research entrena modelos de reconocimiento de voz para comprender el habla atípica (ELA/ENM, disartria, síndrome de Down, tartamudez) usando muestras donadas por personas con habla afectada, implicadas en la creación de prototipos y en el retorno a través de socios como Team Gleason y ALS/MND Alliance.

1.5 million
Enunciados recopilados (as of February 2025)
~3,000
Hablantes que contribuyeron al conjunto de datos (as of February 2025)
132
Hablantes adicionales reclutados a nivel internacional (2025 expansion)
Project Euphonia — Entrenar el Reconocimiento de Voz en Habla Atípica Mediante una Recogida de Datos Co-Diseñada

Detalles

Madurez
En expansión
Promotor
Google Research / Google.org
Período
2019-present
Palabras clave
AI research, speech accessibility, assistive technology

Contexto

Project Euphonia es una iniciativa de Google Research que entrena modelos de reconocimiento automático del habla (ASR) y de comunicación personalizada con patrones de habla atípicos, incluido el habla afectada por ELA/enfermedad de la neurona motora, disartria, síndrome de Down y tartamudez.

Objetivos

En lugar de crear un reconocedor único para todos, el proyecto busca desarrollar modelos de comunicación personalizados adaptados a cada hablante, reclutando a personas con habla afectada —a través de organizaciones asociadas como Team Gleason, la ALS/MND Alliance, LSVT Global y CureDuchenne— para donar muestras de voz y participar en las fases de ideación, creación de prototipos y retroalimentación.

Actividades

El proyecto se expandió internacionalmente, reclutando a 132 hablantes adicionales en cuatro idiomas (38 en español, 14 en francés, 76 en japonés, 4 en hindi) en México, Colombia, Perú, Francia, India y Japón, para comprobar si el modelo de reclutamiento y retroalimentación se traslada a contextos no anglófonos.

Resultados

Una evaluación revisada por pares, publicada en 2025 en Frontiers in Language Sciences, indica que, a fecha de febrero de 2025, el proyecto había recopilado más de 1,5 millones de enunciados de aproximadamente 3000 hablantes.

Conclusiones

El artículo es transparente respecto a las limitaciones: el reclutamiento produjo un conjunto de datos muy desequilibrado entre idiomas, la evaluación formal solo se completó para dos de los cuatro idiomas añadidos (francés y español), la evaluación en francés presentaba riesgo de sesgo por evaluador único, y los conjuntos de datos subyacentes no se publican, por motivos de privacidad, lo que limita la replicación independiente. Los propios materiales de Google describen la participación de los usuarios como abarcando la ideación, el diseño y la retroalimentación sobre prototipos, pero el relato revisado por pares es más preciso, y describe «alianzas estratégicas» que facilitaron el reclutamiento, en lugar de un proceso formal y documentado de gobernanza de codiseño.

Implementación

Coste indicativo
Medio (50 000–500 000 €)
Tiempo hasta resultados
Largo (> 3 años) — Running continuously since 2019; a 2025 paper documents a subsequent international pilot expansion.
Personal y competencias
Google Research / Google.org, Partner organisations: Team Gleason, ALS/MND Alliance, LSVT Global, CureDuchenne, Volunteer speakers with atypical speech

Condiciones para el éxito

  • Partnerships with disability and patient organisations to reach willing speech donors
  • Privacy-preserving data collection given sensitive health-related speech data
  • International recruitment partners to test cross-language transfer

Modos de fallo comunes

  • Recruitment produced a heavily imbalanced dataset across languages
  • Formal evaluation completed for only two of the four added languages (French and Spanish)
  • French evaluation carried single-rater bias risk
  • Underlying datasets not published, for privacy reasons, limiting independent replication
  • Participant involvement described by Google as spanning ideation/design/feedback, but the peer-reviewed account describes only 'strategic partnerships' facilitating recruitment rather than a documented formal co-design governance process

Habitualmente financiado por

Own resources / municipal budget

Vías de financiación indicativas para prácticas de este tipo: compruebe siempre las convocatorias vigentes y las reglas de elegibilidad de cada programa.

¿Usted implementa esta práctica? Reivindíquela — los implementadores verificados obtienen un contacto público en la página y pueden proponer correcciones.

Fuentes de datos

De dónde se obtuvo la información de esta práctica, y cuándo.

Adjuntos

Prácticas similares que pueden serle útiles