evidoria

← Retour à la liste

Bonne pratique Importée

Project Euphonia — Entraîner la Reconnaissance Vocale sur des Paroles Atypiques par une Collecte de Données Co-Conçue

États-Unis d'Amérique · Mountain View · Voir le profil de États-Unis d'Amérique · Voir le profil de Mountain View

Preuves: Observationnel / avant-après Top 9% 96/100 · Demandez à Evidence Copilot à propos de cette pratique

Google Research entraîne des modèles de reconnaissance vocale à comprendre une parole atypique (SLA/MND, dysarthrie, trisomie 21, bégaiement) à l'aide d'échantillons donnés par des personnes ayant une parole affectée, impliquées dans le prototypage et les retours via des partenaires comme Team Gleason et l'ALS/MND Alliance.

1.5 million
Énoncés recueillis (as of February 2025)
~3,000
Locuteurs ayant contribué au jeu de données (as of February 2025)
132
Locuteurs supplémentaires recrutés à l'international (2025 expansion)
Project Euphonia — Entraîner la Reconnaissance Vocale sur des Paroles Atypiques par une Collecte de Données Co-Conçue

Détails

Maturité
En expansion
Promoteur
Google Research / Google.org
Période
2019-present
Mots-clés
AI research, speech accessibility, assistive technology

Contexte

Project Euphonia est une initiative de Google Research qui entraîne des modèles de reconnaissance automatique de la parole (RAP) et de communication personnalisée sur des schémas de parole atypiques, notamment la parole affectée par la SLA/maladie du motoneurone, la dysarthrie, le syndrome de Down et le bégaiement.

Objectifs

Plutôt que de créer un système de reconnaissance universel, le projet vise à développer des modèles de communication personnalisés adaptés à chaque locuteur, en recrutant des personnes ayant une parole altérée — via des organisations partenaires telles que Team Gleason, l'ALS/MND Alliance, LSVT Global et CureDuchenne — pour faire don d'échantillons de parole et participer aux phases d'idéation, de prototypage et de retour d'expérience.

Activités

Le projet s'est étendu à l'international, recrutant 132 locuteurs supplémentaires dans quatre langues (38 en espagnol, 14 en français, 76 en japonais, 4 en hindi) au Mexique, en Colombie, au Pérou, en France, en Inde et au Japon, afin de tester si le modèle de recrutement et de retour d'expérience se transpose en dehors des contextes anglophones.

Résultats

Une évaluation évaluée par des pairs, publiée en 2025 dans Frontiers in Language Sciences, indique qu'en février 2025, le projet avait recueilli plus de 1,5 million d'énoncés auprès d'environ 3 000 locuteurs.

Conclusions

L'article est transparent sur les limites : le recrutement a produit un jeu de données fortement déséquilibré entre les langues, l'évaluation formelle n'a été menée à bien que pour deux des quatre langues ajoutées (français et espagnol), l'évaluation en français comportait un risque de biais lié à un évaluateur unique, et les jeux de données sous-jacents ne sont pas publiés, pour des raisons de confidentialité, ce qui limite la reproductibilité indépendante. Les documents de Google décrivent l'implication des participants comme couvrant l'idéation, la conception et le retour sur prototypes, mais le compte rendu évalué par des pairs est plus précis, décrivant des « partenariats stratégiques » ayant facilité le recrutement plutôt qu'un processus formel et documenté de gouvernance en co-conception.

Mise en œuvre

Coût indicatif
Moyen (50 k€–500 k€)
Délai jusqu’aux résultats
Long (> 3 ans) — Running continuously since 2019; a 2025 paper documents a subsequent international pilot expansion.
Personnel et compétences
Google Research / Google.org, Partner organisations: Team Gleason, ALS/MND Alliance, LSVT Global, CureDuchenne, Volunteer speakers with atypical speech

Conditions de réussite

  • Partnerships with disability and patient organisations to reach willing speech donors
  • Privacy-preserving data collection given sensitive health-related speech data
  • International recruitment partners to test cross-language transfer

Modes d’échec courants

  • Recruitment produced a heavily imbalanced dataset across languages
  • Formal evaluation completed for only two of the four added languages (French and Spanish)
  • French evaluation carried single-rater bias risk
  • Underlying datasets not published, for privacy reasons, limiting independent replication
  • Participant involvement described by Google as spanning ideation/design/feedback, but the peer-reviewed account describes only 'strategic partnerships' facilitating recruitment rather than a documented formal co-design governance process

Habituellement financé par

Own resources / municipal budget

Pistes de financement indicatives pour des pratiques de ce type — vérifiez toujours les appels en cours et les règles d'éligibilité de chaque programme.

Vous portez cette pratique ? Revendiquez-la — les porteurs vérifiés obtiennent un contact public sur la page et peuvent proposer des corrections.

Sources de données

D'où proviennent les informations de cette pratique, et quand.

Pièces jointes

Pratiques similaires qui pourraient vous être utiles