evidoria

← Back to browse

Good practice

ELSA Speak — Entrenador de pronunciación por IA para aprendientes de inglés en Vietnam

Vietnam · Ho Chi Minh City · See the Vietnam profile

ELSA Speak usa ASR por aprendizaje profundo para dar a los aprendientes de inglés (EFL) retroalimentación fonémica en tiempo real, haciendo accesible el entrenamiento. Más de 50M de usuarios en 195 países; estudio PLOS ONE (2025) confirma mejoras en cohortes universitarias vietnamitas.

50 million+
Usuarios en todo el mundo (as of 2024)
195 countries
Países alcanzados (as of 2024)
77.3 %
Estudiantes que califican ELSA como eficaz o muy eficaz (one semester, 2024)
81.8 %
Estudiantes que reportan mayor confianza al hablar (2024)
ELSA Speak — Entrenador de pronunciación por IA para aprendientes de inglés en Vietnam

Details

Maturity
Established
Promoter
ELSA Corp
Period
2015–present
Keywords
ed-tech, language-learning, English-pronunciation, speech-recognition, EFL

Context

ELSA (English Language Speech Assistant) fue cofundada en Vietnam en 2015 para dar a los estudiantes de inglés como lengua extranjera (EFL) en Vietnam y en todo el Sur Global acceso a apoyo de pronunciación que de otro modo no podrían costear, utilizando reconocimiento automático de voz basado en aprendizaje profundo para detectar errores a nivel de fonema sin un profesor humano.

Objectives

La aplicación busca ofrecer retroalimentación personalizada de pronunciación en tiempo real, a nivel de fonema, con un coste y una escala que la tutoría de un hablante nativo no puede igualar. Varias instituciones de educación superior vietnamitas han incorporado formalmente ELSA en sus cursos de pronunciación de inglés, sustituyendo o complementando la tutoría individual, que resulta costosa.

Activities

Los usuarios graban frases en inglés en la aplicación, que aplica un sistema propietario de reconocimiento de voz para señalar errores de pronunciación a nivel de fonema y ofrecer retroalimentación instantánea y personalizada. La plataforma se ha expandido a 195 países y cuenta con más de 50 millones de usuarios; Vietnam ha sido históricamente su mayor mercado (80-90% de los primeros usuarios, alrededor del 20% en la actualidad a medida que la plataforma se ha globalizado).

Results

Un estudio revisado por pares publicado en PLOS ONE (enero de 2025, n=205 estudiantes de la carrera de inglés en una universidad vietnamita) registró una alta satisfacción autoinformada respecto a la utilidad percibida, la facilidad de uso y la mejora de la pronunciación. Un estudio pre-/post- en el Vien Dong College, en Ho Chi Minh (2024, n=63, un semestre) encontró que el 77,3% de los estudiantes calificó ELSA como eficaz o muy eficaz y el 81,8% reportó mayor confianza al hablar. Otro estudio en la IJIRSS documentó una alta motivación y participación entre los estudiantes vietnamitas de EFL.

Conclusions

La base de evidencia es consistente pero modesta: todos los estudios publicados se basan en satisfacción autoinformada y en muestras pequeñas y no aleatorizadas, sin ninguna medida de competencia estandarizada e independiente, y el modelo propietario de reconocimiento de voz no ha sido auditado de forma independiente en cuanto a precisión o sesgo. Los datos se rigen por la CCPA de EE. UU. y no por el RGPD ni por la legislación vietnamita, y la integración sistemática en la escolaridad formal —en lugar del autoaprendizaje— sigue siendo la excepción.

Implementation

Indicative cost
Low (< €50k) — Freemium consumer app; no institutional infrastructure investment required beyond course integration.
Time to results
Short (< 1 year) — Immediate to adopt (app download); institutional embedding into a course typically takes one semester.
Staffing & skills
No teacher or institutional staff required for the core app — it is fully self-service and teacher-free by design, Institutions that embed ELSA in courses do so through existing English-language faculty rather than dedicated staff

Conditions for success

  • Smartphone and internet access for learners
  • Institutional willingness to formally embed the app in pronunciation courses rather than leave it to self-study

Common failure modes

  • Proprietary ASR model has not been independently audited for accuracy or bias
  • Data governed under US CCPA rather than GDPR or Vietnamese data-protection law
  • Evidence relies on small, non-randomised, self-reported samples

Where it fits

Governance type
private company (direct-to-consumer/institutional app)
Scale
global (195 countries, 50M+ users), strongest adoption in Vietnam
Income level
aimed at Global South / lower-cost-access learners

Data sources

Where this practice's information was retrieved from, and when.

Attachments

Similar practices you may find useful