Desarrollan académicos repositorio orientado al estudio de la lengua Yuhmu

Puebla, Pue.- Con el firme propósito de contribuir a la preservación del patrimonio lingüístico de México y poner la tecnología al servicio de las comunidades originarias, académicos e investigadores desarrollaron el proyecto ZETZOHO-YUHMU. SPEECH DATASET, un repositorio digital pionero diseñado para el estudio, documentación y enseñanza de la lengua Yuhmu, variante del otomí que se encuentra en peligro de extinción.
El proyecto es liderado por Arturo Olvera López e Iván Olmos Pineda, catedráticos e investigadores de la Facultad de Ciencias de la Computación de la Benemérita Universidad Autónoma de Puebla (BUAP), en colaboración con Eric Ramos-Aguilar, Ricardo Ramos-Aguilar y Daniel Sánchez-Ruiz, especialistas de la Unidad Profesional Interdisciplinaria de Ingeniería del Instituto Politécnico Nacional, campus Tlaxcala (UPIIT-IPN).
Tecnología para la preservación lingüística
El conjunto de datos comprende una base estructurada para impulsar la investigación en reconocimiento automático del habla (ASR, por sus siglas en inglés) y el análisis de la pronunciación en escenarios caracterizados por la escasez de datos lingüísticos.
Esta herramienta tecnológica sienta las bases para crear sistemas de retroalimentación en el aprendizaje del idioma, así como para fortalecer los esfuerzos de conservación de lenguas indígenas que cuentan con muy pocos recursos documentados.
Al respecto, el Dr. Arturo Olvera López destacó el alcance social e investigativo de esta plataforma:
“El repositorio es de libre acceso y puede ser de mucha utilidad para la comunidad que hace investigación relacionada al procesamiento del lenguaje natural considerando lenguas indígenas en México que actualmente están poco representadas respecto a la cantidad de personas hablantes de la lengua.”
Un recurso abierto para la ciencia y la cultura
| Aspecto Clave | Descripción |
| Proyecto | ZETZOHO-YUHMU. SPEECH DATASET |
| Objeto de estudio | Lengua Yuhmu (variante del otomí) |
| Instituciones participantes | BUAP (Facultad de Ciencias de la Computación) y UPIIT-IPN Campus Tlaxcala |
| Aplicaciones | Procesamiento del Lenguaje Natural (PLN), Reconocimiento Automático del Habla (ASR) y evaluación de la pronunciación |
| Acceso | Libre y público bajo la denominación Conjunto de datos de voz de Zetzoho-Yuhmu |
Con esta colaboración interinstitucional entre la BUAP y el IPN Tlaxcala, la comunidad científica suma un valioso recurso de procesamiento del lenguaje natural para asegurar que la riqueza cultural y oral de la lengua Yuhmu no desaparezca ante la brecha digital.