Passer à la navigation principale Passer à la recherche Passer au contenu principal

A robust tongue shape model for ultrasound recordings of normal and impaired speech

Traduction de l'intitulé de la thèse: Un modèle de forme de langue robuste à partir d’enregistrements ultrasons de la parole normale et altérée
  • Sahba Changizi

Thèses et mémoires: Mémoire de maîtriseMaîtrise en ingénierie: Génie

Résumé

L’imagerie par ultrasons est un outil utile pour observer les mouvements de la langue en interférant minimalement avec la parole naturelle. Il existe une variété de modèles pour quantifier la forme de la langue à partir de contours extraits d’images échographiques. Cependant, ceux-ci peuvent être affectés par une mauvaise qualité d’image, par exemple, lorsque des parties de la langue manquent sur les images en raison d’artefacts d’imagerie. Dans cette étude, nous étudions les effets de diverses erreurs d’extraction de contour sur la précision et la cohérence de différentes mesures de forme. Nous avons développé des modèles de perturbation de contour exponentiels et polynomiaux, puis simulé la pointe et la racine de la langue manquantes, et étudié l’impact de ces perturbations sur les mesures de forme basées sur la transformée de Fourier discrète (DFT), l’indice de courbure modifié (MCI) et l’ajustement triangulaire. Ceci a été appliqué à un ensemble d’énoncés CV collectés auprès de locuteurs sains et déficients. Les résultats démontrent l’efficacité de la DFT et de l’ajustement triangulaire dans le regroupement de différents phonèmes malgré le bruit ajouté. Il existe également un compromis entre la robustesse du modèle et la sensibilité aux différences réelles mineures dans la forme de la langue. Parfois, ces légères différences aident à regrouper les formes de langue qui diffèrent, par exemple en raison d’effets de coarticulation. Par conséquent, nous avons tenté d’améliorer la précision du modèle DFT en ajoutant des informations de contact palatal. Notre expérience montre que le nouveau modèle de forme est robuste au bruit et peut classer avec succès les énoncés CV et augmenter le score de classification de 23% pour les locuteurs qui ont des troubles de la parole.
Date11 juil. 2022
langue originaleAnglais américain
Établissement diplômant
  • École de technologie supérieure
SuperviseurCatherine Laporte (Directeur(-trice)) & Lucie Ménard (Codirecteur(-trice))

Mots-clés

  • quantification de la forme de la langue
  • ultrason
  • modélisation robuste de la forme de la langue

Citer cette ressource

'