Reconnaissance automatique du locuteur par des GMM à grande marge

Jourani, Reda

Reconnaissance automatique du locuteur par des GMM à grande marge

fr

Authors

Jourani, Reda

Collections

Faculté des Sciences - Rabat

Publisher

Université Mohammed V - Agdal, Faculté des Sciences, Rabat

URI

https://toubkal.imist.ma/handle/123456789/13148
https://doi.org/10.83129/toubkal-14420

Date

2012-09-06

Abstract

Depuis plusieurs dizaines d'années, la reconnaissance automatique du locuteur (RAL) fait l'objet de travaux de recherche entrepris par de nombreuses équipes dans le monde. La majorité des systèmes actuels sont basés sur l'utilisation des Modèles de Mélange de lois Gaussiennes (GMM) et/ou des modèles discriminants SVM, i.e., les machines à vecteurs de support. Nos travaux ont pour objectif général la proposition d'utiliser de nouveaux modèles GMM à grande marge pour la RAL qui soient une alternative aux modèles GMM génératifs classiques et l'approche discriminante état de l'art GMM-SVM. Nous appelons ces modèles LM-dGMM pour Large Margin diagonal GMM. Nos modèles reposent sur une récente technique discriminante pour la séparation multi-classes, qui a été appliquée en reconnaissance de la parole. Exploitant les propriétés des systèmes GMM utilisés en RAL, nous présentons dans cette thèse des variantes d'algorithmes d'apprentissage discriminant des GMM minimisant une fonction de perte à grande marge. Des tests effectués sur les tâches de reconnaissance du locuteur de la campagne d'évaluation NIST-SRE 2006 démontrent l'intérêt de ces modèles en reconnaissance

Keywords

Reconnaissance automatiqueSciences de l'Ingénieur, Informatique, Télécommunications, Loi Gaussienne, Reconnaissance du locuteur

Full item page

Reconnaissance automatique du locuteur par des GMM à grande marge

Authors

Collections

Journal Title

Journal ISSN

Volume Title

Publisher

Department

Supervisor

URI

Date

Abstract

Description

Keywords

Citation

Endorsement

Review

Supplemented By

Referenced By