High bulk filler
Additives for Polymers · 1990
This paper presents an overview of Japanese research on individuality information in speech waves, which have been performed from various points of view. Whereas physical correlates having perceptual voice individuality have been investigated from the psychological viewpoint, research from the engineering viewpoint is related to automatic speaker recognition, speaker-independent speech recognition, and training algorithms in speech recognition.Speaker recognition research can be classified into two classes, depending on whether or not the text is predetermined. However, it has been made clear that even if the text is not predetermined, text-dependent individual information can be used that is based on explicit or implicit phoneme recognition. Various examples of speaker recognition methods are classified into these variations, and their performances are presented in this paper. In particular, this paper focuses on the long-term intra-speaker variability of feature parameters as on the most crucial problems in speaker recognition.Additionally, it presents an investigation into methods for reducing the effects of long-term spectral variability on recognition accuracy.Der folgende Artikel bietet einen Überblick über die Arbeiten in Japan welche sich mit der sprecherspezifischen Information im Sprachsignal befassen. Die Wechselbeziehung zwischen physikalishen Merkmalen und der wahrgenommenen Individualität der Stimme is vom psychologischen Standpunkt aus untersucht worden. Wohingegen, die technischen Wissenschaften sich mehr für die automatische Sprechererkennung, für die automatische sprecherunabhängige Spracherkennung, sowie für das automatische Präparieren von Spracherkennungssystemen anhand von Prototypen interessiert haben.Die Arbeiten über die Sprechererkennung als solche können in zwei Klassen eingeteilt werden, abhängig davon ob der Text fixiert ist oder nicht. Es ist nachgewiesen worden, anhand von ausdrücklicher oder impliziter Phonemerkennung, dass auch wenn der Text nicht vorherbestimmt ist, textabhängige Sprecherinformation nutzbar ist. Verschiedene Beispiele von Sprechererkennungsmethoden werden in diesem Beitrag vorgestellt. Im besonderen wird das Problem der sprecherspezifischen Laugzeitvariabilität der akustischen Merkmale hervorgehoben. Dieses Problem muss als eines der kritischsten im Rahmen der Sprechererkennung bezeichnet werden.Dieser Beitrag stellt eine Untersuchung an über Methoden welche es erlauben die Auswirkungen der langzeitvariabilität spektraler Grössen auf die Erkennungsgenauigkeit zu reduzieren.Cet article présente un aperçu des recherches entreprises au Japon, relatives à l'information individuelle véhiculée par l'onde de parole. Alors que les corrélats physiques des traits perceptifs de l'identité de la voix ont été étudiés du point de vue psychologique, la recherche menée du point de vue de l'ingénieur se rattache à la reconnaissance automatique du locuteur, à la reconnaissance de la parole indépendante du locuteur, et aux algorithmes d'apprentissage en reconnaissance de la parole.La recherche en reconnaissance du locuteur peut être cataloguée en deux classes, selon que le texte est prédéterminé ou non. Cependant, il a été mis en évidence que, même si le texte n'est pas prédéterminé, l'information individuelle dépendante du texte peut être utilisée et ce, sur base de la reconnaissance explicite ou implicite du phonème. Divers exemples de méthodes de reconnaissance du locuteur sont classées ici selon ces variantes et leurs performances sont présentées. En particulier, cet article éclaire la variabilité à long terme des paramètres intra-locuteur comme l'un des problèmes les plus cruciaux en reconnaissance du locuteur.En plus, cet article présente une étude des méthodes destinées à réduire les effets de la variabilité spectrale à long terme sur la précision de la reconnaissance.