Logo image
以循序機率比值檢測作語者確認之研究
Thesis

以循序機率比值檢測作語者確認之研究

李彥農
Masters, National Tsing Hua University
2006

Abstract

語者確認循序機率比值檢定特徵參數正規化分數正規化 Speaker verificationSequential probability ratio testFeature normalizationScore normalization
文字不特定(Text-independent)之語者確認(Speaker verification)乃是語音處理中重要的研究項目之一。然而,現今語者確認系統多數是要求使用者唸完一段文字並錄音後,再對這段語音做語者確認的判斷,使用者必須在錄完音的最後才能得知系統判斷的結果。本論文之目的在於設計一個可以在使用者錄音的同時做判斷的語者確認系統,導入循序機率比值檢定(Sequential probability ratio test, SPRT)的檢定法,使系統能在語音長度足以判斷時,即刻顯示出語者確認的結果,而不需要使用者必須錄完整段語句後才能做判斷,以此增加使用者在操作系統時的效率。這篇論文設計之SPRT語者確認系統,以GMM-UBM為基礎之語者確認做為設計平台,設計過程加入了可增加使用彈性之簡易效能調整法,讓SPRT語者確認系統可應用在不同的情況下,例如建構高安全性之身分認證系統。之後並在SPRT語者確認系統下嘗試納入數種近年來使用廣泛且具代表性之特徵參數正規化與分數正規化法,以期在這些新技術的加持下,可增加語者確認系統對使用環境變異的強健性,最後以NIST 2002 one-speaker detection task效能評估平台來對上述系統做相關之實驗。實驗結果顯示出SPRT語者確認系統可在平均音框數相同之情況下,比原始系統達到更佳的效能,並驗證在不同之特徵參數正規化與分數正規化方法的結合下,SPRT語者確認系統仍能保留這些正規化法之特性。

Metrics

1 Record Views

Details

Logo image