Abstract
隨著世界化的潮流驅勢,不同人種共同生活的機會越來越高,隨之而來的問題便是語言之間的差異。各式自動化的服務諸如飯店的訂房、機票的預訂、車票的訂購、以及醫院的掛號等等,都面臨到多國語言使用者的考驗。本篇論文的研究重點在於尋找出不需要標註資料的自動化語言辨認法,主要建立於高斯混合模型表徵器,以及語言模型兩種基本模型上,加上切割處理以及後端處理的輔助,處理語音資料的語言辨認工作。主要系統架構分別為串聯高斯混合模型表徵器和語言模型的 “高斯混合模型表徵器-語言模型法” ,以及將語言模型融合在表徵器裡面的 “連結聲學-語言模型法” 兩種型式。根據實驗結果發現,對於 “高斯混合模型表徵器-語言模型法”,在特徵參數的選用上,以38階梅爾刻度式倒頻譜參數表現最為理想 ; 表徵器的個數選擇上則是多表徵器的表現比起單一表徵器來得好 ; 後端處理器的選用以算術平均法的表現最為理想。對於 “連結聲學-語言模型法”,經過切割處理的語料,在表徵器混合數128時,便能夠有和混合數256時差不多的高辨認率,顯示加入切割處理的幫助,系統的混合數能夠大幅度的降低。由於 “連結聲學-語言模型法” 是根據模型的聲學相似度來做為辨認的依據,可能會有某些語言相似度偏高的狀況發生,實驗中也加入了偏差值的考量。由實驗結果觀察,加入切割處理的幫助,能夠提升系統的辨認效能。在3國以及11國語言的辨認上,以 “高斯混合模型表徵器-語言模型法” 表現較好 ; 對於 6 國語言的辨認,則是去除偏差值的 ”連結聲學-語言模型法” 表現較好。