Logo image
結合韻律與頻譜資訊的語言辨認
Thesis

結合韻律與頻譜資訊的語言辨認

劉賾暵
Masters, National Tsing Hua University
2008

Abstract

自動化語言辨認韻律資訊頻譜資訊虛擬音節序列核函數支持向量機語言相關權重計算 automatic language identificationrhythmic informationspectral informationpseudo syllablesequence kernelsupport vector machinelanguage dependent weighting
由於交通科技的發達使得國與國之間的距離越來越縮短,人類的生活圈擴大至世界各地,產生了一些因為語言不同所造成的問題。以緊急事件的求救電話為例,就很有可能因為接線員不能快速的了解求救人的語言而造成悲劇的產生。然而一個人所能了解的語言有限,若我們能夠先用機器辨認出求救人的語言,再轉至同語言的服務人員便能減少悲劇的發生。 本論文研究主要處理的問題為不需要語音標記的自動化語言辨認,藉由結合韻律資訊與頻譜資訊的方法,提高語言辨識的效果。韻律系統擷取,以虛擬音節長度結合二連文法的方式來建立語言模型。頻譜系統擷取位移差分化倒頻譜係數,利用序列核函數的支持向量機分類器建立模型。後端處理的部分,使用語言相關權重計算方法,將兩個系統的輸出作結合,使得不同語言模型以及不同系統之間能夠有更柔性的計算方式。 實驗部分以不同長度的句子來比較。單使用韻律系統時,長句辨識率為89%、中句辨識率為59%、短句辨識率為35%。單使用頻譜系統時,長句辨識率為96%、中句辨識率為88%、短句辨識率為59%。經過後端處理結合後,長句辨識率為100%,比單使用頻譜系統改善了4%,中句辨識率為94%,也有6%的成長,在短句的部分則為62%,比起未結合前改善了3%。本論文所提出的方法,對於不需要標記語料的自動化語言辨認,在中長句子上都有很好的表現。利用語言相關權重計算來結合韻律與頻譜的資訊,也確實能夠在辨識率上有所提升。

Metrics

1 Record Views

Details

Logo image