Logo image
國語語音訊號中鼻音偵測之研究
Thesis

國語語音訊號中鼻音偵測之研究

林怡君
Masters, National Tsing Hua University
2004

Abstract

鼻音偵測語音辨認 nasaldetectionspeech recognition
新一代語音辨認技術,將以多組特徵參數取代僅以一組特徵參數為辨認的基礎。在國語語音中,聲母可以依各種發音方法與發音部位區分,韻母可以口腔形狀區分,鼻音為可區分不同聲母與韻母的特性之一;若各種發音方法、發音部位、口腔形狀皆一組或多組特徵參數表示,於是所有國語語音可建立多組特徵參數表示。 在以共振峰模型作語音合成的實驗中,鼻音效果可以用一對共振器-反共振器來模擬,有鼻音時,共振頻率與反共振頻率錯開,反共振效果產生鼻音現象,而錯開的方式決定了不同的鼻音,也使得鼻音高頻音能量降低,能量集中在低頻,在200~400Hz有一共振峰存在,此外,鼻音的頻率特性穩定,也是用以偵測鼻音存在的依據。本論文將利用這些特性建立鼻音模型,用以偵測鼻音。 本論文使用Seneff聽覺模型,取其包絡線響應,切割連續語音為多段語音音段,再以同步響應,對每一音段萃取鼻音特徵參數,使用高斯混合模型作鼻音偵測。實驗包含較是否將200~400Hz由200~ 4000Hz獨立為一個頻帶、鼻音聲母與韻母分開訓練模型,以不同鼻音特徵參數,對鼻音偵測的影響。實驗結果,以各頻帶同步響應值和之平均值及語音音段中點與起點、終點與中點同步響應值差之平均值為鼻音特徵參數,最佳正確率可達82%。

Metrics

1 Record Views

Details

Logo image