Logo image
特定語者之連續語音辨認
Thesis

特定語者之連續語音辨認

譚旦旭
Masters, National Tsing Hua University
1987

Abstract

特定語者語者連續語音辨認語音辨認辨認國語
在本論文中我們提出一套國語連續語音辨認系統。這個系統依據語音能量及過零率將連續語音(句子)切割成一連串的詞(word)後,再加以辨認。辨認時採用樣型比對法(pattern match method),所利用的語音特徵為訊號的八階PARCOR係數。係認出來的詞再連結成完整的句子而成為辨認的結果。在語者平均發音速率(speaking rate) 為每分鐘180個音節的情況下,切割之正確率可達98%。在語者相關(speaker dependent) 之條件下,詞與句子的辨認率各為95%及73%。考慮到第三順位(htird cardidate) 時,辨認率可達97%及84%。(1)本研究提出了一個可靠的方法,能將連續語音精確地切割成為一串獨立詞,再加以辨認。由95%的詞辨認率可驗證此方法之精確性。(2)本研究提出一個算連續語音中抽取參考樣本的訓練方法(training method),實驗結果驗證,在連續語音的情況中,此種方式的效果遠勝於以獨立詞為參考樣本者。亦即,偶合效應(coarticulation effect) 已被有效地克服。(3)藉著限量分段平均法(finite section averaging method), 語音資料及處理時間己被大量地減少。實驗結果顯示在分段數(section number)為六的情況下,辨認效果最佳。

Metrics

1 Record Views

Details

Logo image