Abstract
在本篇論文中,作者提出並且完成一個新的由文句導引的動態時域展延階層建構連續語音辨認系統(Syntax directed dynamic time warping level-building connect-ed speech recognition system).本文中所提出的辨認方法,大略言之,是一個基於文句結構(Syntax)而成的動態時域展延(Dynamic time warping,DTW )辨認方法.由於文句結構的使用,使得搜尋最佳結果的計算複雜度大為降低,更重要的是,這樣的文法結構限制,較其他的各種限制合理,並且能夠提高辨認力.本文中使用了強健的線性預估編碼法(Robust linear prediction coding algorit-hm)抽取辨認的特微,因為對聲帶在發音上的特性有不同的發現,所以能夠得到較穩定的線性預估參數,而且在實驗中吾人亦可見其較優的辨認力.本文中的實驗可分為兩部份,一是連續數字(connected digits)的辨認,一是簡化的購票系統.吾人提出的辨認系統在連續數字的辨認上,字串的辨認錯誤率為百分之十五,數字的錯誤率則為百分之四點六四.對購票系統,句子的錯誤率為百分之十二,單字的錯誤率則為百分之二點二九,亦即有百分之九十七點七一的正確率.