Abstract
在語音辨識領域中,國語數字辨認(Mandarin Digit Speech Recognition,簡寫為MDSR)為一些特定應用場合(例如:行動通訊系統的語音聲控撥號、電子商務交易及電話證卷交易等應用範圍)中所必須具備的一項語音訊號處理技術。國語數字辨認的識別對象是“零”-“玖”十個非特定人的國語數字語音,其處理方式較連續語句辨認簡單。本論文研究主要方向是利用模擬工具套件來模擬現行市面上既有的數位信號處理器(DSP,Digit Signal Processor)晶片所運用的定點數(Fixed-point)演算法在個人電腦(Personal Computer)上進行國語數字辨認的實驗。由於DSP具有體積小,功耗低的特點,同時國語數字辨認系統的硬體部份在現階段大部份採單晶片DSP(single chip Digit Signal Processor)上或在單晶片ASIC上實現。若要使用DSP來實現MDSR,則只有運用定點式DSP才能夠達到成本降低的要求。另外由於定點DSP具有運算資源和存儲資源有限的特點,所以識別系統演算法在定點DSP上實現時,其演算法流程和與處理各系統區塊的實現過程都與基於個人電腦上的國語數字辨認系統有較大差別。本文主要討論國語數字辨認系統在定點DSP上實現時演算法流程的改進以及對MDSR系統的特徵提取及向量量化、端點檢測和HMM識別這幾個主要區塊在定點DSP上的實現作詳細介紹,並藉由實驗結果來找出最適合DSP晶片的演算法,以便作為硬體設計之參考。