Logo image
雜訊刪減與有聲語音訊號重建之研究
Thesis

雜訊刪減與有聲語音訊號重建之研究

杜宗憲
Masters, National Tsing Hua University
2009

Abstract

語音增強弦波模型 speech enhancementharmonic model
生活中的一些應用,例如行動手機、聽障者的助聽系統、自動語音辨識(ASR)系統等,都會有環境雜訊干擾的問題,必須克服雜訊的干擾,讓聽者可以聽到品質較好的語音或是改善系統的辨識率。一般的單一通道語音增強技術,需要先做雜訊的預估,接著再計算頻譜增益函數用以抑制語音中含有的雜訊。本文提出一個兩階段的單通道語音增強方法,第一階段以短時間頻譜大小預估(STSA estimation, Short-Time Spectral Amplitude estimaion)為基礎來處理,第二階段以弦波模型重估有聲語音訊號,增強其諧振成份,抑制諧振間的雜訊。針對最小控制遞迴平均(MCRA, Minima Controlled Recursive Averaging)雜訊預估對於語音存在與否的偵測,提出改善的方式,使得偵測的結果較為清楚,進一步改善雜訊的預估。直接決定法(Decision-Directed)預估事先訊噪比時,將平滑常數改為隨著音框而改變,以達到反應頻譜的變化。弦波模型法則是將第一階段增強後的有聲語音訊號,進一步增強其諧振成分,改善語音的品質。實驗的結果使用分段訊噪比改進和語音品質感知評估(PESQ)作評量,本文提出的語音增強方式作各階段的比較,結果顯示二階段語音增強方式有再一次改善語音品質感知評估的效果,但在聽覺上的改善比較不明顯。

Metrics

1 Record Views

Details

Logo image