Logo image
國語語音資料庫之標音系統
Thesis

國語語音資料庫之標音系統

莊向凱
Masters, 國立清華大學, 電機工程學系
1998

Abstract

標音 Labeling
所謂標音即是一個將語句中相對應於某音標之位置標示出來的過程。在面對大量語料時,為了省去大量的人力資源及時間來進行人工標音的程序,我們需要一個有效的自動標音或半自動標音方法。而標音方法之基礎是建築在切音,到目前為止,已有許多的切音方法被陸陸續續地提出來。典型的切音方式是藉由語音參數(例如:能量,基頻,與頻譜)來偵測出語音單位的邊界。一旦邊界被偵測出後,相對應的音標即標示在每個語音單位上。對於標音系統而言,偵測出語音單位的邊界與對照音標的過程是有點類似語音辨識的過程。 在本篇論文中,我們提出了一個針對MAT語音資料庫進行自動標音的方法。在這套方法中,將會標示出語句中之音節邊界,及其相對應的音標。每個音節可分成兩個次音節部份:聲母及韻母。而這些次音節可表成隱藏式馬可夫模型。標音的程序是藉由維特比解碼過程(Viterbi decoding processing )來完成的,並自動判斷標音之正確性。經使用部分的語料來進行人工標音,所得之結果與自動標音之結果相互對照,發現誤差在16ms內者接近90%,在32ms內者有93~94%。經實驗結果顯示,平均需要人工加以修正標音資料之音節數只佔所有音節之 1/10,故本論文所提出之方法不失為一有效,可靠並可節省大量的人力資源之方法。同時我們也建立起這套系統之視窗介面,可以在Window95、Window98的環境下進行操作,來修正自動標音之誤差。

Metrics

1 Record Views

Details

Logo image