Logo image
MPEG編碼上視像物件的壓縮技術研究
Thesis

MPEG編碼上視像物件的壓縮技術研究

林翔祺
Masters, National Tsing Hua University
1997

Abstract

動量預估外型可調式分散式餘弦轉換外型編碼視像物件 motion estimationshape adaptive DCTshape codingvideo object plane
由於網路的普及,許多的資料經由網際網路傳輸,網路多媒體的興起,區域網路的流行,也使得影像與聲音的傳輸,資料量也越來越大。但是由於頻寬的限制,所以如何能在有限頻寬的限制下,將大量的資料壓縮成少量資料的技術更形重要。1990年代制定了所謂的MPEG-X與H.263的標準,MPEG-1是著眼於CD-ROM的應用(頻寬約1.5Mbps),主要應用於和VHS相容的系統.MPEG-2則提供高品質的影像服務(頻寬可達2Mbps-30Mbps),加強了堅韌性與錯誤回復力以及針對不同的影像壓縮來源的處理.MPEG-4則可視為MPEG-1與MPEG-2的延伸,提供更多的功能組(functionality)以供使用者選擇。在我們的系統裡,在我們的系統裡,則嘗試以修改MPEG-2壓縮/解壓縮程式的方式,引用MPEG-4的視像物件(video object plane),外型編碼(shape coding)的觀念,對視像物件做外型偵測與壓縮物件的動作。我們的想法基於--物體移動時,如果在移動量不是很大的情況下,可以經由前一張影像中物件已知的外型和動量預估(motion estimation)的技術,來預估下一張影像中同一個物件的外型。而求得外型之後,便可以運用視像物件的觀念(video object plane),再利用可調式外型分散式餘弦轉換(shape adaptive DCT)做物件的壓縮,因此可以在相同的頻寬下,得到較佳的影像品質。在本論文中也提出了數種不同的外型編碼(shape coding)的方法,來降低外型編碼的頻寬浪費,由此可以有效對抓取出來的物件做壓縮的動作。透過這些步驟,在壓縮端的使用者可以只針對感興趣的單一視像物件(video object plane)壓縮,而在解壓縮端,將來使用者則可以將解壓縮之後的視像物件(video object plane)做編輯處理。

Metrics

1 Record Views

Details

Logo image