Logo image
架構於三維物體分割之立體視訊編碼演算法
Thesis

架構於三維物體分割之立體視訊編碼演算法

黃明裕
Masters, National Tsing Hua University
1995

Abstract

立體;物件基底 物件分割 動態程式法 Stereo Object-based Object segmentation Dynamic programming
隨著科技的進步與人類對視覺享受需求的不斷提升,人類希望電視也能提供三維空間立體顯像,以達到視覺的真實感,於是現在立體電視越來越受重視。而一個最基本的立體電視至少必須提供左右二眼視訊,其資訊量很大,因此立體影像壓縮也日漸重要。因為左右二眼的視訊有著高度相關性,如何利用此相關性應用在立體影像壓縮是非常重要的,尤其在網路發達的今日,高壓縮率立體影像編碼是極迫須要的。一個鋼體運動我們可以用簡單的六個參數來描述它,包括三個位移參數和三個旋轉參數。再利用針孔成像的模型來轉換三維和二維座標之間的關係。最後我們導出二個等式,在等式中我們先求出物體二維的運動向量與座標位置。然後再利用最小平方近似解出三維運動參數。因為影像序列是二維座標我們不可能直接得到物體的深度座標,只能由左右二張影像之間的視差位移量估測其深度值。本章敘述利用動態程式法來估測視差位移量,以求得較準確的視差。在這篇論文中我們提出了一個以物件為基底的演算法應用在立體影像的壓縮。以物件為基底的壓縮方式必須先作物件的分割。在此的物件分割我們是利用二元樹的資料結構,而分割的準則是判斷分割後的物件是否具有相同的三維運動參數以及三維運動補償後投影回二維平面影像的誤差是否足夠小。為了得到高壓縮比率且在不影響立體視覺的情況下,我們也採用了立體視覺抑止性質於我們的演算法中。從我們的實驗結果顯示了所提出的壓縮演算法可以得到高壓縮比和立體效果。

Metrics

1 Record Views

Details

Logo image