Abstract
由於網路技術的進步,使得站與站之間的資料傳輸速度愈來愈快。因此, 可以利用多個站來同時處理使用者的查詢來達到查詢處理最佳化(query optimization)。所以「分割和複製」(fragment and replicate)查詢 處理策略已經被用來平行處理使用者查詢。使用這個策略時,我們需決定 那一個關聯表(relation)要被分割、如何分割、以及使用那些站來同時 處理使用者查詢。在這篇論文中,我們延伸此一策略而考慮只複製關聯表 的部份代替原來將整個關聯表完全複製以改進執行效率。我們首先介紹如 何應用半連結(semijoin)來只複製必要的資料,再來根據半連結的特性 而提出了「最小-最大」方法和另一個使用雜湊函數的方法來分割關聯表 。我們並提供了一個分割演算法來決定那一些關聯表要被分割,分割的方 式,以及用那幾個站來處理。 我們也討論如何有效地處理兩個相隔不 久的使用者查詢。由於那些在查詢處理過程中被複製的關聯表對未來的使 用者查詢可能有用,因此我們討論如何儲存以及管理它們。特別地,我們 所提出的分割演算法亦可在異質性的分散式資料庫系統中,達到查詢處理 最佳化。本篇論文共分為六章:第一章簡單介紹本文的背景資訊以及基本 概念;第二章探討查詢處理最佳化會遭遇到的問題;第三章介紹一些相關 的研究;第四章中我們提出一些解決方法去解決第二章中所提出的問題; 第五章討論我們提出的解決方法是否在異質式分散式系統中可行;而第六 章做一個結論以及討論未來研究方向。