Logo image
階層同步式之不合法語句剖析及錯誤修正
Thesis

階層同步式之不合法語句剖析及錯誤修正

林一中
Masters, National Tsing Hua University
1994

Abstract

部分剖析 強健性剖析 錯誤修正 Partial Parsing Robust Parsing Error Recovery
對一個實際的自然語言系統而言,不合法語句的處理是不可避免的問題。因此,正確地剖析不合法語句並對其錯誤做適當的修正是相當重要的。在這篇論文中,我們提出一個階層同步式剖析方法,用以剖析不合法的語句。此方法將語句的剖析程序視為替該語句建立一連串的詞組階層。在剖析的過程中,我們以一個與階層同步的評分函數快速地篩選出可能的詞組階層。當所有在搜尋範圍內的詞組階層無法再進一步地剖析時,建立詞組階層的程序便停止,此時一個結合上下文資訊的機率評分函數將被用來選出最好的部分剖析樹。實驗的結果顯示,使用階層同步式剖析方法之系統較使用「最左最長詞組優先」經驗法則之系統為優。部分剖析樹的詞組正確率(即精確率及召回率的平均值)由 74.05% 提高至 80.44% 。對部分自然語言處理系統而言,僅對不合法語句做部分剖析是不夠的。這些系統需要的是一個標記著錯誤訊息的完整剖析結果,以便於系統對不合法語句做正常的處理。因此,本文亦提出一個兩階段的錯誤修正策略,用以增強所提出的階層同步式剖析方法。在第一階段,系統嘗試修補最好的部分剖析樹成一個完整剖析樹。倘若此一部分剖析樹不能被適當的修補,則系統將在第二階段修正可能的詞類錯誤。實驗的結果顯示,此系統能將 35% 的不合法語句剖析成完全正確的完整剖析樹。完整剖析樹的詞組正確率則由 73.99% 提高至 78.65%。本篇論文共分七章:第一章為導論。第二章回顧以往的相關研究。第三章建立一個以最長詞組優先的雛形系統。第四章說明所提出的階層同步式剖析方法。第五章探討如何修正句子的錯誤。第六章分析未能解決的錯誤並提出將來的發展方向。第七章為結論。

Metrics

1 Record Views

Details

Logo image