Abstract
在發展中文自然語言處理系統的過程中,由於文法的不完全性,每次面臨一個合法但系統卻無法處理的句子時,必須重新修改系統的文法,反覆測試,這是一件費時的事,尤其當文法規則的數量龐大時,這件工作更加困難。本篇論文主要在解決這樣的問題,並且由於解決方法的特性,亦可當成一種能自動擷取文法規則的機構。參考文獻涵蓋語言學,前人的研究,以及其它有關自然語言處理的文件,計三十篇以上,詳列在論文之後,有興報從事這方面研究者,可以從中獲得一個好的起點。作者是以計算機學者的眼光來探討中文,分析其特性,找出它的困難,並提出切乎實際的解決之道。全文按處理的程度逐步介紹,從語彙分析以至於文法分析為止,其中包括斷辭,文法的表達,以及自我擴延的機構等等。本篇論文提出中文自然語言處理的一般架構,一個簡單卻有效的斷辭方法,以及具自動擴延能力機構的演算法則,並且討論它的相開運用,包括文法的學習,錯誤的回復,容錯的剖析等。