Logo image
Laplacian Based State-value Function Transfer in Discrete Reinforcement Learning
Thesis

Laplacian Based State-value Function Transfer in Discrete Reinforcement Learning

Yi-Ting Tsao
Masters, 國立清華大學, 資訊工程學系
2007

Abstract

增強式學習 轉換學習 拉普拉斯運算 Reinforcement Learning Transfer Learning Laplacian
在學習這件事中,分別學習兩個相似的問題可能會造成時間上的浪費,而這個浪費是由於重複學習同樣的子問題所造成。因此,所謂的轉換學習指得是縮短學習相似問題的時間,也就是再利用某一問題所學到的知識。很多過去的研究都注重於如何利用轉移函數來做知識的轉換,但是設計轉換函數必須要十分了解問題的特性,因此就算是此問題的專家也是不容易的一件事,所以我們提出一個以拉普拉斯為基礎的轉換方式。我們修改了原有的拉普拉斯運算,使之變成不只反應問題的拓撲特性,也反應在增強式學習中所需的獎勵。此外,我們也簡單地敘述這個方法的特性和解釋為何這個方法可以達到加速學習的目的。透過這個方法,我們可以直接轉換兩個增強式學習的問題而不需要轉換函式。在本論文中,我們研究三種不同的轉換形式,而從實驗的結果中可知這樣的轉換方式對於減少學習時間是有幫助的。

Metrics

1 Record Views

Details

Logo image