× Zamknij

Serwis Infona wykorzystuje pliki cookies (ciasteczka). Są to wartości tekstowe, zapamiętywane przez przeglądarkę na urządzeniu użytkownika. Nasz serwis ma dostęp do tych wartości oraz wykorzystuje je do zapamiętania danych dotyczących użytkownika, takich jak np. ustawienia (typu widok ekranu, wybór języka interfejsu), zapamiętanie zalogowania. Korzystanie z serwisu Infona oznacza zgodę na zapis informacji i ich wykorzystanie dla celów korzytania z serwisu. Więcej informacji można znaleźć w Polityce prywatności oraz Regulaminie serwisu. Zamknięcie tego okienka potwierdza zapoznanie się z informacją o plikach cookies, akceptację polityki prywatności i regulaminu oraz sposobu wykorzystywania plików cookies w serwisie. Możesz zmienić ustawienia obsługi cookies w swojej przeglądarce.

Wyniki wyszukiwania dla: Shu-Hong Yang

Pozycje od 1 do 1 spośród 1 wyników

rozdział

Incremental least squares policy iteration in reinforcement learning for control

Chun-Gui Li, Meng Wang, Shu-Hong Yang

2008 International Conference on Machine Learning and Cybernetics > 4 > 2010 - 2014

2008 International Conference on Machine Learning and Cybernetics (ICMLC)

We propose a novel algorithm of reinforcement learning for control problems which combines value-function approximation with linear architectures and approximate policy iteration. This algorithm improves least-squares policy iteration (LSPI) methods by using incremental least-squares temporal-difference learning algorithm (iLSTD) for prediction problems. We show that the novel algorithm has less computing...

Opcje filtrowania

Słowa kluczowe:
VALUE-FUNCTION APPROXIMATION

Data publikacji

Ustaw własny zakres dat

Sfinansowano przez Narodowe Centrum Badań i Rozwoju (NCBiR), nr umowy SP/I/1/77065/10 w ramach programu strategicznego: SYNAT - „Interdyscyplinarny system interaktywnej informacji naukowej i naukowo-technicznej”.

INFONA - portal komunikacji naukowej

Wyniki wyszukiwania dla: Shu-Hong Yang

Incremental least squares policy iteration in reinforcement learning for control

Dodaj adresata

Anulowanie wysłania wiadomości

Czy na pewno chcesz anulować wysłanie wiadomości?

Wyślij wiadomość

Opcje filtrowania

Data publikacji

Ustawianie zakresu dat

Podaj zakres dat dla filtrowania wyświetlonych wyników. Możesz podać datę początkową, końcową lub obie daty. Daty możesz wpisać ręcznie lub wybrać za pomocą kalendarza.

Zgłaszanie błędu / nadużycia

Nieudane wysłanie zgłoszenia

Ułatwienia dostępu