× Zamknij

Serwis Infona wykorzystuje pliki cookies (ciasteczka). Są to wartości tekstowe, zapamiętywane przez przeglądarkę na urządzeniu użytkownika. Nasz serwis ma dostęp do tych wartości oraz wykorzystuje je do zapamiętania danych dotyczących użytkownika, takich jak np. ustawienia (typu widok ekranu, wybór języka interfejsu), zapamiętanie zalogowania. Korzystanie z serwisu Infona oznacza zgodę na zapis informacji i ich wykorzystanie dla celów korzytania z serwisu. Więcej informacji można znaleźć w Polityce prywatności oraz Regulaminie serwisu. Zamknięcie tego okienka potwierdza zapoznanie się z informacją o plikach cookies, akceptację polityki prywatności i regulaminu oraz sposobu wykorzystywania plików cookies w serwisie. Możesz zmienić ustawienia obsługi cookies w swojej przeglądarce.

Wyniki wyszukiwania dla: Andras Gyorgy

Pozycje od 1 do 1 spośród 1 wyników

artykuł

Online Markov Decision Processes Under Bandit Feedback

Gergely Neu, Andras Gyorgy, Csaba Szepesvari, Andras Antos

IEEE Transactions on Automatic Control > 2014 > 59 > 3 > 676 - 691

We consider online learning in finite stochastic Markovian environments where in each time step a new reward function is chosen by an oblivious adversary. The goal of the learning agent is to compete with the best stationary policy in hindsight in terms of the total reward received. Specifically, in each time step the agent observes the current state and the reward associated with the last transition,...

Opcje filtrowania

Słowa kluczowe:
ROBUST CONTROL
EDUCATIONAL INSTITUTIONS

Data publikacji

Ustaw własny zakres dat

Sfinansowano przez Narodowe Centrum Badań i Rozwoju (NCBiR), nr umowy SP/I/1/77065/10 w ramach programu strategicznego: SYNAT - „Interdyscyplinarny system interaktywnej informacji naukowej i naukowo-technicznej”.

INFONA - portal komunikacji naukowej

Wyniki wyszukiwania dla: Andras Gyorgy

Online Markov Decision Processes Under Bandit Feedback

Dodaj adresata

Anulowanie wysłania wiadomości

Czy na pewno chcesz anulować wysłanie wiadomości?

Wyślij wiadomość

Opcje filtrowania

Data publikacji

Ustawianie zakresu dat

Podaj zakres dat dla filtrowania wyświetlonych wyników. Możesz podać datę początkową, końcową lub obie daty. Daty możesz wpisać ręcznie lub wybrać za pomocą kalendarza.

Zgłaszanie błędu / nadużycia

Nieudane wysłanie zgłoszenia

Ułatwienia dostępu