,

On-Policy Deep Reinforcement Learning - The Discounted and Average Reward Criteria.

Y. Zhang.
New York University, USA, (2022)

Метаданные

ключ BibTeX: phd/us/Zhang22
тип записи: phdthesis
год: 2022
учебное заведение: New York University, USA
ee: https://cs.nyu.edu/media/publications/Yiming_Zhang_PhD_Thesis.pdf

тэги

dblp

Пользователи данного ресурса

Комментарии и рецензиипоказать / перейти в невидимый режим

Пожалуйста, войдите в систему, чтобы принять участие в дискуссии (добавить собственные рецензию, или комментарий)

Цитировать эту публикацию

искать в

Что такое BibSonomy?: С чего начать; Кнопки для браузера; Помощь
Разработчикам: Обзор; API-документация

Контакт и защита личных данных: о нас; Cookies; Сообщить о проблеме; BibSonomy Вики

Интеграция: PUMA; Расширение для TYPO3; Плагин для; Клиент Java REST; Поддерживаемые источники; далее

О BibSonomy: Команда; Блог; Список рассылки
Социальные сети: Наш Twitter