The Reward Biased Method: An Optimism based Approach for Reinforcement Learning

The Reward Biased Method: An Optimism based Approach for Reinforcement Learning
复制标题

奖励偏差方法:基于乐观的强化学习方法

DOI:
10.1109/allerton58177.2023.10313396
复制
发表时间:
2023
期刊:
IEEE
影响因子:
--
通讯作者:
Kumar, P. R.
Kumar, P. R.
中科院分区:
--
文献类型:
--
作者:
Mete, Akshay;Singh, Rahul;Kumar, P. R.

文献摘要

参考文献

相似文献

(1) 制作学校午餐Champuru研究食谱,并将其应用于通过学校午餐进行饮食教育的实践,2013年4月1日《琉球新闻报》发表《冲绳社会面临的长寿崩溃15个挑战》
DOI: --
发表时间: --
期刊:
影响因子: --
作者:
通讯作者: --
用于自适应控制和学习的输入扰动
DOI: 10.1016/j.automatica.2020.108950
发表时间: 2020
期刊: Automatica
影响因子: 6.4
作者:
Shirani Faradonbeh, Mohamad Kazem;Tewari, Ambuj;Michailidis, George
通讯作者: Michailidis, George
DOI: --
发表时间: 2020-11
期刊: ArXiv
影响因子: --
作者:
Akshay Mete;Rahul Singh;Xi Liu;P. Kumar
通讯作者: Akshay Mete;Rahul Singh;Xi Liu;P. Kumar
DOI: 10.1609/aaai.v35i9.16961
发表时间: 2020-10
期刊: ArXiv
影响因子: --
作者:
Yu-Heng Hung;Ping-Chun Hsieh;Xi Liu;P. Kumar
通讯作者: Yu-Heng Hung;Ping-Chun Hsieh;Xi Liu;P. Kumar
DOI: 10.1109/ciss53076.2022.9751189
发表时间: 2022
期刊: IEEE
影响因子: --
作者:
Mete, Akshay;Singh, Rahul;Kumar, P. R.
通讯作者: Kumar, P. R.