Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture
Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture
复制标题
使用 MaxPain 架构并行奖励和惩罚进行深度强化学习
DOI:
--
复制
发表时间:
2018
期刊:
影响因子:
--
通讯作者:
and Eiji Uchibe
中科院分区:
文献类型:
--
作者:
Jiexin Wang;Stefan Elfwing;and Eiji Uchibe
登录
查看更多内容
DOI:
--
发表时间:
2001
期刊:
International Work-Conference on Artificial and Natural Neural Networks
影响因子:
--
作者:
Hiroyuki Okada;H. Yamakawa;T. Omori
通讯作者:
T. Omori
DOI:
10.1109/iros.1996.568989
发表时间:
1996
期刊:
Proceedings of IEEE/RSJ International Conference on Intelligent Robots and Systems. IROS '96
影响因子:
--
作者:
E. Uchibe;M. Asada;K. Hosoda
通讯作者:
K. Hosoda
DOI:
10.1073/pnas.1519829113
发表时间:
2016-04-26
影响因子:
11.1
作者:
Eldar, Eran;Hauser, Tobias U.;Dolan, Raymond J.
通讯作者:
Dolan, Raymond J.
DOI:
10.1109/devlrn.2017.8329799
发表时间:
2017
期刊:
2017 Joint IEEE International Conference on Development and Learning and Epigenetic Robotics (ICDL-EpiRob)
影响因子:
--
作者:
Stefan Elfwing;B. Seymour
通讯作者:
B. Seymour