Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture

Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture
复制标题

使用 MaxPain 架构并行奖励和惩罚进行深度强化学习

DOI:
--
复制
发表时间:
2018
期刊:
影响因子:
--
通讯作者:
and Eiji Uchibe
and Eiji Uchibe
中科院分区:
--
文献类型:
--
作者:
Jiexin Wang;Stefan Elfwing;and Eiji Uchibe

文献摘要

参考文献

被引文献

相似文献

DOI: --
发表时间: 2001
期刊: International Work-Conference on Artificial and Natural Neural Networks
影响因子: --
作者:
Hiroyuki Okada;H. Yamakawa;T. Omori
通讯作者: T. Omori
使用模块化强化学习的移动机器人的行为协调
DOI: 10.1109/iros.1996.568989
发表时间: 1996
期刊: Proceedings of IEEE/RSJ International Conference on Intelligent Robots and Systems. IROS '96
影响因子: --
作者:
E. Uchibe;M. Asada;K. Hosoda
通讯作者: K. Hosoda
DOI: 10.1073/pnas.1519829113
发表时间: 2016-04-26
影响因子: 11.1
作者:
Eldar, Eran;Hauser, Tobias U.;Dolan, Raymond J.
通讯作者: Dolan, Raymond J.
人类和机器人的并行奖励和惩罚控制:使用 MaxPain 算法的安全强化学习
DOI: 10.1109/devlrn.2017.8329799
发表时间: 2017
期刊: 2017 Joint IEEE International Conference on Development and Learning and Epigenetic Robotics (ICDL-EpiRob)
影响因子: --
作者:
Stefan Elfwing;B. Seymour
通讯作者: B. Seymour