Integration of Kullback-Leibler control and intrinsic rewards for reinforcement learning
Integration of Kullback-Leibler control and intrinsic rewards for reinforcement learning
批准号:
16K12504
负责人:
UCHIBE Eiji
金额:
$2.16万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Challenging Exploratory Research
财政年份:
2016
资助国家:
日本
项目状态:
已结题
起止时间:
2016-04-01 至 2019-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
期刊论文(12)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture
使用 MaxPain 架构并行奖励和惩罚进行深度强化学习
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[Jiexin Wang, Stefan Elfwing, and Eiji Uchibe]
通讯作者:
and Eiji Uchibe
DOI:
10.3902/jnns.24.195
发表时间:
2017
期刊:
The Brain & Neural Networks
影响因子:
--
作者:
[E. Uchibe;Jiexin Wang]
通讯作者:
E. Uchibe;Jiexin Wang
DOI:
--
发表时间:
2019
期刊:
影响因子:
--
作者:
[Jiexin Wang, Eiji Uchibe, Kenji Doya, Eiji Uchibe]
通讯作者:
Eiji Uchibe
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[Jiexin Wang, Eiji Uchibe, Kenji Doya, Eiji Uchibe, Eiji Uchibe]
通讯作者:
Eiji Uchibe
方策探査法のための多重重点サンプリングを用いた経験再利用
使用多重重要性采样进行策略探索方法的经验重用
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[Jiexin Wang, Stefan Elfwing, and Eiji Uchibe, Eiji Uchibe, 内部英治]
通讯作者:
内部英治
共 10 条
Information theoretic optimization of intrinsic rewards for reinforcement learning
-
批准号:24500249
-
项目类别:Grant-in-Aid for Scientific Research (C)
-
资助金额:$3.16万
-
财政年份:2012
-
负责人:UCHIBE Eiji
-
依托单位:
海外基金