课题基金 / 基金详情

Integration of Kullback-Leibler control and intrinsic rewards for reinforcement learning

Integration of Kullback-Leibler control and intrinsic rewards for reinforcement learning
Kullback-Leibler 控制和强化学习内在奖励的集成
批准号:
16K12504
负责人:
UCHIBE Eiji
金额:
$2.16万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Challenging Exploratory Research
财政年份:
2016
资助国家:
日本
项目状态:
已结题
起止时间:
2016-04-01 至 2019-03-31

项目摘要

项目成果

UCHIBE Eiji的其他基金

相似基金

相关文献

中文摘要
翻译
点击翻译按钮获取中文摘要
英文摘要
期刊论文(12)
专著(0)
科研奖励(0)
会议论文
Deep reinforcement learning by parallelizing reward and punishment using MaxPain architecture
使用 MaxPain 架构并行奖励和惩罚进行深度强化学习
DOI: --
发表时间: 2018
期刊:
影响因子: --
作者: [Jiexin Wang, Stefan Elfwing, and Eiji Uchibe]
通讯作者: and Eiji Uchibe
DOI: 10.3902/jnns.24.195
发表时间: 2017
期刊: The Brain & Neural Networks
影响因子: --
作者: [E. Uchibe;Jiexin Wang]
通讯作者: E. Uchibe;Jiexin Wang
Imitation learning under entropy regularization
熵正则化下的模仿学习
DOI: --
发表时间: 2019
期刊:
影响因子: --
作者: [Jiexin Wang, Eiji Uchibe, Kenji Doya, Eiji Uchibe]
通讯作者: Eiji Uchibe
DOI: --
发表时间: 2018
期刊:
影响因子: --
作者: [Jiexin Wang, Eiji Uchibe, Kenji Doya, Eiji Uchibe, Eiji Uchibe]
通讯作者: Eiji Uchibe
10
    Information theoretic optimization of intrinsic rewards for reinforcement learning
    海外基金