Developing a theory of deep reinforcement learning equipped with bounded rationality
Developing a theory of deep reinforcement learning equipped with bounded rationality
批准号:
17H04696
负责人:
Takahashi Tatsuji
金额:
$15.14万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Young Scientists (A)
财政年份:
2017
资助国家:
日本
项目状态:
已结题
起止时间:
2017-04-01 至 2020-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
満足化を通じた最適な自律的探索
通过满意度进行最优自主搜索
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[甲野 佑, 高橋 達二]
通讯作者:
高橋 達二
パリ第8大学/高等師範学校/高等研究実習院(フランス)
巴黎第八大学/巴黎高等师范学院/高等研究与培训学院(法国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
ダーラム大学(英国)
杜伦大学(英国)
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Extended Bayesian inference incorporating symmetry bias
结合对称偏差的扩展贝叶斯推理
DOI:
10.1016/j.biosystems.2020.104104
发表时间:
2020
期刊:
Biosystems
影响因子:
1.6
作者:
[Shinohara Shuji, Manome Nobuhito, Suzuki Kouta, Chung Ung-il, Takahashi Tatsuji, Gunji Pegio-Yukio, Nakajima Yoshihiro, Mitsuyoshi Shunji]
通讯作者:
Mitsuyoshi Shunji
認知的満足化価値関数の分析
认知满足价值函数分析
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[玉造 晃弘, 高橋 達二]
通讯作者:
高橋 達二
共 13 条
Proposal of Value Function Implementing Adaptive Cognitive Properties and Its Application to Large-Scale Computing
-
批准号:25730150
-
项目类别:Grant-in-Aid for Young Scientists (B)
-
资助金额:$2.66万
-
财政年份:2013
-
负责人:Takahashi Tatsuji
-
依托单位:
海外基金