The Asymptotic Equipartition Property in Reinforcement Learning and its Relation to Return Maximization
The Asymptotic Equipartition Property in Reinforcement Learning and its Relation to Return Maximization
复制标题
强化学习中的渐近均分性质及其与收益最大化的关系
DOI:
--
复制
发表时间:
--
期刊:
影响因子:
--
通讯作者:
Hideaki Sakai
中科院分区:
文献类型:
--
作者:
Kazunori Iwata;Kazushi Ikeda;Hideaki Sakai
登录
查看更多内容
DOI:
10.1109/18.79912
发表时间:
1991
期刊:
IEEE Trans. Inf. Theory
影响因子:
--
作者:
N. Merhav
通讯作者:
N. Merhav
DOI:
10.1109/tit.1979.1056003
发表时间:
1979
期刊:
IEEE Trans. Inf. Theory
影响因子:
--
作者:
G. Dueck;J. Körner
通讯作者:
J. Körner
影响因子:
--
作者:
Kazunori Iwata;K. Ikeda;H. Sakai
通讯作者:
Kazunori Iwata;K. Ikeda;H. Sakai
DOI:
10.1109/18.108258
发表时间:
1992
期刊:
IEEE Trans. Inf. Theory
影响因子:
--
作者:
N. Merhav;D. Neuhoff
通讯作者:
D. Neuhoff
影响因子:
2.5
作者:
AMARI, SI;HAN, TS
通讯作者:
HAN, TS