The Asymptotic Equipartition Property in Reinforcement Learning and its Relation to Return Maximization

The Asymptotic Equipartition Property in Reinforcement Learning and its Relation to Return Maximization
复制标题

强化学习中的渐近均分性质及其与收益最大化的关系

DOI:
--
复制
发表时间:
--
期刊:
Neural Networks (発表予定)
影响因子:
--
通讯作者:
Hideaki Sakai
Hideaki Sakai
中科院分区:
--
文献类型:
--
作者:
Kazunori Iwata;Kazushi Ikeda;Hideaki Sakai

文献摘要

参考文献

被引文献

相似文献

DOI: 10.1109/18.79912
发表时间: 1991
期刊: IEEE Trans. Inf. Theory
影响因子: --
作者:
N. Merhav
通讯作者: N. Merhav
离散无记忆通道在速率高于容量时的可靠性函数(对应)
DOI: 10.1109/tit.1979.1056003
发表时间: 1979
期刊: IEEE Trans. Inf. Theory
影响因子: --
作者:
G. Dueck;J. Körner
通讯作者: J. Körner
DOI: 10.1109/tnn.2004.828760
发表时间: 2004-07
影响因子: --
作者:
Kazunori Iwata;K. Ikeda;H. Sakai
通讯作者: Kazunori Iwata;K. Ikeda;H. Sakai
可变长度到固定长度代码比固定到可变长度代码提供更好的大偏差性能
DOI: 10.1109/18.108258
发表时间: 1992
期刊: IEEE Trans. Inf. Theory
影响因子: --
作者:
N. Merhav;D. Neuhoff
通讯作者: D. Neuhoff
DOI: 10.1109/18.32118
发表时间: 1989-03-01
影响因子: 2.5
作者:
AMARI, SI;HAN, TS
通讯作者: HAN, TS