Reinforcement learning with orthonormal basis adaptation based on activity-oriented index allocation

Reinforcement learning with orthonormal basis adaptation based on activity-oriented index allocation
复制标题

基于活动导向的指标分配的正交基自适应强化学习

DOI:
--
复制
发表时间:
2008
期刊:
IEICE Trans. Fundamentals Vol.E91-A, No.4
影响因子:
--
通讯作者:
Hideki Sato
Hideki Sato
中科院分区:
--
文献类型:
--
作者:
H.Noda;M.Niimi;E.Kawaguchi;Hideki Sato

文献摘要

参考文献

相似文献

使用混合强化学习系统进行识别和控制
DOI: 10.5555/206705.206706
发表时间: 1995
期刊: International Journal in Computer Simulation
影响因子: --
作者:
P. Mills;M. Tadé;Albert Y. Zomaya
通讯作者: Albert Y. Zomaya
DOI: 10.1016/j.robot.2003.11.006
发表时间: 2003-09
期刊: Robotics Auton. Syst.
影响因子: --
作者:
T. Kondo;Koji Ito
通讯作者: T. Kondo;Koji Ito
一种基于多变量分析的高维连续状态空间强化学习状态空间压缩方法
DOI: --
发表时间: 2006
期刊: IEICE Tans. Fundamentals Vol.E89-A, no.8
影响因子: --
作者:
枦修一郎;神坂文康;薮上信;金高弘恭;石山和志;荒井賢一;Hideki Satoh
通讯作者: Hideki Satoh