The Choice Function Framework for Online Policy Improvement

The Choice Function Framework for Online Policy Improvement
复制标题

在线政策改进的选择函数框架

DOI:
10.1609/aaai.v34i06.6578
复制
发表时间:
2020
期刊:
Proceedings of the AAAI Conference on Artificial Intelligence
影响因子:
--
通讯作者:
Tadepalli, Prasad
Tadepalli, Prasad
中科院分区:
--
文献类型:
--
作者:
Issakkimuthu, Murugeswari;Fern, Alan;Tadepalli, Prasad

文献摘要

参考文献

相似文献

DOI: --
发表时间: 1996-12
期刊: --
影响因子: --
作者:
G. Tesauro;Gregory R. Galperin
通讯作者: G. Tesauro;Gregory R. Galperin
DOI: 10.1126/science.aar6404
发表时间: 2018-12-07
期刊: SCIENCE
影响因子: 56.9
作者:
Silver, David;Hubert, Thomas;Hassabis, Demis
通讯作者: Hassabis, Demis
针对概率规划问题训练深度反应策略
DOI: --
发表时间: 2018
期刊: International Conference on Automated Planning and Scheduling
影响因子: --
作者:
Murugeswari Issakkimuthu;Alan Fern;Prasad Tadepalli
通讯作者: Prasad Tadepalli
纸牌:人与机器
DOI: --
发表时间: 2004
期刊: Neural Information Processing Systems
影响因子: --
作者:
X. Yan;P. Diaconis;Paat Rusmevichientong;Benjamin Van Roy
通讯作者: Benjamin Van Roy
使用次优策略引导基于模拟的算法
DOI: --
发表时间: 2014
期刊: International Conference on Automated Planning and Scheduling
影响因子: --
作者:
Truong;T. Silander;Wee Sun Lee;T. Leong
通讯作者: T. Leong