Instance-optimal PAC Algorithms for Contextual Bandits

Instance-optimal PAC Algorithms for Contextual Bandits
复制标题

针对上下文强盗的实例最优 PAC 算法

DOI:
--
复制
发表时间:
2022
期刊:
Advances in neural information processing systems
影响因子:
--
通讯作者:
Jain, Lalit
Jain, Lalit
中科院分区:
--
文献类型:
--
作者:
Li, Zhaoqi;Ratliff, Lillian;Nassif, Houssam;Jamieson, Kevin;Jain, Lalit

文献摘要

参考文献

被引文献

相似文献

具有回归预言的实用上下文强盗
DOI: --
发表时间: 2018
期刊: Proceedings of Machine Learning Research
影响因子: --
作者:
Foster, Dylan;Agarwal, Alekh;Dudik, Miroslav;Luo, Haipeng;Schapire, Robert
通讯作者: Schapire, Robert
使用经验贝叶斯的贝叶斯元先验学习
DOI: 10.1287/mnsc.2021.4136
发表时间: 2020
期刊: Manag. Sci.
影响因子: --
作者:
Sareh Nabi;Houssam Nassif;Joseph Hong;H. Mamani;G. Imbens
通讯作者: G. Imbens
DOI: 10.48550/arxiv.2207.02575
发表时间: 2022-07
期刊: ArXiv
影响因子: --
作者:
Andrew J. Wagenmaker;Kevin G. Jamieson
通讯作者: Andrew J. Wagenmaker;Kevin G. Jamieson
线性上下文强盗中的自适应探索
DOI: --
发表时间: 2019
期刊: International Conference on Artificial Intelligence and Statistics
影响因子: --
作者:
Botao Hao;Tor Lattimore;Csaba Szepesvari
通讯作者: Csaba Szepesvari
马尔可夫决策过程中最佳策略识别的自适应采样
DOI: --
发表时间: 2020
期刊: International Conference on Machine Learning
影响因子: --
作者:
Aymen Al Marjani;A. Proutière
通讯作者: A. Proutière