Theoretical research of the policy gradient reinforcement learning without Markov properties and its application to games
Theoretical research of the policy gradient reinforcement learning without Markov properties and its application to games
批准号:
26330419
负责人:
Harukazu Igarashi
金额:
$1.25万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Scientific Research (C)
财政年份:
2014
资助国家:
日本
项目状态:
已结题
起止时间:
2014-04-01 至 2017-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
サッカーエージェントにおけるスルーパスの強化学習
足球特工直传球的强化学习
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[田川 諒,五十嵐治一]
通讯作者:
田川 諒,五十嵐治一
agent2d のチェーンアクションにおける評価関数の重み調整
Agent2d连锁作用评价函数权重调整
DOI:
--
发表时间:
2014
期刊:
影响因子:
--
作者:
[Noor Imanina N.H. , Harukazu Igarashi, 五十嵐治一,森岡祐一,山本一将, 田川 諒,谷川俊策,五十嵐治一]
通讯作者:
田川 諒,谷川俊策,五十嵐治一
RoboCupサッカーシミュレーションリーグ2Dにおける局面評価関数の設計と学習
RoboCup足球模拟联赛二维阶段评价函数的设计与学习
DOI:
--
发表时间:
2014
期刊:
影响因子:
--
作者:
[Noor Imanina N.H. , Harukazu Igarashi, 五十嵐治一,森岡祐一,山本一将, 田川 諒,谷川俊策,五十嵐治一, 谷川俊策,五十嵐治一,石原聖司]
通讯作者:
谷川俊策,五十嵐治一,石原聖司
Policy Gradient Reinforcement Learning with a Fuzzy Controller for Policy: Decision Making in RoboCup Soccer Small Size League
使用模糊策略控制器进行策略梯度强化学习:RoboCup 足球小规模联赛中的决策
DOI:
10.3156/jsoft.26.647
发表时间:
2014
期刊:
Journal of Japan Society for Fuzzy Theory and Intelligent Informatics
影响因子:
--
作者:
[杉本 将也,五十嵐 治一,石原 聖司,田中 一基]
通讯作者:
杉本 将也,五十嵐 治一,石原 聖司,田中 一基
局面評価関数を用いたサッカーエージェントの移動先決定
使用情况评估函数确定足球经纪人的目的地
DOI:
--
发表时间:
2016
期刊:
影响因子:
--
作者:
[大内 斉,五十嵐 治一]
通讯作者:
大内 斉,五十嵐 治一
共 14 条
海外基金