课题基金 / 基金详情

強化学習エージェントのための生態学的ニッチ固有の制約構造を活用した状態分割法

強化学習エージェントのための生態学的ニッチ固有の制約構造を活用した状態分割法
利用生态位特定约束结构的强化学习代理的状态划分方法
批准号:
15700159
负责人:
半田 久志
金额:
$1.6万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Young Scientists (B)
财政年份:
2003
资助国家:
日本
项目状态:
已结题
起止时间:
2003 至 2004

项目摘要

项目成果

半田 久志的其他基金

相关文献

中文摘要
翻译
点击翻译按钮获取中文摘要
英文摘要
近年,ニューラルネットや強化学習,進化計算のような学習機構を取り入れた自律移動ロボットに関する研究が盛んである.しかしながら,現状では,たとえ高性能な学習機構を取り入れていても,地面のすべりや背景といった環境特有の情報,エージェントのアクチュエータやセンサの特性といった生態学的ニッチ固有の制約構造を巧く活用しないとロボットは全く機能しない.本研究では,自律的に知覚・行動を行う強化学習エージェントに対して与えられた生態学的ニッチ固有の制約構造を活用するための状態分割法を提案しその有用性を示した.提案手法では,知覚-行動-知覚という系列について,状態分割の整合性を検査し,矛盾が検出されるたびにさらなる分割を生じることによりその矛盾解消を試みる.すなわち,ある時刻における知覚入力に対して状態を割り当てるような状態分割器を考える.そして,行動を行った結果として生じる知覚入力を状態分割器に与え,状態を得る.系列をエージェントが行動するたびに蓄えていき,矛盾検出とその解消を行う.提案手法では、階層的な情報処理による状態分割を行うメカニズムを有し、階層は情報の縮約を、上位層は階層で縮約を行ったニューロンが発火した際に、次時刻ではどのような知覚変化を引き起こすかを予測している。この予測の精度にもとづいて状態分割を構成している。本年度は、この研究課題で新たに提案を行った上記の状態分割法について、車の山登り問題へ適用した研究について2004年7月にブダペストで行われたIJCNN04にて成果発表を行った。また状態だけではなく行動の分節化を行うようなアルゴリズムの拡張について検討した。
期刊论文(1)
专著(0)
科研奖励(0)
会议论文
Hisashi HANDA: "State Space Construction of Reinforcement Learning Agents Based upon Anticipated Sensory Changes"International Joint Conference on Neural Networks. (採録決定). (2004)
Hisashi HANDA:“基于预期感官变化的强化学习代理的状态空间构建”神经网络国际联合会议(已接受)。
DOI: --
发表时间:
期刊:
影响因子: --
作者: []
通讯作者:
機械学習を援用した進化計算による有機薄膜太陽電池に適した化合物の探索
  • 批准号:
    23K11254
  • 项目类别:
    Grant-in-Aid for Scientific Research (C)
  • 资助金额:
    $3.08万
  • 财政年份:
    2023
  • 负责人:
    半田 久志
  • 依托单位:
Evolutionary Search of Structured Data by Using Deep Graph Kernels
  • 批准号:
    20K12000
  • 项目类别:
    Grant-in-Aid for Scientific Research (C)
  • 资助金额:
    $2.66万
  • 财政年份:
    2020
  • 负责人:
    半田 久志
  • 依托单位: