階層型視覚的コモンセンスを考慮した動画質問応答
階層型視覚的コモンセンスを考慮した動画質問応答
批准号:
22KJ2914
负责人:
綱島 秀樹
金额:
$1.09万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2023
资助国家:
日本
项目状态:
已结题
起止时间:
2023-03-08 至 2024-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
本研究課題の幼児の一人称視点動画からの視覚的コモンセンス獲得において、2022年度開始時は幼児の一人称視点動画の詳細な分析を行った。しかしながら、幼児の一人称視点動画は撮影条件や視点などが統一されておらず、機械学習の文脈において未来予測をすることは非常に困難であることが明らかとなった。そこで、近年深層学習において技術的転換点となったTransformerを用いてインタラクションを伴う行動計画タスク自体から初期的視覚的コモンセンスを創発させることができないかに取り組んだ。Transformerの自己注意機構を可視化した結果として、視覚的コモンセンスのPやFについての初期的視覚コモンセンスの獲得の傾向は見られたが、CとIとUについての創発は見られなかった。それゆえ、タスク自体の見直しを行うことにした。次に取り組んだタスクとして物理現象を伴うパズルであるPHYREを用いて、視覚的コモンセンスFPICU全ての創発を行うエージェントを開発することに取り組んだ。FPICUを全て創発させるために、FPICUを統一的に考慮する定式化を数学的に行い、実験を行った。しかしながら、因果性であるCの学習が困難を極め、Cの関連する技術であるVAEや統計的因果推論についてのサーベイを行った。結果として、2022年度はタスクの2度の見直しとFPICUの学習困難性のために論文出版を行うことはできなかった。しかしながら、近年登場したChatGPTがIとUを備えている可能性があり、ChatGPTを活用して視覚的コモンセンスを統一的に考慮するための初期的実験を開始した。
期刊论文(5)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
視覚情報に用いたタスク指向型対話における人間の返答に対する間違い指摘の検討
利用视觉信息指出任务导向对话中人类反应错误的研究
DOI:
--
发表时间:
2023
期刊:
影响因子:
--
作者:
[Kazuki Kohyama, Takahiro Tsukahara, Keiichi Tamai, Masaki Sano, 荒川深映(この発表者と綱島は共同第一著者), 大島遼祐(この発表者と綱島は共同著者)]
通讯作者:
大島遼祐(この発表者と綱島は共同著者)
視覚情報を用いたタスク指向型対話における人間の応答に対する間違い指摘の検討
利用视觉信息指出任务导向对话中人类反应错误的研究
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
複数解像度で画像を生成可能な拡散確率モデル
可以生成多种分辨率图像的扩散随机模型
DOI:
--
发表时间:
2023
期刊:
影响因子:
--
作者:
[Kazuki Kohyama, Takahiro Tsukahara, Keiichi Tamai, Masaki Sano, 荒川深映(この発表者と綱島は共同第一著者)]
通讯作者:
荒川深映(この発表者と綱島は共同第一著者)
視覚情報に基づくタスク指向型対話における人間の返答に対する間違い指摘の検討
基于视觉信息的任务导向对话中人类反应错误的指出研究
DOI:
--
发表时间:
2023
期刊:
影响因子:
--
作者:
[Kazuki Kohyama, Takahiro Tsukahara, Keiichi Tamai, Masaki Sano, 荒川深映(この発表者と綱島は共同第一著者), 大島遼祐(この発表者と綱島は共同著者), 大島遼祐(この発表者と綱島は共同著者)]
通讯作者:
大島遼祐(この発表者と綱島は共同著者)
DOI:
10.48550/arxiv.2304.07087
发表时间:
2023-04
期刊:
ArXiv
影响因子:
--
作者:
[Shinei Arakawa;Hideki Tsunashima;Daichi Horita;Keitaro Tanaka;S. Morishima]
通讯作者:
Shinei Arakawa;Hideki Tsunashima;Daichi Horita;Keitaro Tanaka;S. Morishima
海外基金