顔形状復元によるデータ生成と自己教師型補助タスクに基づく視線推定器のドメイン適応
顔形状復元によるデータ生成と自己教師型補助タスクに基づく視線推定器のドメイン適応
批准号:
21K11932
负责人:
菅野 裕介
金额:
$2.66万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Scientific Research (C)
财政年份:
2021
资助国家:
日本
项目状态:
已结题
起止时间:
2021-04-01 至 2024-03-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
本年度は、前年度に検討した3次元復元に基づく学習データ生成手法と、特徴分離を元にしたドメイン適応手法を統合した手法の実装・検証を行った。既存の訓練データに含まれる顔画像データのほとんどは正面顔であるが、顔形状の3次元復元を行い新たな顔向きでレンダリングすることで学習データに含まれる顔向きを拡張することができる。この時、生成データと実データの見えのさを吸収するための教師なしドメイン適応が重要になるが、単にターゲットドメインにおける疑似タスクを導入するのではなく、視線と頭部姿勢、その他の要因を表現する3つの内部特徴を事前学習の際に分離することでより効果的なドメイン適応が実現できる。顔領域以外の背景領域がランダム生成になっている生成データの特性に注目し、ターゲットドメイン画像で疑似的に背景領域を入れ替えた画像を生成した際に推定結果が変化しない、という拘束を新たに損失関数として導入し、これによる精度向上結果を確認した。また、生成データの新たな活用として、これまでの単眼入力に基づくアピアランスベース視線推定だけではなく、複数のカメラ入力を用いたアピアランスベース視線推定モデルの開発に新たに取り組んだ。生成データのみで複眼アピアランスベース視線推定モデルが学習できることは実用上も大きな利点となる。さらに、未知の環境に視線推定モデルを適応する本課題から派生した新たなタスクとして、アイコンタクト検出モデルの教師なし学習という問題設定を提案し検証を行った。任意のビデオ入力を元にアイコンタクトが発生しているフレームを検出するモデルを学習することは容易な課題ではないが、提案手法では視線推定モデルの出力を元に与えた疑似ラベルを使って、多種多様なビデオからアイコンタクトのセグメンテーションモデルを学習する手法を提案した。
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
DOI:
10.1109/cvprw56347.2022.00546
发表时间:
2022-01
期刊:
2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW)
影响因子:
--
作者:
[Jiawei Qin;Takuru Shimoyama;Yusuke Sugano]
通讯作者:
Jiawei Qin;Takuru Shimoyama;Yusuke Sugano
ラベル分布の異なるドメインに対するアピアランスベース視線推定モデルの教師無し適応
基于外观的注视估计模型对具有不同标签分布的领域的无监督适应
DOI:
--
发表时间:
2021
期刊:
影响因子:
--
作者:
[下山拓流, 菅野裕介]
通讯作者:
菅野裕介
View-consistent Feature Alignment for Multi-view Appearance-based Gaze Estimation
基于多视图外观的注视估计的视图一致特征对齐
DOI:
--
发表时间:
2022
期刊:
影响因子:
--
作者:
[Yoichiro Hisadome, Yusuke Sugano]
通讯作者:
Yusuke Sugano
Learning Video-Independent Eye Contact Segmentation from?In-the-Wild Videos
从野外视频中学习与视频无关的眼神接触分割
DOI:
10.1007/978-3-031-26316-3_4
发表时间:
2023
期刊:
Lecture Notes in Computer Science (ACCV2022)
影响因子:
--
作者:
[Wu Tianyi, Sugano Yusuke]
通讯作者:
Sugano Yusuke
人にひらかれたメディア理解に向けて ―人を理解する、人と理解する―
理解受人启发的媒体 - 理解人,理解人 -
DOI:
--
发表时间:
2022
期刊:
影响因子:
--
作者:
[Qin Jiawei, Shimoyama Takuru, Sugano Yusuke, 菅野裕介]
通讯作者:
菅野裕介
海外基金