人間の行動状況理解のための時空間の非線形圧縮による映像の情報要約機構
人間の行動状況理解のための時空間の非線形圧縮による映像の情報要約機構
批准号:
11230205
负责人:
美濃 導彦
金额:
$24.51万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for Scientific Research on Priority Areas (B)
财政年份:
1999
资助国家:
日本
项目状态:
已结题
起止时间:
1999 至 2001
中文摘要
本計画研究の目標は、講義を様々な観点から蓄積してアーカイブ化するシステムを構築することと、利用者自身がアーカイブの中から必要な部分を選択し、要約する枠組みを提案することである。様々な利用者の目的に応じることを可能とするために、講義アーカイブにはできるだけ多様な映像を記録しておくことが望ましい。そこで、受講者の動きを反映した活性度に基づく撮影と、話者位置を推定することによって、質問等をしている受講者の撮影を実現した。まず、受講者の活性度に応じた多様な映像を撮影するために、確率密度関数に基くカメラワークの決定手法を提案した。できるだけ多くの受講者を映像フレーム内に納めるため、位置的に近くに存在する受講者群を被写体の侯補とし、多数の被写体侯補に対して、受講者の動きに基づく活性度を割り当てた。そして、被写体候補を活性度に基いて順序付けたのち、撮影に利用できるカメラ台数に応じて等分し、それぞれのグループ内に含まれる被写体侯補を選択して撮影する確率を高めた確率密度関数を各カメラに対して割り当てることにより、ある時刻における受講者を、活性度に基き多様に撮影する手法を提案した。また、質問等をしている受講者の表情を撮影するために、講義室に複数設置した分散マイクシステムを用いた話者位置推定を実現した。二本のマイクからなるマイク対に到達する音の位相差を利用して音源方向を推定し、これを複数のマイク対に対して求めることによって、各音源方向の交点付近の領域に存在する話者位置を推定することが可能となった。さらに、利用者自身が視聴したい講義映像の被写体の数や撮影サイズなどの傾向を設定することにより、上記の手法によって撮影した複数の講義映像から、設定を満たすように自動選択して提示する枠組みについて検討した。
英文摘要
本計画研究の目標は、講義を様々な観点から蓄積してアーカイブ化するシステムを構築することと、利用者自身がアーカイブの中から必要な部分を選択し、要約する枠組みを提案することである。様々な利用者の目的に応じることを可能とするために、講義アーカイブにはできるだけ多様な映像を記録しておくことが望ましい。そこで、受講者の動きを反映した活性度に基づく撮影と、話者位置を推定することによって、質問等をしている受講者の撮影を実現した。まず、受講者の活性度に応じた多様な映像を撮影するために、確率密度関数に基くカメラワークの決定手法を提案した。できるだけ多くの受講者を映像フレーム内に納めるため、位置的に近くに存在する受講者群を被写体の侯補とし、多数の被写体侯補に対して、受講者の動きに基づく活性度を割り当てた。そして、被写体候補を活性度に基いて順序付けたのち、撮影に利用できるカメラ台数に応じて等分し、それぞれのグループ内に含まれる被写体侯補を選択して撮影する確率を高めた確率密度関数を各カメラに対して割り当てることにより、ある時刻における受講者を、活性度に基き多様に撮影する手法を提案した。また、質問等をしている受講者の表情を撮影するために、講義室に複数設置した分散マイクシステムを用いた話者位置推定を実現した。二本のマイクからなるマイク対に到達する音の位相差を利用して音源方向を推定し、これを複数のマイク対に対して求めることによって、各音源方向の交点付近の領域に存在する話者位置を推定することが可能となった。さらに、利用者自身が視聴したい講義映像の被写体の数や撮影サイズなどの傾向を設定することにより、上記の手法によって撮影した複数の講義映像から、設定を満たすように自動選択して提示する枠組みについて検討した。
期刊论文(9)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
河原達也: "音声認識結果の信頼度を用いた頑健な混合主導対話の実現法"情報処理学会研究報告. 2000-SLP-30-9. (2000)
Tatsuya Kawahara:“利用语音识别结果的可靠性实现稳健的混合主动对话的方法”日本信息处理学会研究报告 2000-SLP-30-9。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Takashi Matsuyama: "Human Head Tracking using Adaptive Appearance Models with a Fixed-Viewpoint Pan-Tilt-Zoom Camera"Proc. of 4th International Conference on Face and Gesture Recognition. (2000)
Takashi Matsuyama:“使用自适应外观模型和固定视点平移倾斜变焦相机进行人体头部跟踪”Proc。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
美濃導彦: "Imaging a 3D Lecture Room by Interpreting Its Dynamic Situation"Proceedings of The Fourth International Workshop on the Cooperative Distributed Vision. 371-412 (2001)
Norihiko Mino:“通过解释其动态情况来想象 3D 演讲室”第四届合作分布式视觉国际研讨会论文集 371-412 (2001)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
Takashi Matsuyama: "Active Image Capturing and Dynamic Scene Visualization by Cooperative Distributed Vision"Advanced Multimedia Content Processing (S. Nishio and F. Kishino eds.) Lecture Notes in Computer Science. No. 1554. 252-288 (1999)
Takashi Matsuyama:“协作分布式视觉的主动图像捕获和动态场景可视化”高级多媒体内容处理(S. Nishio 和 F. Kishino 编辑)计算机科学讲义。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
亀田能成: "複数のカメラを用いた複数ユーザに対する講義の実時間映像化法"電子情報通信学会論文誌. Vol.J82-D-II,No,10. 1598-1605 (1999)
Yoshinari Kameda:“使用多个摄像机的多个用户讲座的实时可视化方法”,电子信息和通信工程师协会学报,第 10 期。1598-1605(1999 年)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
共 9 条
姿勢空間への投影によるボトムアップ型マウス行動分析
-
批准号:16K12463
-
项目类别:Grant-in-Aid for Challenging Exploratory Research
-
资助金额:$2.16万
-
财政年份:2016
-
负责人:美濃 導彦
-
依托单位:
仮想服飾環境における空間操作法
-
批准号:09220211
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$0.9万
-
财政年份:1997
-
负责人:美濃 導彦
-
依托单位:
仮想服飾環境における空間操作法
-
批准号:08234215
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$1.92万
-
财政年份:1996
-
负责人:美濃 導彦
-
依托单位:
仮想服飾環境における空間操作法
-
批准号:07244212
-
项目类别:Grant-in-Aid for Scientific Research on Priority Areas
-
资助金额:$2.75万
-
财政年份:1995
-
负责人:美濃 導彦
-
依托单位:
トップダウン情報を利用した拘束充足型画像処理
-
批准号:04750324
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1992
-
负责人:美濃 導彦
-
依托单位:
動的輪郭モデルに基づくトップダウン画像理解
-
批准号:03750279
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$0.58万
-
财政年份:1991
-
负责人:美濃 導彦
-
依托单位:
海外基金