動きを利用したセンサ間対応の自動抽出の研究
動きを利用したセンサ間対応の自動抽出の研究
批准号:
09750532
负责人:
向井 利春
金额:
$1.28万
依托单位国家:
日本
项目类别:
Grant-in-Aid for Encouragement of Young Scientists (A)
财政年份:
1997
资助国家:
日本
项目状态:
已结题
起止时间:
1997 至 1998
中文摘要
人間は,複数の人が歩いているシーンから,聞こえてくる足音が視覚中のどの足から発せられたものであるかを見つけ出すことができる。これは,人間が視覚と聴覚の対応付けを行なっているからだと考えられる。本研究では,複数の物体が視野内に存在し,その一つが音を発している場合に,先見的な知識無しで音を発している物体を見つけ出す方法を確立した。具体的には,まず,音データと動画像データを同期して取り込む。次に,画像1フレームに対応する音データの小区間から振幅最大のものを選ぶことによって,画像フレームに対応する音データの系列を作る。この系列から,複数のピーク部分を抽出する。次に,音のピークに対応する画像フレームとその前後のフレームを選びだし,そのフレーム間差分をとることによって,音に対応する物体のエッジの(通常は複数の)候補を見つける。最後に,音のピークデータの系列と,画像からエッジ抽出した部分の画素数の相関係数を計算することによって,音と関連して生じているエッジ部分を見つけ,このエッジが囲む部分を音に対応する物体が画像中に存在する領域とする。実際の実験では,メトロノームと拍手している手が写っている動画像から,拍手の音を手がかりにして,画像中の手の位置を見つけ出すことに成功した。
英文摘要
人間は,複数の人が歩いているシーンから,聞こえてくる足音が視覚中のどの足から発せられたものであるかを見つけ出すことができる。これは,人間が視覚と聴覚の対応付けを行なっているからだと考えられる。本研究では,複数の物体が視野内に存在し,その一つが音を発している場合に,先見的な知識無しで音を発している物体を見つけ出す方法を確立した。具体的には,まず,音データと動画像データを同期して取り込む。次に,画像1フレームに対応する音データの小区間から振幅最大のものを選ぶことによって,画像フレームに対応する音データの系列を作る。この系列から,複数のピーク部分を抽出する。次に,音のピークに対応する画像フレームとその前後のフレームを選びだし,そのフレーム間差分をとることによって,音に対応する物体のエッジの(通常は複数の)候補を見つける。最後に,音のピークデータの系列と,画像からエッジ抽出した部分の画素数の相関係数を計算することによって,音と関連して生じているエッジ部分を見つけ,このエッジが囲む部分を音に対応する物体が画像中に存在する領域とする。実際の実験では,メトロノームと拍手している手が写っている動画像から,拍手の音を手がかりにして,画像中の手の位置を見つけ出すことに成功した。
期刊论文(1)
专著(0)
科研奖励(0)
会议论文
早川 和宏: "物理法則に基づく視聴覚情報の対応付け" 電子情報通信学会技術研究報告. 98・573. 13-18 (1999)
Kazuhiro Hayakawa:“根据物理定律关联视听信息”IEICE 技术报告 98・573(1999)。
DOI:
--
发表时间:
期刊:
影响因子:
--
作者:
[]
通讯作者:
不確かな階層的知識の表現と推論に関する新しいフレームワークの研究
-
批准号:03F03857
-
项目类别:Grant-in-Aid for JSPS Fellows
-
资助金额:$0.32万
-
财政年份:2005
-
负责人:向井 利春
-
依托单位:
動画像と加速度・角速度センサ出力を用いて対象の構造を復元する方法の研究
-
批准号:11750383
-
项目类别:Grant-in-Aid for Encouragement of Young Scientists (A)
-
资助金额:$1.41万
-
财政年份:1999
-
负责人:向井 利春
-
依托单位:
海外基金