课题基金 / 基金详情

音の三要素に基づく生成過程を考慮した深層ベイズ自動採譜

音の三要素に基づく生成過程を考慮した深層ベイズ自動採譜
基于声音三要素考虑生成过程的深度贝叶斯自动转录
批准号:
22KJ2959
负责人:
田中 啓太郎
金额:
$1.6万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2023
资助国家:
日本
项目状态:
未结题
起止时间:
2023-03-08 至 2025-03-31

项目摘要

项目成果

相似基金

相关文献

中文摘要
翻译
本研究では,音楽音響信号を構成する全ての楽器に対して各楽譜を推定する,多楽器自動採譜技術を扱う.現代音楽では多種多様な楽器が使用されるため,多楽器自動採譜は楽曲の保存と再現の観点から重要な技術である.従来は,採譜対象の楽器を事前に複数種類指定し,各楽器に依存した個別の採譜モデルを作成することで,各楽譜の推定が行われていた.そのため,使用する訓練データに含まれない楽器をはじめとする多くの楽器は楽譜推定の対象外となり,一般の楽曲に対しては採譜できないという問題があった.そこで本年度は,汎用性の高い採譜手法開発への第一歩として,1) 音高と音色の分離に基づく広範な楽器音の解析,2) 楽器音の分離表現学習における奏法の考慮,という観点から以下の研究を行った.(1) 認識と生成の双方向性を同時に扱う深層ベイズモデルを用いて,対象楽器に制限を設けることなく,楽器音の音高と音色を分析する手法を開発した.時変特徴と時不変特徴を備えた変分自己符号化器を用いて,楽器音から音高と音色を認識し,また生成および編集も可能にした.入力楽器音に与える音高と音色に関する摂動と各潜在表現の不変性に着目することで,ラベル情報に起因する対象楽器の制約を撤廃した.しかし,同一の楽器でも奏法(ビブラートやピッチカート等)の違いによって,異なる楽器として認識されてしまう問題も残った.(2) 楽器音認識のための分離表現学習において,従来主流であった二要素分離を発展させ,奏法の違いを陽に考慮する三要素分離手法を開発した.これにより,一つの楽器に対し複数の奏法を割り当てることを可能にした.さらに,異なる楽器音の間で各要素を置換することで,楽器や音高,奏法の変換を行う手法も開発した.
英文摘要
本研究では,音楽音響信号を構成する全ての楽器に対して各楽譜を推定する,多楽器自動採譜技術を扱う.現代音楽では多種多様な楽器が使用されるため,多楽器自動採譜は楽曲の保存と再現の観点から重要な技術である.従来は,採譜対象の楽器を事前に複数種類指定し,各楽器に依存した個別の採譜モデルを作成することで,各楽譜の推定が行われていた.そのため,使用する訓練データに含まれない楽器をはじめとする多くの楽器は楽譜推定の対象外となり,一般の楽曲に対しては採譜できないという問題があった.そこで本年度は,汎用性の高い採譜手法開発への第一歩として,1) 音高と音色の分離に基づく広範な楽器音の解析,2) 楽器音の分離表現学習における奏法の考慮,という観点から以下の研究を行った.(1) 認識と生成の双方向性を同時に扱う深層ベイズモデルを用いて,対象楽器に制限を設けることなく,楽器音の音高と音色を分析する手法を開発した.時変特徴と時不変特徴を備えた変分自己符号化器を用いて,楽器音から音高と音色を認識し,また生成および編集も可能にした.入力楽器音に与える音高と音色に関する摂動と各潜在表現の不変性に着目することで,ラベル情報に起因する対象楽器の制約を撤廃した.しかし,同一の楽器でも奏法(ビブラートやピッチカート等)の違いによって,異なる楽器として認識されてしまう問題も残った.(2) 楽器音認識のための分離表現学習において,従来主流であった二要素分離を発展させ,奏法の違いを陽に考慮する三要素分離手法を開発した.これにより,一つの楽器に対し複数の奏法を割り当てることを可能にした.さらに,異なる楽器音の間で各要素を置換することで,楽器や音高,奏法の変換を行う手法も開発した.
期刊论文(11)
专著(0)
科研奖励(0)
会议论文
Patch-based Memory Efficient Diffusion Probabilistic Models
基于补丁的内存有效扩散概率模型
DOI: --
发表时间: 2022
期刊:
影响因子: --
作者: [Aida Kazuhiro, Hirao Marina, Funabashi Aiko, Sugimura Natsuhiko, Ota Eisuke, Yamaguchi Junichiro, Shinei Arakawa]
通讯作者: Shinei Arakawa
覚醒度と感情価に基づく音楽による画像スタイル変換
基于唤醒水平和情绪效价使用音乐进行图像风格转换
DOI: --
发表时间: 2023
期刊:
影响因子: --
作者: [Yuko Arthurs, Imre Lahdelma, Tuomas Eerola, アーサーズ裕子, 吉永 朋矢, 神庭 有花]
通讯作者: 神庭 有花
運指と運弓を反映した音響信号からのヴァイオリン演奏アニメーションの自動生成
根据反映指法和弓法的声学信号自动生成小提琴演奏动画
DOI: --
发表时间: 2022
期刊:
影响因子: --
作者: [Yuko Arthurs, Imre Lahdelma, Tuomas Eerola, アーサーズ裕子, 吉永 朋矢, 神庭 有花, 柏木 爽良, Keitaro Tanaka, Asuka Hirata, 平田 明日香]
通讯作者: 平田 明日香
動画内話者の音声強調における特定背景音声の透過
增强视频中讲话者的声音时特定背景音频的透明度
DOI: --
发表时间: 2023
期刊:
影响因子: --
作者: [Yuko Arthurs, Imre Lahdelma, Tuomas Eerola, アーサーズ裕子, 吉永 朋矢]
通讯作者: 吉永 朋矢
11
    海外基金