Parametrisation of prosody and voice quality for concatenatice speech synthesis in view of emotion expression
Parametrisation of prosody and voice quality for concatenatice speech synthesis in view of emotion expression
批准号:
24430698
负责人:
Dr. Marc Schröder
金额:
$0.0万
依托单位国家:
德国
项目类别:
Research Grants
财政年份:
2006
资助国家:
德国
项目状态:
已结题
起止时间:
2005-12-31 至 2010-12-31
中文摘要
点击翻译按钮获取中文摘要
英文摘要
Ein Haupthindernis für die Akzeptanz von Sprachsynthese ist ihre mangelnde Ausdruckskraft. Um z.B. den emotionalen Gehalt von Äußerungen angemessen vermitteln zu können, müsste der Klang der synthetischen Stimme verändert werden; jedoch fehlt neueren Sprachsyntheseverfahren die Möglichkeit, die relevanten Parameter im nötigen Umfang zu beeinflussen. In der Sprachsynthese sind derzeit Natürlichkeit und Flexibilität nicht vereinbar: neuere korpusbasierte Unit Selection Syntheseverfahren klingen zwar oft natürlich, können aber nur einen einzigen Sprechstil realisieren, der bei der Aufnahme des Sprachkorpus bestimmt wird. Dem gegenüber stehen ältere Verfahren wie Formant- oder Diphonsynthese, die zwar parametrisierbar sind, aber recht unnatürlich klingen. Es existiert derzeit keine Synthesemethode, die die Natürlichkeit korpus-basierter Synthese mit der Parametrisierbarkeit früherer Systeme verbindet. Das Projekt PAVOQUE soll einen wesentlichen Beitrag dazu leisten, diese Unvereinbarkeit von Synthesequalität und Parametrisierbarkeit zu überwinden. In einem aktuellen, korpus-basierten Sprachsynthesesystem erforscht es Methoden für die nötige Parametrisierbarkeit der Schlüsselparameter für den Ausdruck von Emotionen in der Stimme: Prosodie (Intonation und Rhythmus) und Stimmqualität. Zwei Lösungsansätze werden verfolgt: Parameter-basierte Selektion von Units aus dem Korpus, und Nachverarbeitung des synthetischen Sprachsignals mit Signalmanipulationsverfahren. Dadurch soll ein hohes Mali an Ausdruckskraft bei gleichbleibend guter Qualität des Sprachsignals bereitgestellt werden.
期刊论文(1)
专著(0)
科研奖励(0)
会议论文
DOI:
10.1109/tasl.2010.2041113
发表时间:
2010-07
期刊:
IEEE Transactions on Audio, Speech, and Language Processing
影响因子:
--
作者:
[O. Türk;M. Schröder]
通讯作者:
O. Türk;M. Schröder
海外基金