Parametrisation of prosody and voice quality for concatenatice speech synthesis in view of emotion expression
Parametrisation of prosody and voice quality for concatenatice speech synthesis in view of emotion expression
批准号:
24430698
负责人:
Dr. Marc Schröder
金额:
$0.0万
依托单位国家:
德国
项目类别:
Research Grants
财政年份:
2006
资助国家:
德国
项目状态:
已结题
起止时间:
2005-12-31 至 2010-12-31
中文摘要
在高等院校的研究中,科学合成是一种先进的技术。Um z.B. den emotionalen Gehalt von Äußerungen angemessen vermitteln zu können, m<e:1> sste der Klang der synthetischen time verändert werden;jedoch felt neweren Sprachsyntheseverfahren die Möglichkeit, die相关参数在nötigen Umfang zu beeinfussen。In der Sprachsynthese sind derzeit nat<s:1> rlichkeit und Flexibilität nicht vereinbar: neuere korpusbasierte单位选择Syntheseverfahren klingen zwar of nat<s:1> rlich, können aber nur einzen Sprechstil realisieren, der der Aufnahme des Sprachkorpus bestestimmt wnd。Dem gegenen ber stehen ältere Verfahren wie Formant- oder diphonsynthesis, die zwar parametric isierbar sind, aber recht unnatrlich klingen。存在一种基于参数的合成方法,即基于参数的合成方法,即基于参数的合成方法。当项目被设计成一个完整的系统时,它就会被设计成一个完整的系统,并被设计成一个完整的系统。In einem aktuellen, korpuss - baserten sprachsynthessystem erforscht es Methoden f<s:1> r die nötige parametertrisierbarkeit der schl<e:1> sselparameter f<e:1> r den Ausdruck von Emotionen In der time: Prosodie (Intonation und Rhythmus) und Stimmqualität。Zwei Lösungsansätze werden verfolt . [j] .基于参数的单位选择方法,和Nachverarbeitung des synthetischen Sprachsignals . mit Signalmanipulationsverfahren。达达尔奇在马里和澳大利亚的航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家航海家。
英文摘要
Ein Haupthindernis für die Akzeptanz von Sprachsynthese ist ihre mangelnde Ausdruckskraft. Um z.B. den emotionalen Gehalt von Äußerungen angemessen vermitteln zu können, müsste der Klang der synthetischen Stimme verändert werden; jedoch fehlt neueren Sprachsyntheseverfahren die Möglichkeit, die relevanten Parameter im nötigen Umfang zu beeinflussen. In der Sprachsynthese sind derzeit Natürlichkeit und Flexibilität nicht vereinbar: neuere korpusbasierte Unit Selection Syntheseverfahren klingen zwar oft natürlich, können aber nur einen einzigen Sprechstil realisieren, der bei der Aufnahme des Sprachkorpus bestimmt wird. Dem gegenüber stehen ältere Verfahren wie Formant- oder Diphonsynthese, die zwar parametrisierbar sind, aber recht unnatürlich klingen. Es existiert derzeit keine Synthesemethode, die die Natürlichkeit korpus-basierter Synthese mit der Parametrisierbarkeit früherer Systeme verbindet. Das Projekt PAVOQUE soll einen wesentlichen Beitrag dazu leisten, diese Unvereinbarkeit von Synthesequalität und Parametrisierbarkeit zu überwinden. In einem aktuellen, korpus-basierten Sprachsynthesesystem erforscht es Methoden für die nötige Parametrisierbarkeit der Schlüsselparameter für den Ausdruck von Emotionen in der Stimme: Prosodie (Intonation und Rhythmus) und Stimmqualität. Zwei Lösungsansätze werden verfolgt: Parameter-basierte Selektion von Units aus dem Korpus, und Nachverarbeitung des synthetischen Sprachsignals mit Signalmanipulationsverfahren. Dadurch soll ein hohes Mali an Ausdruckskraft bei gleichbleibend guter Qualität des Sprachsignals bereitgestellt werden.
期刊论文(1)
专著(0)
科研奖励(0)
会议论文
DOI:
10.1109/tasl.2010.2041113
发表时间:
2010-07
期刊:
IEEE Transactions on Audio, Speech, and Language Processing
影响因子:
--
作者:
[O. Türk;M. Schröder]
通讯作者:
O. Türk;M. Schröder
海外基金