On the Contribution of Articulatory Features to Speech Synthesis
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F49777513%3A23520%2F18%3A43952752" target="_blank" >RIV/49777513:23520/18:43952752 - isvavai.cz</a>
Výsledek na webu
<a href="https://link.springer.com/chapter/10.1007%2F978-3-319-99579-3_42" target="_blank" >https://link.springer.com/chapter/10.1007%2F978-3-319-99579-3_42</a>
DOI - Digital Object Identifier
<a href="http://dx.doi.org/10.1007/978-3-319-99579-3_42" target="_blank" >10.1007/978-3-319-99579-3_42</a>
Alternativní jazyky
Jazyk výsledku
angličtina
Název v původním jazyce
On the Contribution of Articulatory Features to Speech Synthesis
Popis výsledku v původním jazyce
There are several features that are used for the unit selection speech synthesis. Among the most used for computing a concatenation cost are energy, F0 and Mel-frequency cepstrum coefficients (MFCC) that usually give a good description of a speech signal. In our work, we focus on a usage of articulatory features. We want to determine whether they are correlated with MFCC and in that case, if they can replace MFCC or bring a new information into the process of speech synthesis. To obtain the articulatory data, we used electromagnetic articulograph AG501 and then we examined the correlation of two sequences of join costs each described by different features.
Název v anglickém jazyce
On the Contribution of Articulatory Features to Speech Synthesis
Popis výsledku anglicky
There are several features that are used for the unit selection speech synthesis. Among the most used for computing a concatenation cost are energy, F0 and Mel-frequency cepstrum coefficients (MFCC) that usually give a good description of a speech signal. In our work, we focus on a usage of articulatory features. We want to determine whether they are correlated with MFCC and in that case, if they can replace MFCC or bring a new information into the process of speech synthesis. To obtain the articulatory data, we used electromagnetic articulograph AG501 and then we examined the correlation of two sequences of join costs each described by different features.
Klasifikace
Druh
D - Stať ve sborníku
CEP obor
—
OECD FORD obor
20205 - Automation and control systems
Návaznosti výsledku
Projekt
<a href="/cs/project/GA16-04420S" target="_blank" >GA16-04420S: Kombinované využití fonetických a korpusově založených postupů při odstraňování rušivých jevů v řečové syntéze</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2018
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Údaje specifické pro druh výsledku
Název statě ve sborníku
Speech and Computer 20th International Conference, SPECOM 2018 Leipzig, Germany, September 18–22, 2018, Proceedings
ISBN
978-3-319-99578-6
ISSN
0302-9743
e-ISSN
1611-3349
Počet stran výsledku
10
Strana od-do
398-407
Název nakladatele
Springer Nature Switzerland AG
Místo vydání
Cham
Místo konání akce
Leipzig, Germany
Datum konání akce
18. 9. 2018
Typ akce podle státní příslušnosti
WRD - Celosvětová akce
Kód UT WoS článku
—