SEASR-CZE - speech recognizer for search purposes with models for the Czech language

The result's identifiers

Result code in IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F49777513%3A23520%2F12%3A43917996" target="_blank" >RIV/49777513:23520/12:43917996 - isvavai.cz</a>
Result on the web
<a href="http://www.kky.zcu.cz/cs/sw/SEASR-CZE" target="_blank" >http://www.kky.zcu.cz/cs/sw/SEASR-CZE</a>
DOI - Digital Object Identifier
—

Alternative languages

Result language
čeština
Original language name
SEASR-CZE - rozpoznávač řeči pro účely vyhledávání s modely pro češtinu
Original language description
Standardní systém rozpoznávání řeči sestává z akustického modelu, modulu pro parametrizaci řeči a jazykového modelu. Akustické modely v našem systému jsou založeny na architektuře skrytých Markovových modelů (HMM), která představuje "lege artis" přístupv současném rozpoznávání mluvené řeči. Jsou použity standardní třístavové akustické modely s Gaussovskými směsmi. Model bere v úvahu trifónové závislosti včetně mezislovních. Řeč je parametrizována pomocí 15 PLP koeficientů a jejich delta a delta-delta derivací (tj. vektor příznaků má dimenzi 45). Příznaky jsou extrahovány 100x za vteřinu a je aplikována kepstrální normalizace na úrovni řečníka. Systém obsahuje též zobecněný model ticha a při jeho tvorbě byly použity špičkové metody pro adaptivní a diskriminativní trénování. Pokud se týká jazykového modelu, systém obsahuje dva základní modely - oba trigramové. První z nich je natrénován pouze z pomocí přepisů z "mateřské" domény, zatímco druhý využívá jako trénovací data texty z rozsáhl
Czech name
SEASR-CZE - rozpoznávač řeči pro účely vyhledávání s modely pro češtinu
Czech description
Standardní systém rozpoznávání řeči sestává z akustického modelu, modulu pro parametrizaci řeči a jazykového modelu. Akustické modely v našem systému jsou založeny na architektuře skrytých Markovových modelů (HMM), která představuje "lege artis" přístupv současném rozpoznávání mluvené řeči. Jsou použity standardní třístavové akustické modely s Gaussovskými směsmi. Model bere v úvahu trifónové závislosti včetně mezislovních. Řeč je parametrizována pomocí 15 PLP koeficientů a jejich delta a delta-delta derivací (tj. vektor příznaků má dimenzi 45). Příznaky jsou extrahovány 100x za vteřinu a je aplikována kepstrální normalizace na úrovni řečníka. Systém obsahuje též zobecněný model ticha a při jeho tvorbě byly použity špičkové metody pro adaptivní a diskriminativní trénování. Pokud se týká jazykového modelu, systém obsahuje dva základní modely - oba trigramové. První z nich je natrénován pouze z pomocí přepisů z "mateřské" domény, zatímco druhý využívá jako trénovací data texty z rozsáhl

Classification

Type
R - Software
CEP classification
AJ - Literature, mass media, audio-visual activities
OECD FORD branch
—

Result continuities

Project
<a href="/en/project/DF12P01OVV022" target="_blank" >DF12P01OVV022: ASR- and MT-based Access to a Large Archive of Cultural Heritage (AMALACH)</a><br>
Continuities
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)

Others

Publication year
2012
Confidentiality
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Data specific for result type

Internal product ID
SEASR_CZE
Technical parameters
Akustické modely - 3-stavové HMM, mezislovní trifónové závislosti, kepstrální normalizace, adaptivní a diskriminativní trénink. Extrakce příznaků - 15 PLP + delta + delta-delta. Jazykový model - trigram. Dekodér - dvouprůchodový, generování slovních a fonémových mřížek.
Economical parameters
Výsledek je plánovaným výstupem projektu DF12P01OVV022 "Zpřístupnění rozsáhlého video archivu kulturního dědictví pomocí metod automatického rozpoznávání mluvené řeči a strojového překladu. (AMALACH)". Slouží k automatickému zpracování audiovizuálního archivu metodami automatického rozpoznávání řeči do formy, která umožňuje rychlé a efektivní vyhledávání zadaných slov či frází.
Owner IČO
49777513
Owner name
Západočeská univerzita v Plzni

Similar results(10)

SEASR-ENG - speech recognizer tailored for subsequent search - English models Comparison of MFCC and PLP parameterizations in the speaker independent continuous speech recognition task Neural-Network-based Spectrum Processing for Speech Recognition and Speaker Verification

What are you looking for?

Quick search

Smart search

SEASR-CZE - speech recognizer for search purposes with models for the Czech language

The result's identifiers

Alternative languages

Classification

Result continuities

Others

Data specific for result type

Similar results(10)

What are you looking for?

Quick search

Smart search

Result description

The result's identifiers

The result's identifiers

Alternative languages

Alternative languages

Classification

Classification

Result continuities

Result continuities

Others

Others

Data specific for result type

Data specific for result type

Similar results(10)