Speech recognizer adapted for generating dialectological transcription from audio recordings
The result's identifiers
Result code in IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216305%3A26230%2F26%3A0199376" target="_blank" >RIV/00216305:26230/26:0199376 - isvavai.cz</a>
Alternative codes found
RIV/68378092:_____/25:00646033
Result on the web
<a href="https://prepis.jamap.cz/" target="_blank" >https://prepis.jamap.cz/</a>
DOI - Digital Object Identifier
—
Alternative languages
Result language
čeština
Original language name
Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek
Original language description
Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.
Czech name
Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek
Czech description
Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.
Classification
Type
R - Software
CEP classification
—
OECD FORD branch
10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)
Result continuities
Project
<a href="/en/project/DH23P03OVV010" target="_blank" >DH23P03OVV010: Language memory of the regions of the Czech Republic. Machine learning methods for preservation, documentation and presentation of the Czech dialects</a><br>
Continuities
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Others
Publication year
2025
Confidentiality
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Data specific for result type
Internal product ID
Jamap přepis 1.0
Technical parameters
Systém vychází z volně dostupného Whisper modelu od OpenAI (Radford, 2022; encoder-decoder architektura, velikost large-v3-turbo). Model byl dále trénován (specializovaný fine-tuning), a to na 16,5 hodinách nářečních nahrávek poskytnutých od ÚJČ AV ČR. Jde o nahrávky různého stáří, získávané sběry od 60. let 20. století po současnost. Nahrávky byly datově segmentovány, čištěny a lingvisticky anotovány. Pro uživatelskou jednoduchost bylo pro tento systém vytvořeno webové rozhraní, které umožňuje otestovat rozpoznávač řeči přes internetový prohlížeč jako „cloudovou službu“.
Economical parameters
Software významně zrychluje a zpřesňuje přepis nahrávek, které se stanou součástí knižní monografie a otevřené fonotéky, tedy výstupů plánovaných v rámci příslušného projektu NAKI III. Veškeré přepisy musely být dosud prováděny manuálně, nyní lze proces výrazně zautomatizovat a zefektivnit. V současnosti disponuje dialektologické oddělení 2 587 nahrávkami s celkovou stopáží 1 631 hodin (ke dni 10. 9. 2025), přepisy byly dosud pořízeny pouze u 23 % nahrávek, avšak většinově na úrovni reprezentativních ukázek o délce cca 5 minut. Ruční přepis hodinového záznamu řeči je v průměru pořizován 5 až několik desítek hodin (Šimečková a kol., 2025, s. 58), možnost automatického přepisu tak představuje výrazné zjednodušení v procesu zpracování nářečního audiálního materiálu.
Owner IČO
68378092
Owner name
Ústav pro jazyk český AV ČR, v. v. i.