Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216305%3A26230%2F26%3A0199376" target="_blank" >RIV/00216305:26230/26:0199376 - isvavai.cz</a>
Nalezeny alternativní kódy
RIV/68378092:_____/25:00646033
Výsledek na webu
<a href="https://prepis.jamap.cz/" target="_blank" >https://prepis.jamap.cz/</a>
DOI - Digital Object Identifier
—
Alternativní jazyky
Jazyk výsledku
čeština
Název v původním jazyce
Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek
Popis výsledku v původním jazyce
Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.
Název v anglickém jazyce
Speech recognizer adapted for generating dialectological transcription from audio recordings
Popis výsledku anglicky
Based on the input audio recording, the system automatically generates a transcription of the spoken speech into text, including the preservation of dialect specifics, including differential phenomena that are not available in the standard language. The output is formatted according to the rules of dialectological transcription, which was defined in the Methodology for Transferring of Structured Knowledge from Dialectology into Machine Learning (Šimečková et al., 2025, pp. 56–62; available online). The system is optimized for recordings of traditional Czech dialects from the Czech Republic, and can capture regional variants of Czech that standard speech recognizers ignore.
Klasifikace
Druh
R - Software
CEP obor
—
OECD FORD obor
10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)
Návaznosti výsledku
Projekt
<a href="/cs/project/DH23P03OVV010" target="_blank" >DH23P03OVV010: Jazyková paměť regionů České republiky. Metody strojového učení pro uchování, dokumentaci a prezentaci nářečí českého jazyka</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2025
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Údaje specifické pro druh výsledku
Interní identifikační kód produktu
Jamap přepis 1.0
Technické parametry
Systém vychází z volně dostupného Whisper modelu od OpenAI (Radford, 2022; encoder-decoder architektura, velikost large-v3-turbo). Model byl dále trénován (specializovaný fine-tuning), a to na 16,5 hodinách nářečních nahrávek poskytnutých od ÚJČ AV ČR. Jde o nahrávky různého stáří, získávané sběry od 60. let 20. století po současnost. Nahrávky byly datově segmentovány, čištěny a lingvisticky anotovány. Pro uživatelskou jednoduchost bylo pro tento systém vytvořeno webové rozhraní, které umožňuje otestovat rozpoznávač řeči přes internetový prohlížeč jako „cloudovou službu“.
Ekonomické parametry
Software významně zrychluje a zpřesňuje přepis nahrávek, které se stanou součástí knižní monografie a otevřené fonotéky, tedy výstupů plánovaných v rámci příslušného projektu NAKI III. Veškeré přepisy musely být dosud prováděny manuálně, nyní lze proces výrazně zautomatizovat a zefektivnit. V současnosti disponuje dialektologické oddělení 2 587 nahrávkami s celkovou stopáží 1 631 hodin (ke dni 10. 9. 2025), přepisy byly dosud pořízeny pouze u 23 % nahrávek, avšak většinově na úrovni reprezentativních ukázek o délce cca 5 minut. Ruční přepis hodinového záznamu řeči je v průměru pořizován 5 až několik desítek hodin (Šimečková a kol., 2025, s. 58), možnost automatického přepisu tak představuje výrazné zjednodušení v procesu zpracování nářečního audiálního materiálu.
IČO vlastníka výsledku
68378092
Název vlastníka
Ústav pro jazyk český AV ČR, v. v. i.