All

What are you looking for?

All
Projects
Results
Organizations

Quick search

  • Projects supported by TA ČR
  • Excellent projects
  • Projects with the highest public support
  • Current projects

Smart search

  • That is how I find a specific +word
  • That is how I leave the -word out of the results
  • “That is how I can find the whole phrase”

Speech recognizer adapted for generating dialectological transcription from audio recordings

The result's identifiers

  • Result code in IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216305%3A26230%2F26%3A0199376" target="_blank" >RIV/00216305:26230/26:0199376 - isvavai.cz</a>

  • Alternative codes found

    RIV/68378092:_____/25:00646033

  • Result on the web

    <a href="https://prepis.jamap.cz/" target="_blank" >https://prepis.jamap.cz/</a>

  • DOI - Digital Object Identifier

Alternative languages

  • Result language

    čeština

  • Original language name

    Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek

  • Original language description

    Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.

  • Czech name

    Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek

  • Czech description

    Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.

Classification

  • Type

    R - Software

  • CEP classification

  • OECD FORD branch

    10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)

Result continuities

  • Project

    <a href="/en/project/DH23P03OVV010" target="_blank" >DH23P03OVV010: Language memory of the regions of the Czech Republic. Machine learning methods for preservation, documentation and presentation of the Czech dialects</a><br>

  • Continuities

    P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)

Others

  • Publication year

    2025

  • Confidentiality

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Data specific for result type

  • Internal product ID

    Jamap přepis 1.0

  • Technical parameters

    Systém vychází z volně dostupného Whisper modelu od OpenAI (Radford, 2022; encoder-decoder architektura, velikost large-v3-turbo). Model byl dále trénován (specializovaný fine-tuning), a to na 16,5 hodinách nářečních nahrávek poskytnutých od ÚJČ AV ČR. Jde o nahrávky různého stáří, získávané sběry od 60. let 20. století po současnost. Nahrávky byly datově segmentovány, čištěny a lingvisticky anotovány. Pro uživatelskou jednoduchost bylo pro tento systém vytvořeno webové rozhraní, které umožňuje otestovat rozpoznávač řeči přes internetový prohlížeč jako „cloudovou službu“.

  • Economical parameters

    Software významně zrychluje a zpřesňuje přepis nahrávek, které se stanou součástí knižní monografie a otevřené fonotéky, tedy výstupů plánovaných v rámci příslušného projektu NAKI III. Veškeré přepisy musely být dosud prováděny manuálně, nyní lze proces výrazně zautomatizovat a zefektivnit. V současnosti disponuje dialektologické oddělení 2 587 nahrávkami s celkovou stopáží 1 631 hodin (ke dni 10. 9. 2025), přepisy byly dosud pořízeny pouze u 23 % nahrávek, avšak většinově na úrovni reprezentativních ukázek o délce cca 5 minut. Ruční přepis hodinového záznamu řeči je v průměru pořizován 5 až několik desítek hodin (Šimečková a kol., 2025, s. 58), možnost automatického přepisu tak představuje výrazné zjednodušení v procesu zpracování nářečního audiálního materiálu.

  • Owner IČO

    68378092

  • Owner name

    Ústav pro jazyk český AV ČR, v. v. i.