Vše

Co hledáte?

Vše
Projekty
Výsledky výzkumu
Subjekty

Rychlé hledání

  • Projekty podpořené TA ČR
  • Významné projekty
  • Projekty s nejvyšší státní podporou
  • Aktuálně běžící projekty

Chytré vyhledávání

  • Takto najdu konkrétní +slovo
  • Takto z výsledků -slovo zcela vynechám
  • “Takto můžu najít celou frázi”

Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek

Identifikátory výsledku

  • Kód výsledku v IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216305%3A26230%2F26%3A0199376" target="_blank" >RIV/00216305:26230/26:0199376 - isvavai.cz</a>

  • Nalezeny alternativní kódy

    RIV/68378092:_____/25:00646033

  • Výsledek na webu

    <a href="https://prepis.jamap.cz/" target="_blank" >https://prepis.jamap.cz/</a>

  • DOI - Digital Object Identifier

Alternativní jazyky

  • Jazyk výsledku

    čeština

  • Název v původním jazyce

    Rozpoznávač řeči adaptovaný pro generování dialektologické transkripce z audionahrávek

  • Popis výsledku v původním jazyce

    Systém na základě vstupní zvukové nahrávky automaticky generuje přepis mluveného projevu do textu včetně zachování nářečních specifik, a to i jevů diferenčních, jimiž nedisponuje spisovný jazyk. Výstup je formátován podle pravidel dialektologické transkripce, která byla definována v Metodice pro převod strukturovaných znalostí z oboru dialektologie do strojového učení (Šimečková a kol., 2025, s. 56–62; dostupné online). Systém je optimalizován pro záznamy tradičních dialektů češtiny z území České republiky, přičemž dokáže zachytit regionální varianty češtiny, které standardní rozpoznávače řeči ignorují.

  • Název v anglickém jazyce

    Speech recognizer adapted for generating dialectological transcription from audio recordings

  • Popis výsledku anglicky

    Based on the input audio recording, the system automatically generates a transcription of the spoken speech into text, including the preservation of dialect specifics, including differential phenomena that are not available in the standard language. The output is formatted according to the rules of dialectological transcription, which was defined in the Methodology for Transferring of Structured Knowledge from Dialectology into Machine Learning (Šimečková et al., 2025, pp. 56–62; available online). The system is optimized for recordings of traditional Czech dialects from the Czech Republic, and can capture regional variants of Czech that standard speech recognizers ignore.

Klasifikace

  • Druh

    R - Software

  • CEP obor

  • OECD FORD obor

    10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)

Návaznosti výsledku

  • Projekt

    <a href="/cs/project/DH23P03OVV010" target="_blank" >DH23P03OVV010: Jazyková paměť regionů České republiky. Metody strojového učení pro uchování, dokumentaci a prezentaci nářečí českého jazyka</a><br>

  • Návaznosti

    P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)

Ostatní

  • Rok uplatnění

    2025

  • Kód důvěrnosti údajů

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Údaje specifické pro druh výsledku

  • Interní identifikační kód produktu

    Jamap přepis 1.0

  • Technické parametry

    Systém vychází z volně dostupného Whisper modelu od OpenAI (Radford, 2022; encoder-decoder architektura, velikost large-v3-turbo). Model byl dále trénován (specializovaný fine-tuning), a to na 16,5 hodinách nářečních nahrávek poskytnutých od ÚJČ AV ČR. Jde o nahrávky různého stáří, získávané sběry od 60. let 20. století po současnost. Nahrávky byly datově segmentovány, čištěny a lingvisticky anotovány. Pro uživatelskou jednoduchost bylo pro tento systém vytvořeno webové rozhraní, které umožňuje otestovat rozpoznávač řeči přes internetový prohlížeč jako „cloudovou službu“.

  • Ekonomické parametry

    Software významně zrychluje a zpřesňuje přepis nahrávek, které se stanou součástí knižní monografie a otevřené fonotéky, tedy výstupů plánovaných v rámci příslušného projektu NAKI III. Veškeré přepisy musely být dosud prováděny manuálně, nyní lze proces výrazně zautomatizovat a zefektivnit. V současnosti disponuje dialektologické oddělení 2 587 nahrávkami s celkovou stopáží 1 631 hodin (ke dni 10. 9. 2025), přepisy byly dosud pořízeny pouze u 23 % nahrávek, avšak většinově na úrovni reprezentativních ukázek o délce cca 5 minut. Ruční přepis hodinového záznamu řeči je v průměru pořizován 5 až několik desítek hodin (Šimečková a kol., 2025, s. 58), možnost automatického přepisu tak představuje výrazné zjednodušení v procesu zpracování nářečního audiálního materiálu.

  • IČO vlastníka výsledku

    68378092

  • Název vlastníka

    Ústav pro jazyk český AV ČR, v. v. i.