Systém automatického rozpoznávání řeči pro osoby s kognitivní poruchou
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F49777513%3A23520%2F25%3A43977970" target="_blank" >RIV/49777513:23520/25:43977970 - isvavai.cz</a>
Výsledek na webu
<a href="https://kky-sw.zcu.cz/cs/sw/ddd-asr" target="_blank" >https://kky-sw.zcu.cz/cs/sw/ddd-asr</a>
DOI - Digital Object Identifier
—
Alternativní jazyky
Jazyk výsledku
čeština
Název v původním jazyce
Systém automatického rozpoznávání řeči pro osoby s kognitivní poruchou
Popis výsledku v původním jazyce
Výsledek je software pro automatické rozpoznávání češtiny zaměřené na řeč starší populace a osob s možnými řečovými odchylkami souvisejícími s kognitivní poruchou. Součástí výsledku jsou natrénované modely a aplikační rozhraní umožňující integraci do webové aplikace projektu i do dalších systémů. Model byl optimalizován a ověřen na cílových datech projektu a současně testování na obecných a out-of-domain datech pro kontrolu generalizace. Dokumentace obsahuje technický popis, akceptační požadavky a ověření funkčnosti, programátorské podklady a uživatelský manuál.
Název v anglickém jazyce
Automatic Speech Recognition System for People with Cognitive Impairment
Popis výsledku anglicky
The result is a software system for automatic recognition of spoken Czech, focused on speech produced by older adults and individuals with potential speech deviations related to cognitive impairment. The result includes trained acoustic and language models as well as an application programming interface enabling integration into the project’s web application and other external systems.The model was optimized and validated on the project’s target data and was additionally tested on general and out-of-domain data to assess its generalization capability. The accompanying documentation includes a technical description, acceptance requirements and functional verification, developer documentation, and a user manual.
Klasifikace
Druh
R - Software
CEP obor
—
OECD FORD obor
20205 - Automation and control systems
Návaznosti výsledku
Projekt
<a href="/cs/project/TQ01000332" target="_blank" >TQ01000332: Telemedicínské samovyšetření řeči a paměti pro rychlou detekci kognitivních poruch metodami strojového učení</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2025
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Údaje specifické pro druh výsledku
Interní identifikační kód produktu
ZCU/KKY/2025/004
Technické parametry
Výsledek je v projektu TQ01000332 provozován jako služba v prostředí SpeechCloud a je volán z webové aplikace V5 (V5 zajišťuje streamování audia do SpeechCloudu, data sama neukládá). Výsledek slouží jako klíčová komponenta převodu řeči na text pro následné kroky pipeline. Současně je varianta modelu s jazykovým modelem použita i jako zdroj jedné z vrstev automatických přepisů publikovaných v datasetu DSCD-CZ-2 (V1). Pro demonstraci je výsledek dostupný přes veřejné testovací webové rozhraní (SpeechCloud konzole) a přes UWebASR, odkaz na stránce s popisem výsledku - https://kky-sw.zcu.cz/cs/sw/ddd-asr. Software byl vytvořen v rámci grantu TA ČR TQ01000332. Vlastníkem softwaru je Západočeská univerzita v Plzni, Univerzitní 8 Plzeň. Kontaktní osoba: Ing. Luboš Šmídl, Ph.D. (smidl@kky.zcu.cz)
Ekonomické parametry
Ekonomické parametry nejsou jednoduče přímo vyčíslitelné. Výsledek je primárně využíván jako interní komponenta řešení (backendová služba volaná z V5). Externí integrace je možná prostřednictvím aplikačního rozhraní (API) za podmínek stanovených držiteli práv. Pro demonstraci je výsledek dostupný přes veřejné testovací webové rozhraní (SpeechCloud konzole) a přes UWebASR. Přidaná hodnota spočívá ve snížení nákladů na manuální transkripci řeči v klinických a výzkumných pracovních postupech, protože automatické rozpoznávání řeči odstraňuje potřebu ručního přepisování rozsáhlých audio nahrávek. To rovněž přispívá k efektivnějšímu využití času specialistů a výzkumného personálu a zrychlení zpracování dat, což v konečném důsledku snižuje režijní náklady spojené s validací a anotací řečových dat.
IČO vlastníka výsledku
49777513
Název vlastníka
Západočeská univerzita v Plzni