DIALEKT v1: nářeční korpus češtiny
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11210%2F17%3A10366970" target="_blank" >RIV/00216208:11210/17:10366970 - isvavai.cz</a>
Výsledek na webu
<a href="https://wiki.korpus.cz/doku.php/cnk:dialekt" target="_blank" >https://wiki.korpus.cz/doku.php/cnk:dialekt</a>
DOI - Digital Object Identifier
—
Alternativní jazyky
Jazyk výsledku
čeština
Název v původním jazyce
DIALEKT v1: nářeční korpus češtiny
Popis výsledku v původním jazyce
Korpus DIALEKT prezentuje tradiční teritoriální dialekty zachycené na území celé České republiky. Nářeční materiál byl získán přepisem zvukových nahrávek pocházejících ze všech nářečních oblastí České republiky. Kromě toho byly některé sondy nahrány na území Polska. Korpus je budován ve dvou vrstvách. Starší nářeční vrstva obsahuje nahrávky, které byly pořízeny v období od konce 50. let až do 80. let 20. století. Do nové vrstvy jsou zařazeny sondy pocházející z období od 90. let 20. století až do současnosti. V případě obou vrstev máme k dispozici jazyková data, v nichž jsou zachyceny archaické nářeční prvky, které se už dnes v běžném úzu většinou nevyskytují. Nářeční korpus ve své první verzi obsahuje cca 100 000 slov a bude se postupně rozšiřovat. Předpokládáme, že bude sloužit nejen pro odbornou veřejnost (dialektology, ostatní lingvisty a badatele z příbuzných oborů), ale například i jako praktická pomůcka při výuce na středních nebo vysokých školách. V budoucnu by měl být doplněn také o interaktivní mapy s nářečními rysy z jednotlivých nářečních oblastí, o ukázky přepisů a nahrávek z vybraných lokalit a o další užitečné doplňky.
Název v anglickém jazyce
DIALEKT v1: A corpus of Czech dialects
Popis výsledku anglicky
The DIALEKT corpus presents traditional regional dialects captured over the entire Czech Republic. The dialect material was acquired by transcribing sound recordings coming from all dialectal regions of the Czech Republic. Additionally, several probes were recorded in Poland. The corpus is composed of two levels. The older dialectal level contains recordings which were made in the period from the end of the 1950s until the 1980s. The newer level contains probes covering the period from the 1990s until the present. For both layers, we have language data which capture archaic dialectal elements which do not generally occur in the present day usage. The first version of the dialect corpus contains approx. 100 000 words and will gradually expand. We assume that it will serve not only for specialists (dialectologists, other linguists and researchers from related fields) but also for example as a practical learning aid for high schools and universities. In the future, it should also be supplemented with interactive maps with dialectal features from the individual regional dialects, excerpts from transcripts and recordings from selected locations, and other useful additions.
Klasifikace
Druh
S<sub>db</sub> - Specializovaná veřejná databáze
CEP obor
—
OECD FORD obor
60203 - Linguistics
Návaznosti výsledku
Projekt
<a href="/cs/project/LM2015044" target="_blank" >LM2015044: Český národní korpus</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2017
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Údaje specifické pro druh výsledku
Číslo předpisu
LM2015044/DIALEKT v1
Označení certifikačního orgánu
Ministerstvo školství, mládeže a tělovýchovy České republiky, Karmelitská 529/5, 118 00 Praha 1
Datum certifikace
—