DIALEKT v2: A corpus of Czech dialects
The result's identifiers
Result code in IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11210%2F21%3A10435798" target="_blank" >RIV/00216208:11210/21:10435798 - isvavai.cz</a>
Result on the web
<a href="https://wiki.korpus.cz/doku.php/cnk:dialekt" target="_blank" >https://wiki.korpus.cz/doku.php/cnk:dialekt</a>
DOI - Digital Object Identifier
—
Alternative languages
Result language
čeština
Original language name
DIALEKT v2: nářeční korpus češtiny
Original language description
Korpus DIALEKT prezentuje tradiční teritoriální dialekty zachycené na území celé České republiky. Nářeční materiál byl získán přepisem zvukových nahrávek pocházejících ze všech nářečních oblastí České republiky. Přepisy mají dvě roviny, dialektologickou a ortografickou. Korpus je budován ve dvou vrstvách. Starší nářeční vrstva obsahuje nahrávky, které byly pořízeny v období od konce 50. let až do 80. let 20. století. Do nové vrstvy jsou zařazeny sondy pocházející z období od 90. let 20. století až do současnosti. V případě obou vrstev máme k dispozici jazyková data, v nichž jsou zachyceny archaické nářeční prvky, které se už dnes v běžném úzu většinou nevyskytují. Nářeční korpus ve své druhé verzi obsahuje víc než 220 000 slov a bude se i nadále rozšiřovat. Doplňkem korpusu je mapová aplikace Mapka. Předpokládáme, že korpus bude sloužit nejen pro odbornou veřejnost (dialektology, ostatní lingvisty a badatele z příbuzných oborů), ale například i jako praktická pomůcka při výuce na středních nebo vysokých školách.
Czech name
DIALEKT v2: nářeční korpus češtiny
Czech description
Korpus DIALEKT prezentuje tradiční teritoriální dialekty zachycené na území celé České republiky. Nářeční materiál byl získán přepisem zvukových nahrávek pocházejících ze všech nářečních oblastí České republiky. Přepisy mají dvě roviny, dialektologickou a ortografickou. Korpus je budován ve dvou vrstvách. Starší nářeční vrstva obsahuje nahrávky, které byly pořízeny v období od konce 50. let až do 80. let 20. století. Do nové vrstvy jsou zařazeny sondy pocházející z období od 90. let 20. století až do současnosti. V případě obou vrstev máme k dispozici jazyková data, v nichž jsou zachyceny archaické nářeční prvky, které se už dnes v běžném úzu většinou nevyskytují. Nářeční korpus ve své druhé verzi obsahuje víc než 220 000 slov a bude se i nadále rozšiřovat. Doplňkem korpusu je mapová aplikace Mapka. Předpokládáme, že korpus bude sloužit nejen pro odbornou veřejnost (dialektology, ostatní lingvisty a badatele z příbuzných oborů), ale například i jako praktická pomůcka při výuce na středních nebo vysokých školách.
Classification
Type
O - Miscellaneous
CEP classification
—
OECD FORD branch
60203 - Linguistics
Result continuities
Project
<a href="/en/project/LM2018137" target="_blank" >LM2018137: Czech National Corpus</a><br>
Continuities
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Others
Publication year
2021
Confidentiality
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů