SYN2025: reprezentativní referenční korpus psané češtiny
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11210%2F25%3A10509071" target="_blank" >RIV/00216208:11210/25:10509071 - isvavai.cz</a>
Výsledek na webu
<a href="https://wiki.korpus.cz/doku.php/cnk:syn2025" target="_blank" >https://wiki.korpus.cz/doku.php/cnk:syn2025</a>
DOI - Digital Object Identifier
—
Alternativní jazyky
Jazyk výsledku
čeština
Název v původním jazyce
SYN2025: reprezentativní referenční korpus psané češtiny
Popis výsledku v původním jazyce
Synchronní jazykový korpus o celkovém rozsahu 100 milionů textových slov sestavený jako reprezentace psané (tištěné) češtiny období 2020-2024. Korpus je lemmatizován, morfologicky a syntakticky označkován, u každého textu jsou uvedeny podrobné bibliografické údaje.
Název v anglickém jazyce
SYN2025: representative reference corpus of written Czech
Popis výsledku anglicky
Synchronic language corpus sized 100 million running words (tokens) compiled as a representation of written (printed) Czech of the 2020-2024 period. The corpus is lemmatised, morphologically and syntactically annotated; a detailed bibliographic information is provided for every text.
Klasifikace
Druh
X - Nezařazeno
CEP obor
—
OECD FORD obor
60203 - Linguistics
Návaznosti výsledku
Projekt
<a href="/cs/project/LM2023044" target="_blank" >LM2023044: Český národní korpus</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2025
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů