UDMorph: Morphosyntactically Tagged UD Corpora
Identifikátory výsledku
Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11320%2F24%3A10492864" target="_blank" >RIV/00216208:11320/24:10492864 - isvavai.cz</a>
Nalezeny alternativní kódy
RIV/00216208:11320/25:VZKE7S64
Výsledek na webu
<a href="https://www.clarin.eu/sites/default/files/CLARIN2024_ConferenceProceedings_final.pdf" target="_blank" >https://www.clarin.eu/sites/default/files/CLARIN2024_ConferenceProceedings_final.pdf</a>
DOI - Digital Object Identifier
—
Alternativní jazyky
Jazyk výsledku
angličtina
Název v původním jazyce
UDMorph: Morphosyntactically Tagged UD Corpora
Popis výsledku v původním jazyce
UDMorph provides an infrastructure parallel to that provided by UD for annotated corpus data that follow the UD guidelines, but do not provide dependency relations: a place where new annotated data-sets can be deposited, and where existing data-sets can be found and downloaded. It also provides a corpus creation environment to easily create annotated data for additional languages and variants. And it provides a REST and GUI interface to a growing collection taggers with a CoNLL-U output, currently for around 150 different languages, where taggers for new data-sets in UDMorph are automatically added.
Název v anglickém jazyce
UDMorph: Morphosyntactically Tagged UD Corpora
Popis výsledku anglicky
UDMorph provides an infrastructure parallel to that provided by UD for annotated corpus data that follow the UD guidelines, but do not provide dependency relations: a place where new annotated data-sets can be deposited, and where existing data-sets can be found and downloaded. It also provides a corpus creation environment to easily create annotated data for additional languages and variants. And it provides a REST and GUI interface to a growing collection taggers with a CoNLL-U output, currently for around 150 different languages, where taggers for new data-sets in UDMorph are automatically added.
Klasifikace
Druh
D - Stať ve sborníku
CEP obor
—
OECD FORD obor
10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)
Návaznosti výsledku
Projekt
<a href="/cs/project/LM2023062" target="_blank" >LM2023062: Digitální výzkumná infrastruktura pro jazykové technologie, umění a humanitní vědy</a><br>
Návaznosti
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)
Ostatní
Rok uplatnění
2024
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Údaje specifické pro druh výsledku
Název statě ve sborníku
Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)
ISBN
978-2-493-81410-4
ISSN
2522-2686
e-ISSN
—
Počet stran výsledku
8
Strana od-do
16933-16940
Název nakladatele
European Language Resources Association
Místo vydání
Torino, Italy
Místo konání akce
Torino, Italy
Datum konání akce
22. 5. 2024
Typ akce podle státní příslušnosti
WRD - Celosvětová akce
Kód UT WoS článku
—