Morphological tagging and lemmatization in the Czech National Corpus
The result's identifiers
Result code in IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11210%2F07%3A00103203" target="_blank" >RIV/00216208:11210/07:00103203 - isvavai.cz</a>
Alternative codes found
RIV/68378092:_____/08:00099582
Result on the web
—
DOI - Digital Object Identifier
—
Alternative languages
Result language
čeština
Original language name
Morfologické značkování a lemmatizace v korpusech ČNK
Original language description
Tento článek představuje metody, jimiž byly označkovány tři velké textové korpusy (SYN2000, SYN2005 a SYN2006PUB). Postup značkování má několik fází: tokenizaci a segmentaci, morfologickou analýzu a disambiguaci. Při značkování korpusů byly použity jak stochastické, tak pravidlové metody.
Czech name
Morfologické značkování a lemmatizace v korpusech ČNK
Czech description
Tento článek představuje metody, jimiž byly označkovány tři velké textové korpusy (SYN2000, SYN2005 a SYN2006PUB). Postup značkování má několik fází: tokenizaci a segmentaci, morfologickou analýzu a disambiguaci. Při značkování korpusů byly použity jak stochastické, tak pravidlové metody.
Classification
Type
D - Article in proceedings
CEP classification
AI - Linguistics
OECD FORD branch
—
Result continuities
Project
Result was created during the realization of more than one project. More information in the Projects tab.
Continuities
P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)<br>Z - Vyzkumny zamer (s odkazem do CEZ)
Others
Publication year
2007
Confidentiality
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Data specific for result type
Article name in the collection
Grammar and Corpora
ISBN
978-80-200-1634-8
ISSN
—
e-ISSN
—
Number of pages
11
Pages from-to
—
Publisher name
Academia
Place of publication
Liblice
Event location
—
Event date
—
Type of event by nationality
—
UT code for WoS article
—