Parsing and multi-word expressions. Towards linguistic precision and computational efficiency in natural language processing (PARSEME)

Project name in Czech
PARSEME: Parsing a víceslovné výrazy - k jazykovědné přesnosti a výpočetní efektivitě ve zpracování přirozeného jazyka
Annotation in Czech
Cílem projektu je ve spolupráci se zahraničními partnery a s využitím jejich zkušeností významně posílit vlastní výzkum v oblasti zpracování přirozeného jazyka, konkrétně v oblasti analýzy víceslovných výrazů (multiword entities, MWE), a to z hlediska tvaroslovného, syntaktického a zejména významového. Tento cíl má několik postupných (pod)cílů: metodologii výzkumu v této specifické oblasti ze začleněním dosud rozdrobených poznatků mezinárodního konsorcia partnerů, přípravu expertních lingvisticky anotovaných dat (textových korpusů analyzovaných z hlediska MWE), extrakci slovníku MWE z takto připravených dat, a přípravu pilotních experimentů identifikace MWE v textu. Vedlejším, nicméně velmi důležitým cílem z hlediska navazujícího výzkumu je příprava veřejně dostupných anotovaných dat a již zmíněného slovníku ve formátu vhodném pro další zkoumání a navazující metody strojového učení.

R&D category
ZV - Basic research
CEP classification - main branch
AI - Linguistics
CEP - secondary branch
IN - Informatics
CEP - another secondary branch
—
OECD FORD - equivalent branches <br>(according to the <a href="http://www.vyzkum.cz/storage/att/E6EF7938F0E854BAE520AC119FB22E8D/Prevodnik_oboru_Frascati.pdf">converter</a>)
10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)<br>60201 - General language studies<br>60202 - Specific languages<br>60203 - Linguistics

Provider evaluation
V - Vynikající výsledky projektu (s mezinárodním významem atd.)
Project results evaluation
We have published 7 proceeding papers, a journal paper, PhD. thesis and an annotated corpus. A Training school took place in Prague. Strong international cooperation started, which is proven by our high attendance at international events, our activity in working groups, but mainly by continuing collaboration after the project funding has ended.

Confidentiality
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů
Data delivery code
CEP18-MSM-LD-U/01:1
Data delivery date
Jun 12, 2018

Similar projects(10)