Extracting relations from Italian Wikipedia using unsupervised information extraction

Identifikátory výsledku

Kód výsledku v IS VaVaI
<a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216208%3A11320%2F21%3A10441761" target="_blank" >RIV/00216208:11320/21:10441761 - isvavai.cz</a>
Výsledek na webu
—
DOI - Digital Object Identifier
—

Alternativní jazyky

Jazyk výsledku
angličtina
Název v původním jazyce
Extracting relations from Italian Wikipedia using unsupervised information extraction
Popis výsledku v původním jazyce
In this paper, we describe WikiOIE, a framework for extracting relations from Wikipedia. The framework is based on UDPipe and the Universal Dependencies project for text processing. It easily allows customizing the information extraction (IE) approach to automatically extract triples (subject, predicate, object). In this work, we propose two unsupervised IE methods to extract triples from the Italian version of Wikipedia. The former is based only on PoS-tag patterns; the latter also uses syntactic dependencies. The extraction process is provided in JSON format and is used to build a simple web interface for searching and browsing the extracted triples. A preliminary evaluation conducted on a dataset sample shows promising results, although the approach is completely unsupervised.
Název v anglickém jazyce
Extracting relations from Italian Wikipedia using unsupervised information extraction
Popis výsledku anglicky
In this paper, we describe WikiOIE, a framework for extracting relations from Wikipedia. The framework is based on UDPipe and the Universal Dependencies project for text processing. It easily allows customizing the information extraction (IE) approach to automatically extract triples (subject, predicate, object). In this work, we propose two unsupervised IE methods to extract triples from the Italian version of Wikipedia. The former is based only on PoS-tag patterns; the latter also uses syntactic dependencies. The extraction process is provided in JSON format and is used to build a simple web interface for searching and browsing the extracted triples. A preliminary evaluation conducted on a dataset sample shows promising results, although the approach is completely unsupervised.

Klasifikace

Druh
D - Stať ve sborníku
CEP obor
—
OECD FORD obor
10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)

Návaznosti výsledku

Projekt
—
Návaznosti
—

Ostatní

Rok uplatnění
2021
Kód důvěrnosti údajů
S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Údaje specifické pro druh výsledku

Název statě ve sborníku
CEUR Workshop Proceedings
ISBN
—
ISSN
1613-0073
e-ISSN
—
Počet stran výsledku
11
Strana od-do
—
Název nakladatele
CEUR-WS
Místo vydání
Aachen
Místo konání akce
Bari
Datum konání akce
13. 9. 2021
Typ akce podle státní příslušnosti
WRD - Celosvětová akce
Kód UT WoS článku
—

Podobné výsledky(10)

A Pipeline for Extracting Abstract Dependency Templates for Data-to-Text Natural Language Generation "Wikily" Supervised Neural Translation Tailored to Cross-Lingual Tasks Semantic Annotation Semantically: Using a Shareable Extraction Ontology and a Reasoner

Co hledáte?

Rychlé hledání

Chytré vyhledávání

Extracting relations from Italian Wikipedia using unsupervised information extraction

Identifikátory výsledku

Alternativní jazyky

Klasifikace

Návaznosti výsledku

Ostatní

Údaje specifické pro druh výsledku

Podobné výsledky(10)

Co hledáte?

Rychlé hledání

Chytré vyhledávání

Popis výsledku

Identifikátory výsledku

Identifikátory výsledku

Alternativní jazyky

Alternativní jazyky

Klasifikace

Klasifikace

Návaznosti výsledku

Návaznosti výsledku

Ostatní

Ostatní

Údaje specifické pro druh výsledku

Údaje specifické pro druh výsledku

Podobné výsledky(10)