Vše

Co hledáte?

Vše
Projekty
Výsledky výzkumu
Subjekty

Rychlé hledání

  • Projekty podpořené TA ČR
  • Významné projekty
  • Projekty s nejvyšší státní podporou
  • Aktuálně běžící projekty

Chytré vyhledávání

  • Takto najdu konkrétní +slovo
  • Takto z výsledků -slovo zcela vynechám
  • “Takto můžu najít celou frázi”

Vizuální segmentace elektronických dokumentů

Identifikátory výsledku

  • Kód výsledku v IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00216305%3A26230%2F07%3APU70765" target="_blank" >RIV/00216305:26230/07:PU70765 - isvavai.cz</a>

  • Výsledek na webu

  • DOI - Digital Object Identifier

Alternativní jazyky

  • Jazyk výsledku

    čeština

  • Název v původním jazyce

    Vizuální segmentace elektronických dokumentů

  • Popis výsledku v původním jazyce

    Segmentace dokumentů se zabývá detekcí vizuálního členění obsahu dokumentů a jeho reprezentací. Znalost členění obsahu umožňuje zpřesnit výsledky existujících metod zpracování dokumentů, které dosud využívaly zejména textový obsah dokumentu, jako například metody indexace a vyhledávání dokumentů, klasifikace, extrakce informace a další. V současnosti existuje několik přístupů k segmentaci dokumentů, které jsou však často omezené na konkrétní typ dokumentu či konkrétní aplikaci. V tomto příspěvku navrhujeme novou metodu, která odstraňuje některé omezující vlastnosti existujících metod a dále se zabýváme možností využití navržené metody segmentace v oblasti extrakce dat z dokumentu.

  • Název v anglickém jazyce

    Visual Document Segmentation

  • Popis výsledku anglicky

    Document segmentation deals with the discovery of the visual layout of documents and its representation. This knowledge allows to improve the results of existing document processing methods that are usually based on processing the text content only, suchas document indexing and retrieval, classification, information extraction, etc. Currently, there exist several approaches to the document segmentation. However, they are usually limited to a particular type of documents or a particular application. Inthis paper, we propose a new method that solves some limiting features of the existing methods and furthermore, we show how this method can be used in the information extraction area.

Klasifikace

  • Druh

    D - Stať ve sborníku

  • CEP obor

    JC - Počítačový hardware a software

  • OECD FORD obor

Návaznosti výsledku

  • Projekt

  • Návaznosti

    Z - Vyzkumny zamer (s odkazem do CEZ)

Ostatní

  • Rok uplatnění

    2007

  • Kód důvěrnosti údajů

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Údaje specifické pro druh výsledku

  • Název statě ve sborníku

    Znalosti 2007

  • ISBN

    978-80-248-1279-3

  • ISSN

  • e-ISSN

  • Počet stran výsledku

    12

  • Strana od-do

    155-166

  • Název nakladatele

    Vysoká škola báňská - technická universita Ostrava

  • Místo vydání

    Ostrava

  • Místo konání akce

    Ostrava

  • Datum konání akce

    21. 2. 2007

  • Typ akce podle státní příslušnosti

    CST - Celostátní akce

  • Kód UT WoS článku