Vše

Co hledáte?

Vše
Projekty
Výsledky výzkumu
Subjekty

Rychlé hledání

  • Projekty podpořené TA ČR
  • Významné projekty
  • Projekty s nejvyšší státní podporou
  • Aktuálně běžící projekty

Chytré vyhledávání

  • Takto najdu konkrétní +slovo
  • Takto z výsledků -slovo zcela vynechám
  • “Takto můžu najít celou frázi”

Identifikátory výsledku

  • Kód výsledku v IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F00094943%3A_____%2F25%3AN0000006" target="_blank" >RIV/00094943:_____/25:N0000006 - isvavai.cz</a>

  • Výsledek na webu

    <a href="https://github.com/moravianlibrary/kramarske-tisky" target="_blank" >https://github.com/moravianlibrary/kramarske-tisky</a>

  • DOI - Digital Object Identifier

Alternativní jazyky

  • Jazyk výsledku

    čeština

  • Název v původním jazyce

    DKT-Workflow

  • Popis výsledku v původním jazyce

    Nástroj pro extrakci dat a jejich zpřístupnění - cílem nástroje je plně zautomatizovat proces tvorby metadatových balíčků odpovídajících standardu Národní digitální knihovny při digitalizaci Kramářských tisků. Ty se vyznačují zejména velmi nízkým počtem (nečíslovaných) stran na jeden svazek (4, 8 apod.) a ve sbírkách jich jsou desítky tisíc. Aplikace má na vstupu sekvenci snímků mnoha tisků v jedné dávce, včetně snímků obálek s jejich čárovými kódy. Aplikace tuto sekvenci rozdělí na snímky patřící k jednotlivým tiskům, na základě čárového kódu doplní bibliografická metadata, vygeneruje strukturální metadata, zajistí OCR a vytvoří balíček v souladu se standardy NDK, připravený k importu do digitální knihovny Kramerius a do systému pro dlouhodobou archivaci digitalizovaných dokumentů.

  • Název v anglickém jazyce

    DKT-Workflow

  • Popis výsledku anglicky

    A tool for data extraction and access provision – the aim is to automate the process of creating metadata packages compliant with the National Digital Library (NDK) standard for the digitization of broadside ballads. These are characterized by a very low number of (unnumbered) pages per volume (4, 8, etc.), and there are tens of thousands of them. System takes a sequence of images of many ballads in a single batch, including images of covers with their barcodes as an input. The application splits this sequence into images belonging to individual prints, supplements bibliographic metadata based on the barcode, generates structural metadata, performs OCR, and creates a NDK compliant package, ready for import into the Kramerius digital library and into a system for the long-term preservation.

Klasifikace

  • Druh

    R - Software

  • CEP obor

  • OECD FORD obor

    60500 - Other Humanities and the Arts

Návaznosti výsledku

  • Projekt

  • Návaznosti

    I - Institucionalni podpora na dlouhodoby koncepcni rozvoj vyzkumne organizace

Ostatní

  • Rok uplatnění

    2025

  • Kód důvěrnosti údajů

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Údaje specifické pro druh výsledku

  • Interní identifikační kód produktu

    dkt-workflow

  • Technické parametry

    Open source řešení pro vygenerování kompletního balíčku v souladu se standardy NDK naspané v jazyce java, využívá open source komponenty a externí OCR službu na bázi AI (např. PERO OCR). Řešení bylo již využito např. maďarskou firmou Arcanum při přípravě importních balíčků digitalizovaných periodik pro MZK.

  • Ekonomické parametry

    Volně dostupné řešení je ekonomicky výhodné pro všechny uživatele z řad paměťových institucí, které digitalizují a zpřístupňují své digitální dokumenty a objekty v systému Kramerius, jelikož nemusí vynakládat prostředky na ruční zpracování dokumentů v digitalizačním procesu, které by bylo při manuálním zpracování velmi časově náročné a náchylné k chybám. Řešení lze použít i pro jiné sbírky dokumentů, charakterizované velmi nízkým počtem stran na jeden dokument.

  • IČO vlastníka výsledku

    00094943

  • Název vlastníka

    Moravská zemská knihovna v Brně