All

What are you looking for?

All
Projects
Results
Organizations

Quick search

  • Projects supported by TA ČR
  • Excellent projects
  • Projects with the highest public support
  • Current projects

Smart search

  • That is how I find a specific +word
  • That is how I leave the -word out of the results
  • “That is how I can find the whole phrase”

ČRo Summaries: Automatic generation of daily summaries for all users of the iRozhlas ecosystem

The result's identifiers

  • Result code in IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F68407700%3A21230%2F25%3A00389145" target="_blank" >RIV/68407700:21230/25:00389145 - isvavai.cz</a>

  • Result on the web

    <a href="https://github.com/aic-factcheck/cro_summaries" target="_blank" >https://github.com/aic-factcheck/cro_summaries</a>

  • DOI - Digital Object Identifier

Alternative languages

  • Result language

    čeština

  • Original language name

    ČRo Souhrny: Automatické generování souhrnu dne pro všechny uživatele ekosystému iRozhlas

  • Original language description

    Motivací pro vývoj nástroje ČRo Souhrny je dlouhodobá potřeba Českého rozhlasu automaticky poskytovat stručné, fakticky konzistentní a obsahově vyvážené souhrny aktuálního zpravodajství. V prostředí digitálního zpravodajství vzniká denně velké množství článků, které se mohou tematicky překrývat. Nástroj je vyvíjen pro koncové uživatele, jimž pomáhá získat přehled o tom, co je v daný den skutečně podstatné. Cílem nástroje ČRo Souhrny je automaticky vytvořit denní textový souhrn vybraných článků Českého rozhlasu, který: ● doporučí výběr nejzajímavějších, neredundantních zdrojových článků, ● zachovává faktickou správnost, ● je snadno integrovatelný do dalších systémů ekosystému iRozhlas.

  • Czech name

    ČRo Souhrny: Automatické generování souhrnu dne pro všechny uživatele ekosystému iRozhlas

  • Czech description

    Motivací pro vývoj nástroje ČRo Souhrny je dlouhodobá potřeba Českého rozhlasu automaticky poskytovat stručné, fakticky konzistentní a obsahově vyvážené souhrny aktuálního zpravodajství. V prostředí digitálního zpravodajství vzniká denně velké množství článků, které se mohou tematicky překrývat. Nástroj je vyvíjen pro koncové uživatele, jimž pomáhá získat přehled o tom, co je v daný den skutečně podstatné. Cílem nástroje ČRo Souhrny je automaticky vytvořit denní textový souhrn vybraných článků Českého rozhlasu, který: ● doporučí výběr nejzajímavějších, neredundantních zdrojových článků, ● zachovává faktickou správnost, ● je snadno integrovatelný do dalších systémů ekosystému iRozhlas.

Classification

  • Type

    G<sub>funk</sub> - Functional sample

  • CEP classification

  • OECD FORD branch

    10201 - Computer sciences, information science, bioinformathics (hardware development to be 2.2, social aspect to be 5.8)

Result continuities

  • Project

    <a href="/en/project/TQ01000100" target="_blank" >TQ01000100: Newsroom AI: public service in the era of automated journalism</a><br>

  • Continuities

    P - Projekt vyzkumu a vyvoje financovany z verejnych zdroju (s odkazem do CEP)

Others

  • Publication year

    2025

  • Confidentiality

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Data specific for result type

  • Internal product ID

    TQ01000100-V9

  • Numerical identification

    TQ01000100-V9

  • Technical parameters

    Nástroj ČRo Souhrny pracuje v následujících krocích: 1. Výběr dokumentů: Nástroj získává články z API iRozhlas.cz. V základním režimu pracuje s předem definovaným výběrem dokumentů, v rozšířeném režimu využívá jazykový model pro doporučení nejrelevantnějších článků z větší množiny kandidátů. 2. Předzpracování dokumentů: Stažené články jsou normalizovány do jednotné interní struktury. 3. Doporučení relevantních článků: V případě větší množiny vstupních dokumentů je použit LLM-based recommender, který vybírá podmnožinu článků nejlépe reprezentujících daný časový úsek. 4. Generování sumarizací: Pro každý vybraný článek je pomocí velkého jazykového modelu vygenerována krátká sumarizace ve stylu faktického shrnutí. 5. Ověření faktické správnosti: Každá vygenerovaná sumarizace je následně ověřena nezávislým jazykovým modelem, který posuzuje její konzistenci se zdrojovým textem. 6. Agregace výstupu. Finálním výstupem je sada jednotlivých ověřených sumarizací a agregovaný textový souhrn dne. Použité technologie: Výpočetní modul je implementován v jazyce Python. Celé řešení je postaveno na knihovně LiteLLM, která umožňuje jednotné rozhraní pro různé jazykové modely (otevřené i komerční). Systém je konfigurovatelný pomocí externích konfiguračních souborů a promptů. Součástí nástroje je REST API server postavený na frameworku FastAPI. API umožňuje sumarizaci dodaných článků, spuštění celé pipeline včetně stahování a doporučování článků, snadnou integraci do dalších aplikací a redakčních nástrojů. Zdrojové kódy nástroje jsou dostupné zde: https://github.com/aic-factcheck/cro_summaries

  • Economical parameters

    Licenci je možno udělit jako bezúplatnou pro nekomerční účely. V případě udělení licence pro komerční využití, byl stanoven odhad ceny poskytnuté licence jako licence za časově omezený přístup, a to za poplatek 8 000,- Kč na měsíc, nebo 60 000,- Kč za rok. Cena vychází z nákladů na realizaci, plus přiměřená marže a návratnost. 16. Vlastník (komplexnější informace o spoluvlastnictví se upřesní v technických parametrech v části s informacemi o smlouvě o využití, případně v ekonomických parametrech). Český rozhlas - 15 %, ČVUT- 85 %

  • Application category by cost

  • Owner IČO

    68407700

  • Owner name

    České vysoké učení technické v Praze

  • Owner country

    CZ - CZECH REPUBLIC

  • Usage type

    V - Výsledek je využíván vlastníkem

  • Licence fee requirement

    Z - Poskytovatel licence na výsledek nepožaduje v některých případech licenční poplatek

  • Web page

    https://github.com/aic-factcheck/cro_summaries