Vše

Co hledáte?

Vše
Projekty
Výsledky výzkumu
Subjekty

Rychlé hledání

  • Projekty podpořené TA ČR
  • Významné projekty
  • Projekty s nejvyšší státní podporou
  • Aktuálně běžící projekty

Chytré vyhledávání

  • Takto najdu konkrétní +slovo
  • Takto z výsledků -slovo zcela vynechám
  • “Takto můžu najít celou frázi”

Robust Sequential Decision-Making in Adversarial Environments: Codebase

Identifikátory výsledku

  • Kód výsledku v IS VaVaI

    <a href="https://www.isvavai.cz/riv?ss=detail&h=RIV%2F67985556%3A_____%2F25%3A00646408" target="_blank" >RIV/67985556:_____/25:00646408 - isvavai.cz</a>

  • Výsledek na webu

    <a href="https://doi.org/10.6084/m9.figshare.30788984" target="_blank" >https://doi.org/10.6084/m9.figshare.30788984</a>

  • DOI - Digital Object Identifier

Alternativní jazyky

  • Jazyk výsledku

    angličtina

  • Název v původním jazyce

    Robust Sequential Decision-Making in Adversarial Environments: Codebase

  • Popis výsledku v původním jazyce

    This repository contains experimental datasets, results and configuration files supporting the research article „Robust Sequential Decision-Making in Adversarial Environments“. The associated study addresses reinforcement learning in non-stationary, adversarial environments where standard Markov Decision Process (MDP) assumptions are violated, introducing a model-based framework for Threatened Markov Decision Process (TMDP) that utilises Bayesian belief updates to compute robust policies.

  • Název v anglickém jazyce

    Robust Sequential Decision-Making in Adversarial Environments: Codebase

  • Popis výsledku anglicky

    This repository contains experimental datasets, results and configuration files supporting the research article „Robust Sequential Decision-Making in Adversarial Environments“. The associated study addresses reinforcement learning in non-stationary, adversarial environments where standard Markov Decision Process (MDP) assumptions are violated, introducing a model-based framework for Threatened Markov Decision Process (TMDP) that utilises Bayesian belief updates to compute robust policies.

Klasifikace

  • Druh

    R - Software

  • CEP obor

  • OECD FORD obor

    10102 - Applied mathematics

Návaznosti výsledku

  • Projekt

  • Návaznosti

    I - Institucionalni podpora na dlouhodoby koncepcni rozvoj vyzkumne organizace

Ostatní

  • Rok uplatnění

    2025

  • Kód důvěrnosti údajů

    S - Úplné a pravdivé údaje o projektu nepodléhají ochraně podle zvláštních právních předpisů

Údaje specifické pro druh výsledku

  • Interní identifikační kód produktu

    TMDP adversarial rl

  • Technické parametry

    TMDP adversarial rl, 90.89 kB, Algoritmy pro nestacionární nepřátelské interakce v reinforcement learning

  • Ekonomické parametry

    Algoritmy pro nestacionární nepřátelské interakce v reinforcement learning

  • IČO vlastníka výsledku

    67985556

  • Název vlastníka

    Ústav teorie Informace a automatizace AV ČR, v. v. i.