Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control.

Saved in:
Bibliographic Details
Title: Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control.
Authors: Du, Mu1 (AUTHOR) dumu@dlut.edu.cn, Yu, Hongtao1 (AUTHOR) yuht@dlut.edu.cn, Kong, Nan2 (AUTHOR) nkong@purdue.edu
Source: INFORMS Journal on Computing. Mar/Apr2025, Vol. 37 Issue 2, p315-337. 23p.
Database: Business Source Ultimate
Full text is not displayed to guests.
Description
ISSN:10919856
DOI:10.1287/ijoc.2022.0236