Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control.
Saved in:
| Title: | Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control. |
|---|---|
| Authors: | Du, Mu1 (AUTHOR) dumu@dlut.edu.cn, Yu, Hongtao1 (AUTHOR) yuht@dlut.edu.cn, Kong, Nan2 (AUTHOR) nkong@purdue.edu |
| Source: | INFORMS Journal on Computing. Mar/Apr2025, Vol. 37 Issue 2, p315-337. 23p. |
| Database: | Business Source Ultimate |
|
Full text is not displayed to guests.
Login for full access.
|
|
| ISSN: | 10919856 |
|---|---|
| DOI: | 10.1287/ijoc.2022.0236 |