Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control.
Saved in:
| Title: | Transfer Reinforcement Learning for Mixed Observability Markov Decision Processes with Time-Varying Interval-Valued Parameters and Its Application in Pandemic Control. |
|---|---|
| Authors: | Du, Mu1 (AUTHOR) dumu@dlut.edu.cn, Yu, Hongtao1 (AUTHOR) yuht@dlut.edu.cn, Kong, Nan2 (AUTHOR) nkong@purdue.edu |
| Source: | INFORMS Journal on Computing. Mar/Apr2025, Vol. 37 Issue 2, p315-337. 23p. |
| Database: | Business Source Ultimate |
|
Full text is not displayed to guests.
Login for full access.
|
|
Be the first to leave a comment!