(1)
Meng, L.; Yazidi, A.; Goodwin, M.; Engelstad, P. Expert Q-Learning: Deep Reinforcement Learning With Coarse State Values from Offline Expert Examples. nldl 2022, 3. https://doi.org/10.7557/18.6237.