Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning 文章
ArXiv CS.AI2026-06-03NEWSen作者: Anthony GX-Chen, Ankit Anand, Gheorghe Comanici, Zaheer Abbas, Eser Ayg\"un, David Smalling, Shibl Mourad, Doina Precup, Andr\'e Barreto, Mark Rowland