Yang, Y., Gao, B., & Yuan, Y. (2024). Bilevel reinforcement learning via the development of hyper-gradient without lower-level convexity.
Cita Chicago Style (17a ed.)Yang, Yan, Bin Gao, y Ya-xiang Yuan. Bilevel Reinforcement Learning via the Development of Hyper-gradient Without Lower-level Convexity. 2024.
Cita MLA (9a ed.)Yang, Yan, et al. Bilevel Reinforcement Learning via the Development of Hyper-gradient Without Lower-level Convexity. 2024.
Precaución: Estas citas no son 100% exactas.