Zheng, H., Xie, W., & Feng, M. B. (2021). On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence.
Citazione stile Chigago Style (17a edizione)Zheng, Hua, Wei Xie, e M. Ben Feng. On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence. 2021.
Citatione MLA (9a ed.)Zheng, Hua, et al. On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence. 2021.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.