Zheng, H., Xie, W., & Feng, M. B. (2021). On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence.
Chicago Style (17th ed.) CitationZheng, Hua, Wei Xie, and M. Ben Feng. On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence. 2021.
MLA (9th ed.) CitationZheng, Hua, et al. On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence. 2021.
Warning: These citations may not always be 100% accurate.