Chen, X., Shen, Y., Yang, S., Li, C., Yang, G., & Wang, W. (2026). Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction.
Chicago Style (17th ed.) CitationChen, Xingguo, Yuchen Shen, Shangdong Yang, Chao Li, Guang Yang, and Wenhao Wang. Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction. 2026.
MLA (9th ed.) CitationChen, Xingguo, et al. Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction. 2026.
Warning: These citations may not always be 100% accurate.