Luo, F., Tu, Z., Huang, Z., & Yu, Y. (2024). Efficient Recurrent Off-Policy RL Requires a Context-Encoder-Specific Learning Rate.
Chicago Style (17th ed.) CitationLuo, Fan-Ming, Zuolin Tu, Zefang Huang, and Yang Yu. Efficient Recurrent Off-Policy RL Requires a Context-Encoder-Specific Learning Rate. 2024.
MLA (9th ed.) CitationLuo, Fan-Ming, et al. Efficient Recurrent Off-Policy RL Requires a Context-Encoder-Specific Learning Rate. 2024.
Warning: These citations may not always be 100% accurate.