Ye, J., Zhao, X., Xiang, L., Zhang, Y., & Zong, C. (2026). Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning.
Chicago Style (17th ed.) CitationYe, Jing, Xinpei Zhao, Lu Xiang, Yaping Zhang, and Chengqing Zong. Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning. 2026.
MLA (9th ed.) CitationYe, Jing, et al. Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning. 2026.
Warning: These citations may not always be 100% accurate.