Ye, J., Zhao, X., Xiang, L., Zhang, Y., & Zong, C. (2026). Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning.
Citazione stile Chigago Style (17a edizione)Ye, Jing, Xinpei Zhao, Lu Xiang, Yaping Zhang, e Chengqing Zong. Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning. 2026.
Citatione MLA (9a ed.)Ye, Jing, et al. Listening to the Echo: User-Reaction Aware Policy Optimization via Scalar-Verbal Hybrid Reinforcement Learning. 2026.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.