Shashidhar, S., Mishra, A., & Kotecha, M. (2026). Exploring Re-inforcement Learning via Human Feedback under User Heterogeneity.
Citazione stile Chigago Style (17a edizione)Shashidhar, Sarvesh, Abhishek Mishra, e Madhav Kotecha. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Citatione MLA (9a ed.)Shashidhar, Sarvesh, et al. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.