Shashidhar, S., Mishra, A., & Kotecha, M. (2026). Exploring Re-inforcement Learning via Human Feedback under User Heterogeneity.
Style de citation Chicago (17e éd.)Shashidhar, Sarvesh, Abhishek Mishra, et Madhav Kotecha. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Style de citation MLA (9e éd.)Shashidhar, Sarvesh, et al. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Attention : ces citations peuvent ne pas être correctes à 100%.