Shashidhar, S., Mishra, A., & Kotecha, M. (2026). Exploring Re-inforcement Learning via Human Feedback under User Heterogeneity.
Cita Chicago Style (17a ed.)Shashidhar, Sarvesh, Abhishek Mishra, y Madhav Kotecha. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Cita MLA (9a ed.)Shashidhar, Sarvesh, et al. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.
Precaución: Estas citas no son 100% exactas.