Cita APA (7a ed.)

Shashidhar, S., Mishra, A., & Kotecha, M. (2026). Exploring Re-inforcement Learning via Human Feedback under User Heterogeneity.

Cita Chicago Style (17a ed.)

Shashidhar, Sarvesh, Abhishek Mishra, y Madhav Kotecha. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.

Cita MLA (9a ed.)

Shashidhar, Sarvesh, et al. Exploring Re-inforcement Learning via Human Feedback Under User Heterogeneity. 2026.

Precaución: Estas citas no son 100% exactas.