Zhang, Q., Wei, H., & Ying, L. (2024). Reinforcement Learning from Human Feedback without Reward Inference: Model-Free Algorithm and Instance-Dependent Analysis.
Citazione stile Chigago Style (17a edizione)Zhang, Qining, Honghao Wei, e Lei Ying. Reinforcement Learning from Human Feedback Without Reward Inference: Model-Free Algorithm and Instance-Dependent Analysis. 2024.
Citatione MLA (9a ed.)Zhang, Qining, et al. Reinforcement Learning from Human Feedback Without Reward Inference: Model-Free Algorithm and Instance-Dependent Analysis. 2024.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.