Tu, S., Sun, J., Zhang, Q., Zhang, Y., Liu, J., Chen, K., & Zhao, D. (2024). In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning.
Citazione stile Chigago Style (17a edizione)Tu, Songjun, Jingbo Sun, Qichao Zhang, Yaocheng Zhang, Jia Liu, Ke Chen, e Dongbin Zhao. In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning. 2024.
Citatione MLA (9a ed.)Tu, Songjun, et al. In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning. 2024.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.