Singh, U., Chakraborty, S., Suttle, W. A., Sadler, B. M., Namboodiri, V. P., & Bedi, A. S. (2024). DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning.
Style de citation Chicago (17e éd.)Singh, Utsav, Souradip Chakraborty, Wesley A. Suttle, Brian M. Sadler, Vinay P. Namboodiri, et Amrit Singh Bedi. DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning. 2024.
Style de citation MLA (9e éd.)Singh, Utsav, et al. DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning. 2024.
Attention : ces citations peuvent ne pas être correctes à 100%.