Khanda, R., Baqar, M., Chakrabarti, S., & Changdar, S. (2025). Extending Group Relative Policy Optimization to Continuous Control: A Theoretical Framework for Robotic Reinforcement Learning.
Style de citation Chicago (17e éd.)Khanda, Rajat, Mohammad Baqar, Sambuddha Chakrabarti, et Satyasaran Changdar. Extending Group Relative Policy Optimization to Continuous Control: A Theoretical Framework for Robotic Reinforcement Learning. 2025.
Style de citation MLA (9e éd.)Khanda, Rajat, et al. Extending Group Relative Policy Optimization to Continuous Control: A Theoretical Framework for Robotic Reinforcement Learning. 2025.
Attention : ces citations peuvent ne pas être correctes à 100%.