Osman, A., Abramowitz, S., Bergh, M., Sob, U. A. M., de Kock, R. J., Mahjoub, O., . . . Pretorius, A. (2026). Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation.
Citazione stile Chigago Style (17a edizione)Osman, Asim, et al. Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation. 2026.
Citatione MLA (9a ed.)Osman, Asim, et al. Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation. 2026.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.