Tang, Z., Rybin, D., & Chang, T. (2023). Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles.
Style de citation Chicago (17e éd.)Tang, Zhiwei, Dmitry Rybin, et Tsung-Hui Chang. Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles. 2023.
Style de citation MLA (9e éd.)Tang, Zhiwei, et al. Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles. 2023.
Attention : ces citations peuvent ne pas être correctes à 100%.