Tang, Z., Rybin, D., & Chang, T. (2023). Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles.
Chicago Style (17th ed.) CitationTang, Zhiwei, Dmitry Rybin, and Tsung-Hui Chang. Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles. 2023.
MLA (9th ed.) CitationTang, Zhiwei, et al. Zeroth-Order Optimization Meets Human Feedback: Provable Learning via Ranking Oracles. 2023.
Warning: These citations may not always be 100% accurate.