Yu, Z. Z., Jaw, L. J., Hui, Z., & Low, B. K. H. (2023). Fine-tuning Language Models with Generative Adversarial Reward Modelling.
Chicago Style (17th ed.) CitationYu, Zhang Ze, Lau Jia Jaw, Zhang Hui, and Bryan Kian Hsiang Low. Fine-tuning Language Models with Generative Adversarial Reward Modelling. 2023.
MLA (9th ed.) CitationYu, Zhang Ze, et al. Fine-tuning Language Models with Generative Adversarial Reward Modelling. 2023.
Warning: These citations may not always be 100% accurate.