Singla, S., Wang, Z., Liu, T., Ashfaq, A., Hu, Z., & Xing, E. P. (2024). Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language Models.
Chicago Style (17th ed.) CitationSingla, Somanshu, Zhen Wang, Tianyang Liu, Abdullah Ashfaq, Zhiting Hu, and Eric P. Xing. Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language Models. 2024.
MLA (9th ed.) CitationSingla, Somanshu, et al. Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language Models. 2024.
Warning: These citations may not always be 100% accurate.