Zhang, X., Zhao, Z., Shi, W., Xu, K., Huang, D., & Hu, X. (2024). Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions.
Cita Chicago Style (17a ed.)Zhang, Xiaoyun, Zhengyue Zhao, Wenxuan Shi, Kaidi Xu, Di Huang, y Xing Hu. Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions. 2024.
Cita MLA (9a ed.)Zhang, Xiaoyun, et al. Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions. 2024.
Precaución: Estas citas no son 100% exactas.