Pandit, K., Ganguly, S., Banerjee, A., Angizi, S., & Ghosh, A. (2025). Certifiable Safe RLHF: Fixed-Penalty Constraint Optimization for Safer Language Models.
Cita Chicago Style (17a ed.)Pandit, Kartik, Sourav Ganguly, Arnesh Banerjee, Shaahin Angizi, y Arnob Ghosh. Certifiable Safe RLHF: Fixed-Penalty Constraint Optimization for Safer Language Models. 2025.
Cita MLA (9a ed.)Pandit, Kartik, et al. Certifiable Safe RLHF: Fixed-Penalty Constraint Optimization for Safer Language Models. 2025.
Precaución: Estas citas no son 100% exactas.