Fine-Tuning Language Models with Reward Learning on Policy
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lang, Hao, Huang, Fei, Li, Yongbin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Generalization in Role-Playing Models via Information Theory
par: Li, Yongqi, et autres
Publié: (2025)
par: Li, Yongqi, et autres
Publié: (2025)
Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts
par: Lang, Hao, et autres
Publié: (2023)
par: Lang, Hao, et autres
Publié: (2023)
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
par: Song, Feifan, et autres
Publié: (2024)
par: Song, Feifan, et autres
Publié: (2024)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
par: Wang, Minzheng, et autres
Publié: (2025)
par: Wang, Minzheng, et autres
Publié: (2025)
Controlling Multimodal Conversational Agents with Coverage-Enhanced Latent Actions
par: Li, Yongqi, et autres
Publié: (2026)
par: Li, Yongqi, et autres
Publié: (2026)
DEMO: Reframing Dialogue Interaction with Fine-grained Element Modeling
par: Wang, Minzheng, et autres
Publié: (2024)
par: Wang, Minzheng, et autres
Publié: (2024)
Supervised Fine-Tuning as Inverse Reinforcement Learning
par: Sun, Hao
Publié: (2024)
par: Sun, Hao
Publié: (2024)
Improving Large Language Models with Concept-Aware Fine-Tuning
par: Chen, Michael K., et autres
Publié: (2025)
par: Chen, Michael K., et autres
Publié: (2025)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
par: Yu, Zhang Ze, et autres
Publié: (2023)
par: Yu, Zhang Ze, et autres
Publié: (2023)
Nested-ReFT: Efficient Reinforcement Learning for Large Language Model Fine-Tuning via Off-Policy Rollouts
par: Heuillet, Maxime, et autres
Publié: (2025)
par: Heuillet, Maxime, et autres
Publié: (2025)
Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods
par: Zekri, Oussama, et autres
Publié: (2025)
par: Zekri, Oussama, et autres
Publié: (2025)
BEFT: Bias-Efficient Fine-Tuning of Language Models in Low-Data Regimes
par: Huang, Baichuan, et autres
Publié: (2025)
par: Huang, Baichuan, et autres
Publié: (2025)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
par: Ling, Zhenqing, et autres
Publié: (2025)
par: Ling, Zhenqing, et autres
Publié: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
par: Hong, Joey, et autres
Publié: (2024)
par: Hong, Joey, et autres
Publié: (2024)
Scaling Sparse Fine-Tuning to Large Language Models
par: Ansell, Alan, et autres
Publié: (2024)
par: Ansell, Alan, et autres
Publié: (2024)
Boosting Large Language Models with Mask Fine-Tuning
par: Zhang, Mingyuan, et autres
Publié: (2025)
par: Zhang, Mingyuan, et autres
Publié: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
par: Cheng, Yuwei, et autres
Publié: (2026)
par: Cheng, Yuwei, et autres
Publié: (2026)
The Policy Cliff: A Theoretical Analysis of Reward-Policy Maps in Large Language Models
par: Xu, Xingcheng
Publié: (2025)
par: Xu, Xingcheng
Publié: (2025)
Debate Helps Weak-to-Strong Generalization
par: Lang, Hao, et autres
Publié: (2025)
par: Lang, Hao, et autres
Publié: (2025)
Selective Weak-to-Strong Generalization
par: Lang, Hao, et autres
Publié: (2025)
par: Lang, Hao, et autres
Publié: (2025)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
par: Oliver, Michael, et autres
Publié: (2024)
par: Oliver, Michael, et autres
Publié: (2024)
Unintended Memorization of Sensitive Information in Fine-Tuned Language Models
par: Szep, Marton, et autres
Publié: (2026)
par: Szep, Marton, et autres
Publié: (2026)
G-Loss: Graph-Guided Fine-Tuning of Language Models
par: Sharma, Aditya, et autres
Publié: (2026)
par: Sharma, Aditya, et autres
Publié: (2026)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
par: Chen, Zixiang, et autres
Publié: (2024)
par: Chen, Zixiang, et autres
Publié: (2024)
Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use
par: Chen, Yuhan, et autres
Publié: (2023)
par: Chen, Yuhan, et autres
Publié: (2023)
Parameter-Efficient Fine-Tuning in Large Models: A Survey of Methodologies
par: Wang, Luping, et autres
Publié: (2024)
par: Wang, Luping, et autres
Publié: (2024)
Cost-Effective Proxy Reward Model Construction with On-Policy and Active Learning
par: Chen, Yifang, et autres
Publié: (2024)
par: Chen, Yifang, et autres
Publié: (2024)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
par: Wang, Yulong, et autres
Publié: (2024)
par: Wang, Yulong, et autres
Publié: (2024)
Co-Evolution of Policy and Internal Reward for Language Agents
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
Reviving The Classics: Active Reward Modeling in Large Language Model Alignment
par: Shen, Yunyi, et autres
Publié: (2025)
par: Shen, Yunyi, et autres
Publié: (2025)
Process Rewards with Learned Reliability
par: Li, Jinyuan, et autres
Publié: (2026)
par: Li, Jinyuan, et autres
Publié: (2026)
ReDit: Reward Dithering for Improved LLM Policy Optimization
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Calibration Collapse Under Sycophancy Fine-Tuning: How Reward Hacking Breaks Uncertainty Quantification in LLMs
par: Sahoo, Subramanyam
Publié: (2026)
par: Sahoo, Subramanyam
Publié: (2026)
Variance-reduced Zeroth-Order Methods for Fine-Tuning Language Models
par: Gautam, Tanmay, et autres
Publié: (2024)
par: Gautam, Tanmay, et autres
Publié: (2024)
Fine-Tuning Vision-Language Models for Multimodal Polymer Property Prediction
par: Vuong, An, et autres
Publié: (2025)
par: Vuong, An, et autres
Publié: (2025)
Off-Policy Corrected Reward Modeling for Reinforcement Learning from Human Feedback
par: Ackermann, Johannes, et autres
Publié: (2025)
par: Ackermann, Johannes, et autres
Publié: (2025)
Model Editing by Standard Fine-Tuning
par: Gangadhar, Govind, et autres
Publié: (2024)
par: Gangadhar, Govind, et autres
Publié: (2024)
Embedding Enhancement via Fine-Tuned Language Models for Learner-Item Cognitive Modeling
par: Liu, Yuanhao, et autres
Publié: (2026)
par: Liu, Yuanhao, et autres
Publié: (2026)
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
par: Chow, Yinlam, et autres
Publié: (2024)
par: Chow, Yinlam, et autres
Publié: (2024)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
par: Krishnan, Ranganath, et autres
Publié: (2024)
par: Krishnan, Ranganath, et autres
Publié: (2024)
Documents similaires
-
Understanding Generalization in Role-Playing Models via Information Theory
par: Li, Yongqi, et autres
Publié: (2025) -
Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts
par: Lang, Hao, et autres
Publié: (2023) -
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
par: Song, Feifan, et autres
Publié: (2024) -
Adaptive Social Learning via Mode Policy Optimization for Language Agents
par: Wang, Minzheng, et autres
Publié: (2025) -
Controlling Multimodal Conversational Agents with Coverage-Enhanced Latent Actions
par: Li, Yongqi, et autres
Publié: (2026)