Prior Constraints-based Reward Model Training for Aligning Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Hang, Wang, Chenglong, Hu, Yimin, Xiao, Tong, Zhang, Chunliang, Zhu, Jingbo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Evaluation Models from Large Language Models for Sequence Generation
par: Wang, Chenglong, et autres
Publié: (2023)
par: Wang, Chenglong, et autres
Publié: (2023)
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
par: Wang, Chenglong, et autres
Publié: (2025)
par: Wang, Chenglong, et autres
Publié: (2025)
Hybrid Alignment Training for Large Language Models
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
Teaching Language Models to Self-Improve by Learning from Language Feedback
par: Hu, Chi, et autres
Publié: (2024)
par: Hu, Chi, et autres
Publié: (2024)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
par: Wang, Chenglong, et autres
Publié: (2025)
par: Wang, Chenglong, et autres
Publié: (2025)
GRAM: A Generative Foundation Reward Model for Reward Generalization
par: Wang, Chenglong, et autres
Publié: (2025)
par: Wang, Chenglong, et autres
Publié: (2025)
Revealing the Parallel Multilingual Learning within Large Language Models
par: Mu, Yongyu, et autres
Publié: (2024)
par: Mu, Yongyu, et autres
Publié: (2024)
Foundations of Large Language Models
par: Xiao, Tong, et autres
Publié: (2025)
par: Xiao, Tong, et autres
Publié: (2025)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
par: Chang, Kaiyan, et autres
Publié: (2026)
par: Chang, Kaiyan, et autres
Publié: (2026)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
par: Chang, Kaiyan, et autres
Publié: (2025)
par: Chang, Kaiyan, et autres
Publié: (2025)
Efficient Prompting Methods for Large Language Models: A Survey
par: Chang, Kaiyan, et autres
Publié: (2024)
par: Chang, Kaiyan, et autres
Publié: (2024)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
par: Wang, Chenglong, et autres
Publié: (2025)
par: Wang, Chenglong, et autres
Publié: (2025)
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
Cross-layer Attention Sharing for Pre-trained Large Language Models
par: Mu, Yongyu, et autres
Publié: (2024)
par: Mu, Yongyu, et autres
Publié: (2024)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
par: Mu, Yongyu, et autres
Publié: (2025)
par: Mu, Yongyu, et autres
Publié: (2025)
Task-Aligned Tool Recommendation for Large Language Models
par: Gao, Hang, et autres
Publié: (2024)
par: Gao, Hang, et autres
Publié: (2024)
LaTeXTrans: Structured LaTeX Translation with Multi-Agent Coordination
par: Zhu, Ziming, et autres
Publié: (2025)
par: Zhu, Ziming, et autres
Publié: (2025)
SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
par: Huo, Yifu, et autres
Publié: (2026)
par: Huo, Yifu, et autres
Publié: (2026)
HEAL: A Hypothesis-Based Preference-Aware Analysis Framework
par: Huo, Yifu, et autres
Publié: (2025)
par: Huo, Yifu, et autres
Publié: (2025)
RankPrompt: Step-by-Step Comparisons Make Language Models Better Reasoners
par: Hu, Chi, et autres
Publié: (2024)
par: Hu, Chi, et autres
Publié: (2024)
TLDR: Token-Level Detective Reward Model for Large Vision Language Models
par: Fu, Deqing, et autres
Publié: (2024)
par: Fu, Deqing, et autres
Publié: (2024)
LRHP: Learning Representations for Human Preferences via Preference Pairs
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
Black-Box Prompt Optimization: Aligning Large Language Models without Model Training
par: Cheng, Jiale, et autres
Publié: (2023)
par: Cheng, Jiale, et autres
Publié: (2023)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
par: Fan, Yuchun, et autres
Publié: (2025)
par: Fan, Yuchun, et autres
Publié: (2025)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
par: Huang, Pengcheng, et autres
Publié: (2024)
par: Huang, Pengcheng, et autres
Publié: (2024)
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
par: Zhao, Runsong, et autres
Publié: (2024)
par: Zhao, Runsong, et autres
Publié: (2024)
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)
par: Song, Ziang, et autres
Publié: (2023)
Transforming and Combining Rewards for Aligning Large Language Models
par: Wang, Zihao, et autres
Publié: (2024)
par: Wang, Zihao, et autres
Publié: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
Checklists Are Better Than Reward Models For Aligning Language Models
par: Viswanathan, Vijay, et autres
Publié: (2025)
par: Viswanathan, Vijay, et autres
Publié: (2025)
Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
par: Zhang, Qingru, et autres
Publié: (2025)
par: Zhang, Qingru, et autres
Publié: (2025)
StoryAlign: Evaluating and Training Reward Models for Story Generation
par: Xia, Haotian, et autres
Publié: (2026)
par: Xia, Haotian, et autres
Publié: (2026)
PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models
par: Wang, Chengbing, et autres
Publié: (2026)
par: Wang, Chengbing, et autres
Publié: (2026)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
par: Zhang, Mozhi, et autres
Publié: (2024)
par: Zhang, Mozhi, et autres
Publié: (2024)
Aligning Large Language Models with Searcher Preferences
par: Wu, Wei, et autres
Publié: (2026)
par: Wu, Wei, et autres
Publié: (2026)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
par: Luo, Yingfeng, et autres
Publié: (2025)
par: Luo, Yingfeng, et autres
Publié: (2025)
INMS: Memory Sharing for Large Language Model based Agents
par: Gao, Hang, et autres
Publié: (2024)
par: Gao, Hang, et autres
Publié: (2024)
Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models
par: Mekala, Dheeraj, et autres
Publié: (2024)
par: Mekala, Dheeraj, et autres
Publié: (2024)
OpenGenAlign: A Preference Dataset and Benchmark for Trustworthy Reward Modeling in Open-Ended, Long-Context Generation
par: Zhang, Hanning, et autres
Publié: (2025)
par: Zhang, Hanning, et autres
Publié: (2025)
Aligning Language Models Using Follow-up Likelihood as Reward Signal
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
Documents similaires
-
Learning Evaluation Models from Large Language Models for Sequence Generation
par: Wang, Chenglong, et autres
Publié: (2023) -
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
par: Wang, Chenglong, et autres
Publié: (2025) -
Hybrid Alignment Training for Large Language Models
par: Wang, Chenglong, et autres
Publié: (2024) -
Teaching Language Models to Self-Improve by Learning from Language Feedback
par: Hu, Chi, et autres
Publié: (2024) -
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
par: Wang, Chenglong, et autres
Publié: (2025)