Aligning Crowd Feedback via Distributional Preference Reward Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Dexun, Zhang, Cong, Dong, Kuicai, Deik, Derrick Goh Xin, Tang, Ruiming, Liu, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MMDocIR: Benchmarking Multimodal Retrieval for Long Documents
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
di: Dong, Kuicai, et al.
Pubblicazione: (2025)
Planning with Multi-Constraints via Collaborative Language Agents
di: Zhang, Cong, et al.
Pubblicazione: (2024)
di: Zhang, Cong, et al.
Pubblicazione: (2024)
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
di: Li, Wenjun, et al.
Pubblicazione: (2025)
di: Li, Wenjun, et al.
Pubblicazione: (2025)
MTRec: Learning to Align with User Preferences via Mental Reward Models
di: Zhao, Mengchen, et al.
Pubblicazione: (2025)
di: Zhao, Mengchen, et al.
Pubblicazione: (2025)
Programming over Thinking: Efficient and Robust Multi-Constraint Planning
di: Deik, Derrick Goh Xin, et al.
Pubblicazione: (2026)
di: Deik, Derrick Goh Xin, et al.
Pubblicazione: (2026)
Reward Modeling with Ordinal Feedback: Wisdom of the Crowd
di: Liu, Shang, et al.
Pubblicazione: (2024)
di: Liu, Shang, et al.
Pubblicazione: (2024)
Multi-view Content-aware Indexing for Long Document Retrieval
di: Dong, Kuicai, et al.
Pubblicazione: (2024)
di: Dong, Kuicai, et al.
Pubblicazione: (2024)
RAPID: Efficient Retrieval-Augmented Long Text Generation with Writing Planning and Information Discovery
di: Gu, Hongchao, et al.
Pubblicazione: (2025)
di: Gu, Hongchao, et al.
Pubblicazione: (2025)
Aligning Medical Conversational AI through Online Reinforcement Learning with Information-Theoretic Rewards
di: Verma, Tanvi, et al.
Pubblicazione: (2026)
di: Verma, Tanvi, et al.
Pubblicazione: (2026)
Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling
di: Li, Dexun, et al.
Pubblicazione: (2023)
di: Li, Dexun, et al.
Pubblicazione: (2023)
Reinforcement Learning Foundations for Deep Research Systems: A Survey
di: Li, Wenjun, et al.
Pubblicazione: (2025)
di: Li, Wenjun, et al.
Pubblicazione: (2025)
Aligning Crowd-sourced Human Feedback for Reinforcement Learning on Code Generation by Large Language Models
di: Wong, Man Fai, et al.
Pubblicazione: (2025)
di: Wong, Man Fai, et al.
Pubblicazione: (2025)
Towards Comprehensive Preference Data Collection for Reward Modeling
di: Hu, Yulan, et al.
Pubblicazione: (2024)
di: Hu, Yulan, et al.
Pubblicazione: (2024)
Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling
di: Wang, Jiaxuan, et al.
Pubblicazione: (2026)
di: Wang, Jiaxuan, et al.
Pubblicazione: (2026)
CtrlA: Adaptive Retrieval-Augmented Generation via Inherent Control
di: Liu, Huanshuo, et al.
Pubblicazione: (2024)
di: Liu, Huanshuo, et al.
Pubblicazione: (2024)
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
di: Dong, Zibin, et al.
Pubblicazione: (2023)
di: Dong, Zibin, et al.
Pubblicazione: (2023)
Wisdom of the Crowd: Reinforcement Learning from Coevolutionary Collective Feedback
di: Yuan, Wenzhen, et al.
Pubblicazione: (2025)
di: Yuan, Wenzhen, et al.
Pubblicazione: (2025)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
di: Gu, Yanggan, et al.
Pubblicazione: (2025)
di: Gu, Yanggan, et al.
Pubblicazione: (2025)
Real-Time Aligned Reward Model beyond Semantics
di: Huang, Zixuan, et al.
Pubblicazione: (2026)
di: Huang, Zixuan, et al.
Pubblicazione: (2026)
Beyond Binary Preferences: A Principled Framework for Reward Modeling with Ordinal Feedback
di: Afsharrad, Amirhossein, et al.
Pubblicazione: (2026)
di: Afsharrad, Amirhossein, et al.
Pubblicazione: (2026)
Aligning Deep Implicit Preferences by Learning to Reason Defensively
di: Li, Peiming, et al.
Pubblicazione: (2025)
di: Li, Peiming, et al.
Pubblicazione: (2025)
Efficient Unsupervised Environment Design through Hierarchical Policy Representation Learning
di: Li, Dexun, et al.
Pubblicazione: (2026)
di: Li, Dexun, et al.
Pubblicazione: (2026)
PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model
di: Lin, Baijiong, et al.
Pubblicazione: (2025)
di: Lin, Baijiong, et al.
Pubblicazione: (2025)
VORTEX: Aligning Task Utility and Human Preferences through LLM-Guided Reward Shaping
di: Xiong, Guojun, et al.
Pubblicazione: (2025)
di: Xiong, Guojun, et al.
Pubblicazione: (2025)
Soft Preference Optimization: Aligning Language Models to Expert Distributions
di: Sharifnassab, Arsalan, et al.
Pubblicazione: (2024)
di: Sharifnassab, Arsalan, et al.
Pubblicazione: (2024)
Implicit Safety Alignment from Crowd Preferences
di: Lin, Qian, et al.
Pubblicazione: (2026)
di: Lin, Qian, et al.
Pubblicazione: (2026)
DT2IT-MRM: Debiased Preference Construction and Iterative Training for Multimodal Reward Modeling
di: Zhang, Zhihong, et al.
Pubblicazione: (2026)
di: Zhang, Zhihong, et al.
Pubblicazione: (2026)
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
di: Zhou, Jiayi, et al.
Pubblicazione: (2024)
di: Zhou, Jiayi, et al.
Pubblicazione: (2024)
StructVRM: Aligning Multimodal Reasoning with Structured and Verifiable Reward Models
di: Zhang, Xiangxiang, et al.
Pubblicazione: (2025)
di: Zhang, Xiangxiang, et al.
Pubblicazione: (2025)
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
di: Bansal, Hritik, et al.
Pubblicazione: (2023)
di: Bansal, Hritik, et al.
Pubblicazione: (2023)
Preference Optimization via Contrastive Divergence: Your Reward Model is Secretly an NLL Estimator
di: Chen, Zhuotong, et al.
Pubblicazione: (2025)
di: Chen, Zhuotong, et al.
Pubblicazione: (2025)
Learning to Align Human Code Preferences
di: Yin, Xin, et al.
Pubblicazione: (2025)
di: Yin, Xin, et al.
Pubblicazione: (2025)
EVA: Aligning Video World Models with Executable Robot Actions via Inverse Dynamics Rewards
di: Wang, Ruixiang, et al.
Pubblicazione: (2026)
di: Wang, Ruixiang, et al.
Pubblicazione: (2026)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
di: Lai, Yuhang, et al.
Pubblicazione: (2024)
di: Lai, Yuhang, et al.
Pubblicazione: (2024)
Preference-Based Self-Distillation: Beyond KL Matching via Reward Regularization
di: Yu, Xin, et al.
Pubblicazione: (2026)
di: Yu, Xin, et al.
Pubblicazione: (2026)
Causally Robust Reward Learning from Reason-Augmented Preference Feedback
di: Hwang, Minjune, et al.
Pubblicazione: (2026)
di: Hwang, Minjune, et al.
Pubblicazione: (2026)
Align$^2$LLaVA: Cascaded Human and Large Language Model Preference Alignment for Multi-modal Instruction Curation
di: Huang, Hongzhe, et al.
Pubblicazione: (2024)
di: Huang, Hongzhe, et al.
Pubblicazione: (2024)
Efficient Reasoning via Reward Model
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
RLHF from Heterogeneous Feedback via Personalization and Preference Aggregation
di: Park, Chanwoo, et al.
Pubblicazione: (2024)
di: Park, Chanwoo, et al.
Pubblicazione: (2024)
Aligning Diffusion Language Models via Unpaired Preference Optimization
di: Jindal, Vaibhav, et al.
Pubblicazione: (2025)
di: Jindal, Vaibhav, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MMDocIR: Benchmarking Multimodal Retrieval for Long Documents
di: Dong, Kuicai, et al.
Pubblicazione: (2025) -
Planning with Multi-Constraints via Collaborative Language Agents
di: Zhang, Cong, et al.
Pubblicazione: (2024) -
Adaptive Tool Use in Large Language Models with Meta-Cognition Trigger
di: Li, Wenjun, et al.
Pubblicazione: (2025) -
MTRec: Learning to Align with User Preferences via Mental Reward Models
di: Zhao, Mengchen, et al.
Pubblicazione: (2025) -
Programming over Thinking: Efficient and Robust Multi-Constraint Planning
di: Deik, Derrick Goh Xin, et al.
Pubblicazione: (2026)