LIRE: listwise reward enhancement for preference alignment
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Mingye, Liu, Yi, Zhang, Lei, Guo, Junbo, Mao, Zhendong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
On-the-fly Preference Alignment via Principle-Guided Decoding
von: Zhu, Mingye, et al.
Veröffentlicht: (2025)
von: Zhu, Mingye, et al.
Veröffentlicht: (2025)
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
von: Zhu, Mingye, et al.
Veröffentlicht: (2024)
von: Zhu, Mingye, et al.
Veröffentlicht: (2024)
Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models
von: Liu, Yi, et al.
Veröffentlicht: (2025)
von: Liu, Yi, et al.
Veröffentlicht: (2025)
Compositional preference models for aligning LMs
von: Go, Dongyoung, et al.
Veröffentlicht: (2023)
von: Go, Dongyoung, et al.
Veröffentlicht: (2023)
Inference time LLM alignment in single and multidomain preference spectrum
von: Shahriar, Sadat, et al.
Veröffentlicht: (2024)
von: Shahriar, Sadat, et al.
Veröffentlicht: (2024)
Leveraging Robust Optimization for LLM Alignment under Distribution Shifts
von: Zhu, Mingye, et al.
Veröffentlicht: (2025)
von: Zhu, Mingye, et al.
Veröffentlicht: (2025)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
von: Zhang, Huatian, et al.
Veröffentlicht: (2026)
von: Zhang, Huatian, et al.
Veröffentlicht: (2026)
GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
von: Liu, Shih-Yang, et al.
Veröffentlicht: (2026)
von: Liu, Shih-Yang, et al.
Veröffentlicht: (2026)
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning
von: Jiang, Guochao, et al.
Veröffentlicht: (2026)
von: Jiang, Guochao, et al.
Veröffentlicht: (2026)
MCP-AgentBench: Evaluating Real-World Language Agent Performance with MCP-Mediated Tools
von: Guo, Zikang, et al.
Veröffentlicht: (2025)
von: Guo, Zikang, et al.
Veröffentlicht: (2025)
Asymmetric REINFORCE for off-Policy Reinforcement Learning: Balancing positive and negative rewards
von: Arnal, Charles, et al.
Veröffentlicht: (2025)
von: Arnal, Charles, et al.
Veröffentlicht: (2025)
HelpSteer2: Open-source dataset for training top-performing reward models
von: Wang, Zhilin, et al.
Veröffentlicht: (2024)
von: Wang, Zhilin, et al.
Veröffentlicht: (2024)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
von: Li, Xiaomin, et al.
Veröffentlicht: (2024)
von: Li, Xiaomin, et al.
Veröffentlicht: (2024)
ELDER: Enhancing Lifelong Model Editing with Mixture-of-LoRA
von: Li, Jiaang, et al.
Veröffentlicht: (2024)
von: Li, Jiaang, et al.
Veröffentlicht: (2024)
Aligning language models with human preferences
von: Korbak, Tomasz
Veröffentlicht: (2024)
von: Korbak, Tomasz
Veröffentlicht: (2024)
BLEUBERI: BLEU is a surprisingly effective reward for instruction following
von: Chang, Yapei, et al.
Veröffentlicht: (2025)
von: Chang, Yapei, et al.
Veröffentlicht: (2025)
The Consciousness Cluster: Emergent preferences of Models that Claim to be Conscious
von: Chua, James, et al.
Veröffentlicht: (2026)
von: Chua, James, et al.
Veröffentlicht: (2026)
APB: Accelerating Distributed Long-Context Inference by Passing Compressed Context Blocks across GPUs
von: Huang, Yuxiang, et al.
Veröffentlicht: (2025)
von: Huang, Yuxiang, et al.
Veröffentlicht: (2025)
FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts
von: Wang, Xinyi, et al.
Veröffentlicht: (2025)
von: Wang, Xinyi, et al.
Veröffentlicht: (2025)
REFA: Reference Free Alignment for multi-preference optimization
von: Gupta, Taneesh, et al.
Veröffentlicht: (2024)
von: Gupta, Taneesh, et al.
Veröffentlicht: (2024)
Are aligned neural networks adversarially aligned?
von: Carlini, Nicholas, et al.
Veröffentlicht: (2023)
von: Carlini, Nicholas, et al.
Veröffentlicht: (2023)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
NQKV: A KV Cache Quantization Scheme Based on Normal Distribution Characteristics
von: Cai, Zhihang, et al.
Veröffentlicht: (2025)
von: Cai, Zhihang, et al.
Veröffentlicht: (2025)
Diffusion-RPO: Aligning Diffusion Models through Relative Preference Optimization
von: Gu, Yi, et al.
Veröffentlicht: (2024)
von: Gu, Yi, et al.
Veröffentlicht: (2024)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
von: Feng, Jie, et al.
Veröffentlicht: (2024)
von: Feng, Jie, et al.
Veröffentlicht: (2024)
Relative Preference Optimization: Enhancing LLM Alignment through Contrasting Responses across Identical and Diverse Prompts
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
von: Yin, Yueqin, et al.
Veröffentlicht: (2024)
Improve Mathematical Reasoning in Language Models by Automated Process Supervision
von: Luo, Liangchen, et al.
Veröffentlicht: (2024)
von: Luo, Liangchen, et al.
Veröffentlicht: (2024)
Theoretical guarantees on the best-of-n alignment policy
von: Beirami, Ahmad, et al.
Veröffentlicht: (2024)
von: Beirami, Ahmad, et al.
Veröffentlicht: (2024)
Clip Your Sequences Fairly: Enforcing Length Fairness for Sequence-Level RL
von: Mao, Hanyi, et al.
Veröffentlicht: (2025)
von: Mao, Hanyi, et al.
Veröffentlicht: (2025)
Converting Transformers into DGNNs Form
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
Don't Just Say "I don't know"! Self-aligning Large Language Models for Responding to Unknown Questions with Explanations
von: Deng, Yang, et al.
Veröffentlicht: (2024)
von: Deng, Yang, et al.
Veröffentlicht: (2024)
QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMs
von: Huang, Wei, et al.
Veröffentlicht: (2025)
von: Huang, Wei, et al.
Veröffentlicht: (2025)
InfAlign: Inference-aware language model alignment
von: Balashankar, Ananth, et al.
Veröffentlicht: (2024)
von: Balashankar, Ananth, et al.
Veröffentlicht: (2024)
Few-shot Personalization of LLMs with Mis-aligned Responses
von: Kim, Jaehyung, et al.
Veröffentlicht: (2024)
von: Kim, Jaehyung, et al.
Veröffentlicht: (2024)
Two Calls, Two Moments, and the Vote-Accuracy Curve of Repeated LLM Inference
von: Liu, Yi
Veröffentlicht: (2026)
von: Liu, Yi
Veröffentlicht: (2026)
Is poisoning a real threat to LLM alignment? Maybe more so than you think
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2024)
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Denoising Feedback
von: He, Qi, et al.
Veröffentlicht: (2026)
von: He, Qi, et al.
Veröffentlicht: (2026)
Demystifying the unreasonable effectiveness of online alignment methods
von: Kang, Enoch Hyunwook
Veröffentlicht: (2026)
von: Kang, Enoch Hyunwook
Veröffentlicht: (2026)
Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
von: Li, Haolin, et al.
Veröffentlicht: (2026)
von: Li, Haolin, et al.
Veröffentlicht: (2026)
DNAZEN: Enhanced Gene Sequence Representations via Mixed Granularities of Coding Units
von: Mao, Lei, et al.
Veröffentlicht: (2025)
von: Mao, Lei, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
On-the-fly Preference Alignment via Principle-Guided Decoding
von: Zhu, Mingye, et al.
Veröffentlicht: (2025) -
FlipGuard: Defending Preference Alignment against Update Regression with Constrained Optimization
von: Zhu, Mingye, et al.
Veröffentlicht: (2024) -
Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models
von: Liu, Yi, et al.
Veröffentlicht: (2025) -
Compositional preference models for aligning LMs
von: Go, Dongyoung, et al.
Veröffentlicht: (2023) -
Inference time LLM alignment in single and multidomain preference spectrum
von: Shahriar, Sadat, et al.
Veröffentlicht: (2024)