Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Chenglong, Huo, Yifu, Gan, Yang, Mu, Yongyu, He, Qiaozhi, Yang, Murun, Li, Bei, Zhang, Chunliang, Liu, Tongran, Ma, Anxiang, Yu, Zhengtao, Zhu, Jingbo, Xiao, Tong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LRHP: Learning Representations for Human Preferences via Preference Pairs
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
GRAM: A Generative Foundation Reward Model for Reward Generalization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
HEAL: A Hypothesis-Based Preference-Aware Analysis Framework
von: Huo, Yifu, et al.
Veröffentlicht: (2025)
von: Huo, Yifu, et al.
Veröffentlicht: (2025)
MSRL: Scaling Generative Multimodal Reward Modeling via Multi-Stage Reinforcement Learning
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
von: Chang, Kaiyan, et al.
Veröffentlicht: (2026)
von: Chang, Kaiyan, et al.
Veröffentlicht: (2026)
Hybrid Alignment Training for Large Language Models
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
von: Huo, Yifu, et al.
Veröffentlicht: (2026)
von: Huo, Yifu, et al.
Veröffentlicht: (2026)
Revealing the Parallel Multilingual Learning within Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
Cross-layer Attention Sharing for Pre-trained Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
von: Wang, Chenglong, et al.
Veröffentlicht: (2023)
von: Wang, Chenglong, et al.
Veröffentlicht: (2023)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
von: Zhou, Hang, et al.
Veröffentlicht: (2024)
von: Zhou, Hang, et al.
Veröffentlicht: (2024)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
von: Wang, Yilin, et al.
Veröffentlicht: (2026)
von: Wang, Yilin, et al.
Veröffentlicht: (2026)
SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
von: Wang, Chenglong, et al.
Veröffentlicht: (2026)
LaTeXTrans: Structured LaTeX Translation with Multi-Agent Coordination
von: Zhu, Ziming, et al.
Veröffentlicht: (2025)
von: Zhu, Ziming, et al.
Veröffentlicht: (2025)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
von: Huang, Pengcheng, et al.
Veröffentlicht: (2024)
von: Huang, Pengcheng, et al.
Veröffentlicht: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
When Scaling Fails: Mitigating Audio Perception Decay of LALMs via Multi-Step Perception-Aware Reasoning
von: Mao, Ruixiang, et al.
Veröffentlicht: (2026)
von: Mao, Ruixiang, et al.
Veröffentlicht: (2026)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
LoRA-LiteE: A Computationally Efficient Framework for Chatbot Preference-Tuning
von: Yang, Yahe, et al.
Veröffentlicht: (2024)
von: Yang, Yahe, et al.
Veröffentlicht: (2024)
Enabling DBSCAN for Very Large-Scale High-Dimensional Spaces
von: Wang, Yongyu
Veröffentlicht: (2024)
von: Wang, Yongyu
Veröffentlicht: (2024)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
EfficientGraph-RAG: Structured Retrieval-State Management for Cross-Task Retrieval-Augmented Generation
von: Niu, Miaohe, et al.
Veröffentlicht: (2026)
von: Niu, Miaohe, et al.
Veröffentlicht: (2026)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
Efficient Prompting Methods for Large Language Models: A Survey
von: Chang, Kaiyan, et al.
Veröffentlicht: (2024)
von: Chang, Kaiyan, et al.
Veröffentlicht: (2024)
EIT: Enhanced Interactive Transformer
von: Zheng, Tong, et al.
Veröffentlicht: (2022)
von: Zheng, Tong, et al.
Veröffentlicht: (2022)
Pruning Graphs by Adversarial Robustness Evaluation to Strengthen GNN Defenses
von: Wang, Yongyu
Veröffentlicht: (2025)
von: Wang, Yongyu
Veröffentlicht: (2025)
Offline Exploration-Aware Fine-Tuning for Long-Chain Mathematical Reasoning
von: Mu, Yongyu, et al.
Veröffentlicht: (2026)
von: Mu, Yongyu, et al.
Veröffentlicht: (2026)
From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning
von: Yang, Jun-Jie, et al.
Veröffentlicht: (2026)
von: Yang, Jun-Jie, et al.
Veröffentlicht: (2026)
Efficient LLM Inference with Kcache
von: He, Qiaozhi, et al.
Veröffentlicht: (2024)
von: He, Qiaozhi, et al.
Veröffentlicht: (2024)
On the Emotion Understanding of Synthesized Speech
von: Ge, Yuan, et al.
Veröffentlicht: (2026)
von: Ge, Yuan, et al.
Veröffentlicht: (2026)
Explicit Preference Optimization: No Need for an Implicit Reward Model
von: Hu, Xiangkun, et al.
Veröffentlicht: (2025)
von: Hu, Xiangkun, et al.
Veröffentlicht: (2025)
PerPO: Perceptual Preference Optimization via Discriminative Rewarding
von: Zhu, Zining, et al.
Veröffentlicht: (2025)
von: Zhu, Zining, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
LRHP: Learning Representations for Human Preferences via Preference Pairs
von: Wang, Chenglong, et al.
Veröffentlicht: (2024) -
GRAM: A Generative Foundation Reward Model for Reward Generalization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025) -
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
von: Wang, Chenglong, et al.
Veröffentlicht: (2024) -
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025) -
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)