Rethinking Diverse Human Preference Learning through Principal Component Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Feng, Yang, Rui, Sun, Hao, Deng, Chunyuan, Yao, Jiarui, Shen, Jingyan, Zhang, Huan, Chen, Hanjie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
by: Shen, Jingyan, et al.
Published: (2025)
by: Shen, Jingyan, et al.
Published: (2025)
Learning Distribution-Wise Control in Representation Space for Language Models
by: Deng, Chunyuan, et al.
Published: (2025)
by: Deng, Chunyuan, et al.
Published: (2025)
Steering Information Utility in Key-Value Memory for Language Model Post-Training
by: Deng, Chunyuan, et al.
Published: (2025)
by: Deng, Chunyuan, et al.
Published: (2025)
The Generalization Ridge: Information Flow in Natural Language Generation
by: Chang, Ruidi, et al.
Published: (2025)
by: Chang, Ruidi, et al.
Published: (2025)
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
by: You, Zejia, et al.
Published: (2026)
by: You, Zejia, et al.
Published: (2026)
Language Models are Symbolic Learners in Arithmetic
by: Deng, Chunyuan, et al.
Published: (2024)
by: Deng, Chunyuan, et al.
Published: (2024)
SAFR: Neuron Redistribution for Interpretability
by: Chang, Ruidi, et al.
Published: (2025)
by: Chang, Ruidi, et al.
Published: (2025)
Rethinking Human Preference Evaluation of LLM Rationales
by: Li, Ziang, et al.
Published: (2025)
by: Li, Ziang, et al.
Published: (2025)
PRISM: A Dual View of LLM Reasoning through Semantic Flow and Latent Computation
by: Chang, Ruidi, et al.
Published: (2026)
by: Chang, Ruidi, et al.
Published: (2026)
Principal Component Analysis as a Sanity Check for Bayesian Phylolinguistic Reconstruction
by: Murawaki, Yugo
Published: (2024)
by: Murawaki, Yugo
Published: (2024)
Rethinking Machine Ethics -- Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?
by: Zhou, Jingyan, et al.
Published: (2023)
by: Zhou, Jingyan, et al.
Published: (2023)
Humanizing Machines: Rethinking LLM Anthropomorphism Through a Multi-Level Framework of Design
by: Xiao, Yunze, et al.
Published: (2025)
by: Xiao, Yunze, et al.
Published: (2025)
LT2: Linear-Time Looped Transformers
by: Deng, Chunyuan, et al.
Published: (2026)
by: Deng, Chunyuan, et al.
Published: (2026)
Diverse Preference Optimization
by: Lanchantin, Jack, et al.
Published: (2025)
by: Lanchantin, Jack, et al.
Published: (2025)
BATON: Aligning Text-to-Audio Model with Human Preference Feedback
by: Liao, Huan, et al.
Published: (2024)
by: Liao, Huan, et al.
Published: (2024)
Robust Bayesian Functional Principal Component Analysis
by: Zhang, Jiarui, et al.
Published: (2023)
by: Zhang, Jiarui, et al.
Published: (2023)
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
by: Yang, Qiyuan, et al.
Published: (2024)
by: Yang, Qiyuan, et al.
Published: (2024)
LRHP: Learning Representations for Human Preferences via Preference Pairs
by: Wang, Chenglong, et al.
Published: (2024)
by: Wang, Chenglong, et al.
Published: (2024)
Pragmatic Feature Preferences: Learning Reward-Relevant Preferences from Human Input
by: Peng, Andi, et al.
Published: (2024)
by: Peng, Andi, et al.
Published: (2024)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
by: Han, Yang, et al.
Published: (2024)
by: Han, Yang, et al.
Published: (2024)
Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay
by: Sun, Yifan, et al.
Published: (2025)
by: Sun, Yifan, et al.
Published: (2025)
FaiMA: Feature-aware In-context Learning for Multi-domain Aspect-based Sentiment Analysis
by: Yang, Songhua, et al.
Published: (2024)
by: Yang, Songhua, et al.
Published: (2024)
Diverse Preference Learning for Capabilities and Alignment
by: Slocum, Stewart, et al.
Published: (2025)
by: Slocum, Stewart, et al.
Published: (2025)
LiPO: Listwise Preference Optimization through Learning-to-Rank
by: Liu, Tianqi, et al.
Published: (2024)
by: Liu, Tianqi, et al.
Published: (2024)
COPR: Continual Learning Human Preference through Optimal Policy Regularization
by: Zhang, Han, et al.
Published: (2023)
by: Zhang, Han, et al.
Published: (2023)
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
by: Shen, Wei, et al.
Published: (2024)
by: Shen, Wei, et al.
Published: (2024)
A Survey on Human Preference Learning for Large Language Models
by: Jiang, Ruili, et al.
Published: (2024)
by: Jiang, Ruili, et al.
Published: (2024)
Learning Ordinal Probabilistic Reward from Preferences
by: Chen, Longze, et al.
Published: (2026)
by: Chen, Longze, et al.
Published: (2026)
VRM: Teaching Reward Models to Understand Authentic Human Preferences
by: Liu, Biao, et al.
Published: (2026)
by: Liu, Biao, et al.
Published: (2026)
MaxMin-RLHF: Alignment with Diverse Human Preferences
by: Chakraborty, Souradip, et al.
Published: (2024)
by: Chakraborty, Souradip, et al.
Published: (2024)
ByteFlow: Language Modeling through Adaptive Byte Compression without a Tokenizer
by: Deng, Chunyuan, et al.
Published: (2026)
by: Deng, Chunyuan, et al.
Published: (2026)
Drawing Conclusions from Draws: Rethinking Preference Semantics in Arena-Style LLM Evaluation
by: Tang, Raphael, et al.
Published: (2025)
by: Tang, Raphael, et al.
Published: (2025)
GR-SAP: Generative Replay for Safety Alignment Preservation during Fine-Tuning
by: Fang, Zhouxiang, et al.
Published: (2026)
by: Fang, Zhouxiang, et al.
Published: (2026)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
by: Wang, Haoxiang, et al.
Published: (2024)
by: Wang, Haoxiang, et al.
Published: (2024)
Robust Principal Component Analysis via Discriminant Sample Weight Learning
by: Deng, Yingzhuo, et al.
Published: (2024)
by: Deng, Yingzhuo, et al.
Published: (2024)
DeformAr: Rethinking NER Evaluation through Component Analysis and Visual Analytics
by: Younes, Ahmed Mustafa
Published: (2025)
by: Younes, Ahmed Mustafa
Published: (2025)
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
by: Feng, Jiarui, et al.
Published: (2025)
by: Feng, Jiarui, et al.
Published: (2025)
When Reasoning Meets Its Laws
by: Zhang, Junyu, et al.
Published: (2025)
by: Zhang, Junyu, et al.
Published: (2025)
Not All Preference Pairs Are Created Equal: A Recipe for Annotation-Efficient Iterative Preference Learning
by: Yang, Sen, et al.
Published: (2024)
by: Yang, Sen, et al.
Published: (2024)
Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment
by: Yang, Rui, et al.
Published: (2024)
by: Yang, Rui, et al.
Published: (2024)
Similar Items
-
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
by: Shen, Jingyan, et al.
Published: (2025) -
Learning Distribution-Wise Control in Representation Space for Language Models
by: Deng, Chunyuan, et al.
Published: (2025) -
Steering Information Utility in Key-Value Memory for Language Model Post-Training
by: Deng, Chunyuan, et al.
Published: (2025) -
The Generalization Ridge: Information Flow in Natural Language Generation
by: Chang, Ruidi, et al.
Published: (2025) -
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
by: You, Zejia, et al.
Published: (2026)