When Personalization Meets Reality: A Multi-Faceted Analysis of Personalized Preference Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Yijiang River, Hu, Tiancheng, Liu, Yinhong, Üstün, Ahmet, Collier, Nigel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can LLM be a Personalized Judge?
par: Dong, Yijiang River, et autres
Publié: (2024)
par: Dong, Yijiang River, et autres
Publié: (2024)
Steer Model beyond Assistant: Controlling System Prompt Strength via Contrastive Decoding
par: Dong, Yijiang River, et autres
Publié: (2026)
par: Dong, Yijiang River, et autres
Publié: (2026)
iNews: A Multimodal Dataset for Modeling Personalized Affective Responses to News
par: Hu, Tiancheng, et autres
Publié: (2025)
par: Hu, Tiancheng, et autres
Publié: (2025)
Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging
par: Hu, Tiancheng, et autres
Publié: (2025)
par: Hu, Tiancheng, et autres
Publié: (2025)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
par: Zhou, Han, et autres
Publié: (2024)
par: Zhou, Han, et autres
Publié: (2024)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Value of Information: A Framework for Human-Agent Communication
par: Dong, Yijiang River, et autres
Publié: (2026)
par: Dong, Yijiang River, et autres
Publié: (2026)
Confidence Estimation for LLMs in Multi-turn Interactions
par: Zhang, Caiqi, et autres
Publié: (2026)
par: Zhang, Caiqi, et autres
Publié: (2026)
Privacy-R1: Privacy-Aware Multi-LLM Agent Collaboration via Reinforcement Learning
par: Hui, Zheng, et autres
Publié: (2025)
par: Hui, Zheng, et autres
Publié: (2025)
TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law
par: Hui, Zheng, et autres
Publié: (2025)
par: Hui, Zheng, et autres
Publié: (2025)
UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models
par: Dong, Yijiang River, et autres
Publié: (2024)
par: Dong, Yijiang River, et autres
Publié: (2024)
Multi-agent AI systems outperform human teams in creativity
par: Hu, Tiancheng, et autres
Publié: (2026)
par: Hu, Tiancheng, et autres
Publié: (2026)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
par: Chen, Jin, et autres
Publié: (2023)
par: Chen, Jin, et autres
Publié: (2023)
Personalized LLM Decoding via Contrasting Personal Preference
par: Bu, Hyungjune, et autres
Publié: (2025)
par: Bu, Hyungjune, et autres
Publié: (2025)
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
par: Hu, Tiancheng, et autres
Publié: (2025)
par: Hu, Tiancheng, et autres
Publié: (2025)
When Personalization Misleads: Understanding and Mitigating Hallucinations in Personalized LLMs
par: Sun, Zhongxiang, et autres
Publié: (2026)
par: Sun, Zhongxiang, et autres
Publié: (2026)
Quantifying the Persona Effect in LLM Simulations
par: Hu, Tiancheng, et autres
Publié: (2024)
par: Hu, Tiancheng, et autres
Publié: (2024)
A Post-trainer's Guide to Multilingual Training Data: Uncovering Cross-lingual Transfer Dynamics
par: Shimabucoro, Luisa, et autres
Publié: (2025)
par: Shimabucoro, Luisa, et autres
Publié: (2025)
RLHF Can Speak Many Languages: Unlocking Multilingual Preference Optimization for LLMs
par: Dang, John, et autres
Publié: (2024)
par: Dang, John, et autres
Publié: (2024)
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
par: Cao, Zhiyu, et autres
Publié: (2026)
par: Cao, Zhiyu, et autres
Publié: (2026)
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
par: Shen, Jingyan, et autres
Publié: (2025)
par: Shen, Jingyan, et autres
Publié: (2025)
HorizonBench: Long-Horizon Personalization with Evolving Preferences
par: Li, Shuyue Stella, et autres
Publié: (2026)
par: Li, Shuyue Stella, et autres
Publié: (2026)
Evaluating the Effectiveness of Direct Preference Optimization for Personalizing German Automatic Text Simplifications for Persons with Intellectual Disabilities
par: Gao, Yingqiang, et autres
Publié: (2025)
par: Gao, Yingqiang, et autres
Publié: (2025)
When Reasoning Meets Information Aggregation: A Case Study with Sports Narratives
par: Hu, Yebowen, et autres
Publié: (2024)
par: Hu, Yebowen, et autres
Publié: (2024)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
par: Chen, Yizhuo, et autres
Publié: (2025)
par: Chen, Yizhuo, et autres
Publié: (2025)
Personalizing LLMs with Binary Feedback: A Preference-Corrected Optimization Framework
par: Ma, Xilai, et autres
Publié: (2026)
par: Ma, Xilai, et autres
Publié: (2026)
Latent Preference Modeling for Cross-Session Personalized Tool Calling
par: Yoon, Yejin, et autres
Publié: (2026)
par: Yoon, Yejin, et autres
Publié: (2026)
Learning to Align Multi-Faceted Evaluation: A Unified and Robust Framework
par: Xu, Kaishuai, et autres
Publié: (2025)
par: Xu, Kaishuai, et autres
Publié: (2025)
LoVeC: Reinforcement Learning for Better Verbalized Confidence in Long-Form Generations
par: Zhang, Caiqi, et autres
Publié: (2025)
par: Zhang, Caiqi, et autres
Publié: (2025)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
par: Xiao, Jianfei, et autres
Publié: (2026)
par: Xiao, Jianfei, et autres
Publié: (2026)
The Disparate Impacts of Speculative Decoding
par: Sandler, Jameson, et autres
Publié: (2025)
par: Sandler, Jameson, et autres
Publié: (2025)
All Roads Lead to Rome: Graph-Based Confidence Estimation for Large Language Model Reasoning
par: Zhang, Caiqi, et autres
Publié: (2025)
par: Zhang, Caiqi, et autres
Publié: (2025)
ReasonGraph: Visualisation of Reasoning Paths
par: Li, Zongqian, et autres
Publié: (2025)
par: Li, Zongqian, et autres
Publié: (2025)
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
par: Li, Li, et autres
Publié: (2025)
par: Li, Li, et autres
Publié: (2025)
Extended Inductive Reasoning for Personalized Preference Inference from Behavioral Signals
par: Li, Jia-Nan, et autres
Publié: (2025)
par: Li, Jia-Nan, et autres
Publié: (2025)
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
par: Amirizaniani, Maryam, et autres
Publié: (2026)
par: Amirizaniani, Maryam, et autres
Publié: (2026)
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
par: Poddar, Sriyash, et autres
Publié: (2024)
par: Poddar, Sriyash, et autres
Publié: (2024)
Tell me what I need to know: Exploring LLM-based (Personalized) Abstractive Multi-Source Meeting Summarization
par: Kirstein, Frederic, et autres
Publié: (2024)
par: Kirstein, Frederic, et autres
Publié: (2024)
Prompt Compression for Large Language Models: A Survey
par: Li, Zongqian, et autres
Publié: (2024)
par: Li, Zongqian, et autres
Publié: (2024)
Documents similaires
-
Can LLM be a Personalized Judge?
par: Dong, Yijiang River, et autres
Publié: (2024) -
Steer Model beyond Assistant: Controlling System Prompt Strength via Contrastive Decoding
par: Dong, Yijiang River, et autres
Publié: (2026) -
iNews: A Multimodal Dataset for Modeling Personalized Affective Responses to News
par: Hu, Tiancheng, et autres
Publié: (2025) -
Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging
par: Hu, Tiancheng, et autres
Publié: (2025) -
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
par: Liu, Yinhong, et autres
Publié: (2024)