Implementing Rational Choice Functions with LLMs and Measuring their Alignment with User Preferences
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Karnysheva, Anna, Drescher, Christian, Klakow, Dietrich |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Semantic Understanding in Speech Language Models via Brain-tuning
par: Moussa, Omer, et autres
Publié: (2024)
par: Moussa, Omer, et autres
Publié: (2024)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
par: Wang, Haoxiang, et autres
Publié: (2024)
par: Wang, Haoxiang, et autres
Publié: (2024)
Unplugging a Seemingly Sentient Machine Is the Rational Choice -- A Metaphysical Perspective
par: Bekkers, Erik J, et autres
Publié: (2026)
par: Bekkers, Erik J, et autres
Publié: (2026)
Sparks of Rationality: Do Reasoning LLMs Align with Human Judgment and Choice?
par: Tak, Ala N., et autres
Publié: (2026)
par: Tak, Ala N., et autres
Publié: (2026)
PricingLogic: Evaluating LLMs Reasoning on Complex Tourism Pricing Tasks
par: Liu, Yunuo, et autres
Publié: (2025)
par: Liu, Yunuo, et autres
Publié: (2025)
Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
par: Chehade, Mohamad, et autres
Publié: (2025)
par: Chehade, Mohamad, et autres
Publié: (2025)
Chemical Language Models for Natural Products: A State-Space Model Approach
par: Wang, Ho-Hsuan, et autres
Publié: (2026)
par: Wang, Ho-Hsuan, et autres
Publié: (2026)
Routing, Cascades, and User Choice for LLMs
par: Mahmood, Rafid
Publié: (2026)
par: Mahmood, Rafid
Publié: (2026)
Classical AI vs. LLMs for Decision-Maker Alignment in Health Insurance Choices
par: Mainali, Mallika, et autres
Publié: (2025)
par: Mainali, Mallika, et autres
Publié: (2025)
Is On-Policy Data always the Best Choice for Direct Preference Optimization-based LM Alignment?
par: Sun, Zetian, et autres
Publié: (2025)
par: Sun, Zetian, et autres
Publié: (2025)
Learning a Reward Function for User-Preferred Appliance Scheduling
par: Čović, Nikolina, et autres
Publié: (2023)
par: Čović, Nikolina, et autres
Publié: (2023)
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
par: Li, Jia-Nan, et autres
Publié: (2025)
par: Li, Jia-Nan, et autres
Publié: (2025)
Reward-Augmented Data Enhances Direct Preference Alignment of LLMs
par: Zhang, Shenao, et autres
Publié: (2024)
par: Zhang, Shenao, et autres
Publié: (2024)
Sample Efficient Preference Alignment in LLMs via Active Exploration
par: Mehta, Viraj, et autres
Publié: (2023)
par: Mehta, Viraj, et autres
Publié: (2023)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
MALLES: A Multi-agent LLMs-based Economic Sandbox with Consumer Preference Alignment
par: Wu, Yusen, et autres
Publié: (2026)
par: Wu, Yusen, et autres
Publié: (2026)
Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences
par: Koo, Jabin, et autres
Publié: (2026)
par: Koo, Jabin, et autres
Publié: (2026)
APPA: Adaptive Preference Pluralistic Alignment for Fair Federated RLHF of LLMs
par: Srewa, Mahmoud, et autres
Publié: (2026)
par: Srewa, Mahmoud, et autres
Publié: (2026)
When Weak LLMs Speak with Confidence, Preference Alignment Gets Stronger
par: Afzali, Amirabbas, et autres
Publié: (2026)
par: Afzali, Amirabbas, et autres
Publié: (2026)
HPS: Hard Preference Sampling for Human Preference Alignment
par: Zou, Xiandong, et autres
Publié: (2025)
par: Zou, Xiandong, et autres
Publié: (2025)
Beyond Preferences in AI Alignment
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
par: Srewa, Mahmoud, et autres
Publié: (2025)
par: Srewa, Mahmoud, et autres
Publié: (2025)
GEM: Generative Entropy-Guided Preference Modeling for Few-shot Alignment of LLMs
par: Zhao, Yiyang, et autres
Publié: (2025)
par: Zhao, Yiyang, et autres
Publié: (2025)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
par: Xu, Wenzhe, et autres
Publié: (2026)
par: Xu, Wenzhe, et autres
Publié: (2026)
Strong Preferences Affect the Robustness of Preference Models and Value Alignment
par: Xu, Ziwei, et autres
Publié: (2024)
par: Xu, Ziwei, et autres
Publié: (2024)
Resource Rational Contractualism Should Guide AI Alignment
par: Levine, Sydney, et autres
Publié: (2025)
par: Levine, Sydney, et autres
Publié: (2025)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
par: Badrinath, Anirudhan, et autres
Publié: (2024)
par: Badrinath, Anirudhan, et autres
Publié: (2024)
Understanding User Preferences in Explainable Artificial Intelligence: A Survey and a Mapping Function Proposal
par: Hashemi, Maryam, et autres
Publié: (2023)
par: Hashemi, Maryam, et autres
Publié: (2023)
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
Temporal User Profiling with LLMs: Balancing Short-Term and Long-Term Preferences for Recommendations
par: Sabouri, Milad, et autres
Publié: (2025)
par: Sabouri, Milad, et autres
Publié: (2025)
EcoAlign: An Economically Rational Framework for Efficient LVLM Alignment
par: Cheng, Ruoxi, et autres
Publié: (2025)
par: Cheng, Ruoxi, et autres
Publié: (2025)
Implicit Safety Alignment from Crowd Preferences
par: Lin, Qian, et autres
Publié: (2026)
par: Lin, Qian, et autres
Publié: (2026)
On Diversified Preferences of Large Language Model Alignment
par: Zeng, Dun, et autres
Publié: (2023)
par: Zeng, Dun, et autres
Publié: (2023)
Direct Alignment with Heterogeneous Preferences
par: Shirali, Ali, et autres
Publié: (2025)
par: Shirali, Ali, et autres
Publié: (2025)
Who Laughs with Whom? Disentangling Influential Factors in Humor Preferences across User Clusters and LLMs
par: Murakami, Soichiro, et autres
Publié: (2026)
par: Murakami, Soichiro, et autres
Publié: (2026)
SparsePO: Controlling Preference Alignment of LLMs via Sparse Token Masks
par: Christopoulou, Fenia, et autres
Publié: (2024)
par: Christopoulou, Fenia, et autres
Publié: (2024)
Transformers for molecular property prediction: Domain adaptation efficiently improves performance
par: Sultan, Afnan, et autres
Publié: (2025)
par: Sultan, Afnan, et autres
Publié: (2025)
The Impact of Demonstrations on Multilingual In-Context Learning: A Multidimensional Analysis
par: Zhang, Miaoran, et autres
Publié: (2024)
par: Zhang, Miaoran, et autres
Publié: (2024)
From User Preferences to Base Score Extraction Functions in Gradual Argumentation (with Appendix)
par: Civit, Aniol, et autres
Publié: (2026)
par: Civit, Aniol, et autres
Publié: (2026)
The Sign Estimator: LLM Alignment in the Face of Choice Heterogeneity
par: Aouad, Ali, et autres
Publié: (2025)
par: Aouad, Ali, et autres
Publié: (2025)
Documents similaires
-
Improving Semantic Understanding in Speech Language Models via Brain-tuning
par: Moussa, Omer, et autres
Publié: (2024) -
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
par: Wang, Haoxiang, et autres
Publié: (2024) -
Unplugging a Seemingly Sentient Machine Is the Rational Choice -- A Metaphysical Perspective
par: Bekkers, Erik J, et autres
Publié: (2026) -
Sparks of Rationality: Do Reasoning LLMs Align with Human Judgment and Choice?
par: Tak, Ala N., et autres
Publié: (2026) -
PricingLogic: Evaluating LLMs Reasoning on Complex Tourism Pricing Tasks
par: Liu, Yunuo, et autres
Publié: (2025)