Fragile Preferences: A Deep Dive Into Order Effects in Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Yin, Haonan, Vardi, Shai, Choudhary, Vidyanand |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
by: Kaduri, Omri, et al.
Published: (2024)
by: Kaduri, Omri, et al.
Published: (2024)
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
by: Guo, Kai, et al.
Published: (2024)
by: Guo, Kai, et al.
Published: (2024)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
by: Chen, QiHong, et al.
Published: (2024)
by: Chen, QiHong, et al.
Published: (2024)
A Survey of Fragile Model Watermarking
by: Gao, Zhenzhe, et al.
Published: (2024)
by: Gao, Zhenzhe, et al.
Published: (2024)
Weights-Rotated Preference Optimization for Large Language Models
by: Yang, Chenxu, et al.
Published: (2025)
by: Yang, Chenxu, et al.
Published: (2025)
On Diversified Preferences of Large Language Model Alignment
by: Zeng, Dun, et al.
Published: (2023)
by: Zeng, Dun, et al.
Published: (2023)
Preference Packing: Efficient Preference Optimization for Large Language Models
by: Cho, Jaekyung
Published: (2026)
by: Cho, Jaekyung
Published: (2026)
Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models
by: Chen, Zijun, et al.
Published: (2024)
by: Chen, Zijun, et al.
Published: (2024)
Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization
by: Nguyen, Thanh Thi, et al.
Published: (2025)
by: Nguyen, Thanh Thi, et al.
Published: (2025)
Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models
by: Tan, Zhijie, et al.
Published: (2024)
by: Tan, Zhijie, et al.
Published: (2024)
Aligned but Fragile: Enhancing LLM Safety Robustness via Zeroth-Order Optimization
by: Liu, Zhihao, et al.
Published: (2026)
by: Liu, Zhihao, et al.
Published: (2026)
Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models
by: Wei, Tianwen, et al.
Published: (2024)
by: Wei, Tianwen, et al.
Published: (2024)
Help or Hurdle? Rethinking Model Context Protocol-Augmented Large Language Models
by: Song, Wei, et al.
Published: (2025)
by: Song, Wei, et al.
Published: (2025)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
by: Aravindan, Ashwath Vaithinathan, et al.
Published: (2026)
by: Aravindan, Ashwath Vaithinathan, et al.
Published: (2026)
DeepDiveAI: Identifying AI Related Documents in Large Scale Literature Data
by: Xiaochen, Zhou, et al.
Published: (2024)
by: Xiaochen, Zhou, et al.
Published: (2024)
Asking Clarifying Questions for Preference Elicitation With Large Language Models
by: Montazeralghaem, Ali, et al.
Published: (2025)
by: Montazeralghaem, Ali, et al.
Published: (2025)
Aligning Large Language Models with Searcher Preferences
by: Wu, Wei, et al.
Published: (2026)
by: Wu, Wei, et al.
Published: (2026)
Estimating the Effects of Sample Training Orders for Large Language Models without Retraining
by: Yang, Hao, et al.
Published: (2025)
by: Yang, Hao, et al.
Published: (2025)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
by: Kour, George, et al.
Published: (2025)
by: Kour, George, et al.
Published: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
by: Zhang, Rongzhi, et al.
Published: (2024)
by: Zhang, Rongzhi, et al.
Published: (2024)
The Fragility Of Moral Judgment In Large Language Models
by: van Nuenen, Tom, et al.
Published: (2026)
by: van Nuenen, Tom, et al.
Published: (2026)
From Principles to Practice: A Deep Dive into AI Ethics and Regulations
by: Sun, Nan, et al.
Published: (2024)
by: Sun, Nan, et al.
Published: (2024)
Can Large Language Models Capture Human Risk Preferences? A Cross-Cultural Study
by: Song, Bing, et al.
Published: (2025)
by: Song, Bing, et al.
Published: (2025)
Active Preference Learning for Large Language Models
by: Muldrew, William, et al.
Published: (2024)
by: Muldrew, William, et al.
Published: (2024)
The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse
by: Yang, Wanli, et al.
Published: (2024)
by: Yang, Wanli, et al.
Published: (2024)
Learning to Select In-Context Demonstration Preferred by Large Language Model
by: Zhang, Zheng, et al.
Published: (2025)
by: Zhang, Zheng, et al.
Published: (2025)
ICL Optimized Fragility
by: Wannaz, Serena Gomez
Published: (2025)
by: Wannaz, Serena Gomez
Published: (2025)
Self-Boosting Large Language Models with Synthetic Preference Data
by: Dong, Qingxiu, et al.
Published: (2024)
by: Dong, Qingxiu, et al.
Published: (2024)
Aligning Large Language Model Behavior with Human Citation Preferences
by: Ando, Kenichiro, et al.
Published: (2026)
by: Ando, Kenichiro, et al.
Published: (2026)
Large Language Models are Zero-Shot Recognizers for Activities of Daily Living
by: Civitarese, Gabriele, et al.
Published: (2024)
by: Civitarese, Gabriele, et al.
Published: (2024)
Beyond Text-Dominance: Understanding Modality Preference of Omni-modal Large Language Models
by: Yan, Xinru, et al.
Published: (2026)
by: Yan, Xinru, et al.
Published: (2026)
Premise Order Matters in Reasoning with Large Language Models
by: Chen, Xinyun, et al.
Published: (2024)
by: Chen, Xinyun, et al.
Published: (2024)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
by: Badrinath, Anirudhan, et al.
Published: (2024)
by: Badrinath, Anirudhan, et al.
Published: (2024)
Matching Game Preferences Through Dialogical Large Language Models: A Perspective
by: Fabre, Renaud, et al.
Published: (2025)
by: Fabre, Renaud, et al.
Published: (2025)
DFIN-SQL: Integrating Focused Schema with DIN-SQL for Superior Accuracy in Large-Scale Databases
by: Volvovsky, Shai, et al.
Published: (2024)
by: Volvovsky, Shai, et al.
Published: (2024)
Fragile Model Watermark for integrity protection: leveraging boundary volatility and sensitive sample-pairing
by: Gao, ZhenZhe, et al.
Published: (2024)
by: Gao, ZhenZhe, et al.
Published: (2024)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
by: Yu, Huimu, et al.
Published: (2024)
by: Yu, Huimu, et al.
Published: (2024)
Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
by: Xie, Zikai
Published: (2024)
by: Xie, Zikai
Published: (2024)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
by: Cao, Boxi, et al.
Published: (2023)
by: Cao, Boxi, et al.
Published: (2023)
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
by: Gu, Zhuojun, et al.
Published: (2025)
by: Gu, Zhuojun, et al.
Published: (2025)
Similar Items
-
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
by: Kaduri, Omri, et al.
Published: (2024) -
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
by: Guo, Kai, et al.
Published: (2024) -
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
by: Chen, QiHong, et al.
Published: (2024) -
A Survey of Fragile Model Watermarking
by: Gao, Zhenzhe, et al.
Published: (2024) -
Weights-Rotated Preference Optimization for Large Language Models
by: Yang, Chenxu, et al.
Published: (2025)