Fragile Preferences: A Deep Dive Into Order Effects in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Yin, Haonan, Vardi, Shai, Choudhary, Vidyanand |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
di: Kaduri, Omri, et al.
Pubblicazione: (2024)
di: Kaduri, Omri, et al.
Pubblicazione: (2024)
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
di: Guo, Kai, et al.
Pubblicazione: (2024)
di: Guo, Kai, et al.
Pubblicazione: (2024)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
di: Chen, QiHong, et al.
Pubblicazione: (2024)
di: Chen, QiHong, et al.
Pubblicazione: (2024)
A Survey of Fragile Model Watermarking
di: Gao, Zhenzhe, et al.
Pubblicazione: (2024)
di: Gao, Zhenzhe, et al.
Pubblicazione: (2024)
Weights-Rotated Preference Optimization for Large Language Models
di: Yang, Chenxu, et al.
Pubblicazione: (2025)
di: Yang, Chenxu, et al.
Pubblicazione: (2025)
On Diversified Preferences of Large Language Model Alignment
di: Zeng, Dun, et al.
Pubblicazione: (2023)
di: Zeng, Dun, et al.
Pubblicazione: (2023)
Preference Packing: Efficient Preference Optimization for Large Language Models
di: Cho, Jaekyung
Pubblicazione: (2026)
di: Cho, Jaekyung
Pubblicazione: (2026)
Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models
di: Chen, Zijun, et al.
Pubblicazione: (2024)
di: Chen, Zijun, et al.
Pubblicazione: (2024)
Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2025)
Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models
di: Tan, Zhijie, et al.
Pubblicazione: (2024)
di: Tan, Zhijie, et al.
Pubblicazione: (2024)
Aligned but Fragile: Enhancing LLM Safety Robustness via Zeroth-Order Optimization
di: Liu, Zhihao, et al.
Pubblicazione: (2026)
di: Liu, Zhihao, et al.
Pubblicazione: (2026)
Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models
di: Wei, Tianwen, et al.
Pubblicazione: (2024)
di: Wei, Tianwen, et al.
Pubblicazione: (2024)
Help or Hurdle? Rethinking Model Context Protocol-Augmented Large Language Models
di: Song, Wei, et al.
Pubblicazione: (2025)
di: Song, Wei, et al.
Pubblicazione: (2025)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
DeepDiveAI: Identifying AI Related Documents in Large Scale Literature Data
di: Xiaochen, Zhou, et al.
Pubblicazione: (2024)
di: Xiaochen, Zhou, et al.
Pubblicazione: (2024)
Asking Clarifying Questions for Preference Elicitation With Large Language Models
di: Montazeralghaem, Ali, et al.
Pubblicazione: (2025)
di: Montazeralghaem, Ali, et al.
Pubblicazione: (2025)
Aligning Large Language Models with Searcher Preferences
di: Wu, Wei, et al.
Pubblicazione: (2026)
di: Wu, Wei, et al.
Pubblicazione: (2026)
Estimating the Effects of Sample Training Orders for Large Language Models without Retraining
di: Yang, Hao, et al.
Pubblicazione: (2025)
di: Yang, Hao, et al.
Pubblicazione: (2025)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
di: Kour, George, et al.
Pubblicazione: (2025)
di: Kour, George, et al.
Pubblicazione: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
The Fragility Of Moral Judgment In Large Language Models
di: van Nuenen, Tom, et al.
Pubblicazione: (2026)
di: van Nuenen, Tom, et al.
Pubblicazione: (2026)
From Principles to Practice: A Deep Dive into AI Ethics and Regulations
di: Sun, Nan, et al.
Pubblicazione: (2024)
di: Sun, Nan, et al.
Pubblicazione: (2024)
Can Large Language Models Capture Human Risk Preferences? A Cross-Cultural Study
di: Song, Bing, et al.
Pubblicazione: (2025)
di: Song, Bing, et al.
Pubblicazione: (2025)
Active Preference Learning for Large Language Models
di: Muldrew, William, et al.
Pubblicazione: (2024)
di: Muldrew, William, et al.
Pubblicazione: (2024)
The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse
di: Yang, Wanli, et al.
Pubblicazione: (2024)
di: Yang, Wanli, et al.
Pubblicazione: (2024)
Learning to Select In-Context Demonstration Preferred by Large Language Model
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
ICL Optimized Fragility
di: Wannaz, Serena Gomez
Pubblicazione: (2025)
di: Wannaz, Serena Gomez
Pubblicazione: (2025)
Self-Boosting Large Language Models with Synthetic Preference Data
di: Dong, Qingxiu, et al.
Pubblicazione: (2024)
di: Dong, Qingxiu, et al.
Pubblicazione: (2024)
Aligning Large Language Model Behavior with Human Citation Preferences
di: Ando, Kenichiro, et al.
Pubblicazione: (2026)
di: Ando, Kenichiro, et al.
Pubblicazione: (2026)
Large Language Models are Zero-Shot Recognizers for Activities of Daily Living
di: Civitarese, Gabriele, et al.
Pubblicazione: (2024)
di: Civitarese, Gabriele, et al.
Pubblicazione: (2024)
Beyond Text-Dominance: Understanding Modality Preference of Omni-modal Large Language Models
di: Yan, Xinru, et al.
Pubblicazione: (2026)
di: Yan, Xinru, et al.
Pubblicazione: (2026)
Premise Order Matters in Reasoning with Large Language Models
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
di: Badrinath, Anirudhan, et al.
Pubblicazione: (2024)
di: Badrinath, Anirudhan, et al.
Pubblicazione: (2024)
Matching Game Preferences Through Dialogical Large Language Models: A Perspective
di: Fabre, Renaud, et al.
Pubblicazione: (2025)
di: Fabre, Renaud, et al.
Pubblicazione: (2025)
DFIN-SQL: Integrating Focused Schema with DIN-SQL for Superior Accuracy in Large-Scale Databases
di: Volvovsky, Shai, et al.
Pubblicazione: (2024)
di: Volvovsky, Shai, et al.
Pubblicazione: (2024)
Fragile Model Watermark for integrity protection: leveraging boundary volatility and sensitive sample-pairing
di: Gao, ZhenZhe, et al.
Pubblicazione: (2024)
di: Gao, ZhenZhe, et al.
Pubblicazione: (2024)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
di: Yu, Huimu, et al.
Pubblicazione: (2024)
di: Yu, Huimu, et al.
Pubblicazione: (2024)
Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
di: Xie, Zikai
Pubblicazione: (2024)
di: Xie, Zikai
Pubblicazione: (2024)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
di: Cao, Boxi, et al.
Pubblicazione: (2023)
di: Cao, Boxi, et al.
Pubblicazione: (2023)
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
di: Gu, Zhuojun, et al.
Pubblicazione: (2025)
di: Gu, Zhuojun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
di: Kaduri, Omri, et al.
Pubblicazione: (2024) -
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
di: Guo, Kai, et al.
Pubblicazione: (2024) -
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
di: Chen, QiHong, et al.
Pubblicazione: (2024) -
A Survey of Fragile Model Watermarking
di: Gao, Zhenzhe, et al.
Pubblicazione: (2024) -
Weights-Rotated Preference Optimization for Large Language Models
di: Yang, Chenxu, et al.
Pubblicazione: (2025)