Saved in:
| Main Authors: | Yin, Haonan, Vardi, Shai, Choudhary, Vidyanand |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2506.14092 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
by: Kaduri, Omri, et al.
Published: (2024)
by: Kaduri, Omri, et al.
Published: (2024)
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
by: Guo, Kai, et al.
Published: (2024)
by: Guo, Kai, et al.
Published: (2024)
A Survey of Fragile Model Watermarking
by: Gao, Zhenzhe, et al.
Published: (2024)
by: Gao, Zhenzhe, et al.
Published: (2024)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
by: Chen, QiHong, et al.
Published: (2024)
by: Chen, QiHong, et al.
Published: (2024)
Weights-Rotated Preference Optimization for Large Language Models
by: Yang, Chenxu, et al.
Published: (2025)
by: Yang, Chenxu, et al.
Published: (2025)
On Diversified Preferences of Large Language Model Alignment
by: Zeng, Dun, et al.
Published: (2023)
by: Zeng, Dun, et al.
Published: (2023)
Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models
by: Chen, Zijun, et al.
Published: (2024)
by: Chen, Zijun, et al.
Published: (2024)
Preference Packing: Efficient Preference Optimization for Large Language Models
by: Cho, Jaekyung
Published: (2026)
by: Cho, Jaekyung
Published: (2026)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
by: Aravindan, Ashwath Vaithinathan, et al.
Published: (2026)
by: Aravindan, Ashwath Vaithinathan, et al.
Published: (2026)
Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization
by: Nguyen, Thanh Thi, et al.
Published: (2025)
by: Nguyen, Thanh Thi, et al.
Published: (2025)
Aligned but Fragile: Enhancing LLM Safety Robustness via Zeroth-Order Optimization
by: Liu, Zhihao, et al.
Published: (2026)
by: Liu, Zhihao, et al.
Published: (2026)
Help or Hurdle? Rethinking Model Context Protocol-Augmented Large Language Models
by: Song, Wei, et al.
Published: (2025)
by: Song, Wei, et al.
Published: (2025)
The Fragility Of Moral Judgment In Large Language Models
by: van Nuenen, Tom, et al.
Published: (2026)
by: van Nuenen, Tom, et al.
Published: (2026)
Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models
by: Tan, Zhijie, et al.
Published: (2024)
by: Tan, Zhijie, et al.
Published: (2024)
Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models
by: Wei, Tianwen, et al.
Published: (2024)
by: Wei, Tianwen, et al.
Published: (2024)
Aligning Large Language Models with Searcher Preferences
by: Wu, Wei, et al.
Published: (2026)
by: Wu, Wei, et al.
Published: (2026)
Asking Clarifying Questions for Preference Elicitation With Large Language Models
by: Montazeralghaem, Ali, et al.
Published: (2025)
by: Montazeralghaem, Ali, et al.
Published: (2025)
Estimating the Effects of Sample Training Orders for Large Language Models without Retraining
by: Yang, Hao, et al.
Published: (2025)
by: Yang, Hao, et al.
Published: (2025)
DeepDiveAI: Identifying AI Related Documents in Large Scale Literature Data
by: Xiaochen, Zhou, et al.
Published: (2024)
by: Xiaochen, Zhou, et al.
Published: (2024)
Large Language Models are Zero-Shot Recognizers for Activities of Daily Living
by: Civitarese, Gabriele, et al.
Published: (2024)
by: Civitarese, Gabriele, et al.
Published: (2024)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
by: Kour, George, et al.
Published: (2025)
by: Kour, George, et al.
Published: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
by: Zhang, Rongzhi, et al.
Published: (2024)
by: Zhang, Rongzhi, et al.
Published: (2024)
DFIN-SQL: Integrating Focused Schema with DIN-SQL for Superior Accuracy in Large-Scale Databases
by: Volvovsky, Shai, et al.
Published: (2024)
by: Volvovsky, Shai, et al.
Published: (2024)
Active Preference Learning for Large Language Models
by: Muldrew, William, et al.
Published: (2024)
by: Muldrew, William, et al.
Published: (2024)
ICL Optimized Fragility
by: Wannaz, Serena Gomez
Published: (2025)
by: Wannaz, Serena Gomez
Published: (2025)
Fragile Model Watermark for integrity protection: leveraging boundary volatility and sensitive sample-pairing
by: Gao, ZhenZhe, et al.
Published: (2024)
by: Gao, ZhenZhe, et al.
Published: (2024)
Learning to Select In-Context Demonstration Preferred by Large Language Model
by: Zhang, Zheng, et al.
Published: (2025)
by: Zhang, Zheng, et al.
Published: (2025)
Self-Boosting Large Language Models with Synthetic Preference Data
by: Dong, Qingxiu, et al.
Published: (2024)
by: Dong, Qingxiu, et al.
Published: (2024)
Aligning Large Language Model Behavior with Human Citation Preferences
by: Ando, Kenichiro, et al.
Published: (2026)
by: Ando, Kenichiro, et al.
Published: (2026)
The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse
by: Yang, Wanli, et al.
Published: (2024)
by: Yang, Wanli, et al.
Published: (2024)
FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness
by: Li, Zhuoyun, et al.
Published: (2026)
by: Li, Zhuoyun, et al.
Published: (2026)
From Principles to Practice: A Deep Dive into AI Ethics and Regulations
by: Sun, Nan, et al.
Published: (2024)
by: Sun, Nan, et al.
Published: (2024)
Can Large Language Models Capture Human Risk Preferences? A Cross-Cultural Study
by: Song, Bing, et al.
Published: (2025)
by: Song, Bing, et al.
Published: (2025)
From Reasoning to Super-Intelligence: A Search-Theoretic Perspective
by: Shalev-Shwartz, Shai, et al.
Published: (2025)
by: Shalev-Shwartz, Shai, et al.
Published: (2025)
Premise Order Matters in Reasoning with Large Language Models
by: Chen, Xinyun, et al.
Published: (2024)
by: Chen, Xinyun, et al.
Published: (2024)
Synthetic Feature Augmentation Improves Generalization Performance of Language Models
by: Choudhary, Ashok, et al.
Published: (2025)
by: Choudhary, Ashok, et al.
Published: (2025)
Matching Game Preferences Through Dialogical Large Language Models: A Perspective
by: Fabre, Renaud, et al.
Published: (2025)
by: Fabre, Renaud, et al.
Published: (2025)
ROPO: Robust Preference Optimization for Large Language Models
by: Liang, Xize, et al.
Published: (2024)
by: Liang, Xize, et al.
Published: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
by: He, Jiafan, et al.
Published: (2024)
by: He, Jiafan, et al.
Published: (2024)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
by: Badrinath, Anirudhan, et al.
Published: (2024)
by: Badrinath, Anirudhan, et al.
Published: (2024)
Similar Items
-
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
by: Kaduri, Omri, et al.
Published: (2024) -
Learning on Graphs with Large Language Models(LLMs): A Deep Dive into Model Robustness
by: Guo, Kai, et al.
Published: (2024) -
A Survey of Fragile Model Watermarking
by: Gao, Zhenzhe, et al.
Published: (2024) -
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
by: Chen, QiHong, et al.
Published: (2024) -
Weights-Rotated Preference Optimization for Large Language Models
by: Yang, Chenxu, et al.
Published: (2025)