On Diversified Preferences of Large Language Model Alignment
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zeng, Dun, Dai, Yong, Cheng, Pengyu, Wang, Longyue, Hu, Tianhao, Chen, Wanshun, Du, Nan, Xu, Zenglin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
von: Cheng, Pengyu, et al.
Veröffentlicht: (2023)
von: Cheng, Pengyu, et al.
Veröffentlicht: (2023)
Anchor-based Large Language Models
von: Pang, Jianhui, et al.
Veröffentlicht: (2024)
von: Pang, Jianhui, et al.
Veröffentlicht: (2024)
Tree of Preferences for Diversified Recommendation
von: Yuan, Hanyang, et al.
Veröffentlicht: (2025)
von: Yuan, Hanyang, et al.
Veröffentlicht: (2025)
Chunk, Align, Select: A Simple Long-sequence Processing Method for Transformers
von: Xie, Jiawen, et al.
Veröffentlicht: (2023)
von: Xie, Jiawen, et al.
Veröffentlicht: (2023)
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
von: Badrinath, Anirudhan, et al.
Veröffentlicht: (2024)
von: Badrinath, Anirudhan, et al.
Veröffentlicht: (2024)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
von: Gu, Leijiang, et al.
Veröffentlicht: (2026)
von: Gu, Leijiang, et al.
Veröffentlicht: (2026)
KV-Efficient VLA: A Method to Speed up Vision Language Models with RNN-Gated Chunked KV Cache
von: Xu, Wanshun, et al.
Veröffentlicht: (2025)
von: Xu, Wanshun, et al.
Veröffentlicht: (2025)
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
von: Gu, Zhuojun, et al.
Veröffentlicht: (2025)
von: Gu, Zhuojun, et al.
Veröffentlicht: (2025)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
von: Liu, Biao, et al.
Veröffentlicht: (2025)
von: Liu, Biao, et al.
Veröffentlicht: (2025)
FedNoisy: Federated Noisy Label Learning Benchmark
von: Liang, Siqi, et al.
Veröffentlicht: (2023)
von: Liang, Siqi, et al.
Veröffentlicht: (2023)
Towards Benign Memory Forgetting for Selective Multimodal Large Language Model Unlearning
von: Zeng, Zhen, et al.
Veröffentlicht: (2025)
von: Zeng, Zhen, et al.
Veröffentlicht: (2025)
Simple Yet Effective: Extracting Private Data Across Clients in Federated Fine-Tuning of Large Language Models
von: Hu, Yingqi, et al.
Veröffentlicht: (2025)
von: Hu, Yingqi, et al.
Veröffentlicht: (2025)
Strong Preferences Affect the Robustness of Preference Models and Value Alignment
von: Xu, Ziwei, et al.
Veröffentlicht: (2024)
von: Xu, Ziwei, et al.
Veröffentlicht: (2024)
Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models
von: Lu, Shule, et al.
Veröffentlicht: (2026)
von: Lu, Shule, et al.
Veröffentlicht: (2026)
Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models
von: Lu, Shule, et al.
Veröffentlicht: (2026)
von: Lu, Shule, et al.
Veröffentlicht: (2026)
Adversarial Preference Learning for Robust LLM Alignment
von: Wang, Yuanfu, et al.
Veröffentlicht: (2025)
von: Wang, Yuanfu, et al.
Veröffentlicht: (2025)
Accelerated Preference Optimization for Large Language Model Alignment
von: He, Jiafan, et al.
Veröffentlicht: (2024)
von: He, Jiafan, et al.
Veröffentlicht: (2024)
Atoxia: Red-teaming Large Language Models with Target Toxic Answers
von: Du, Yuhao, et al.
Veröffentlicht: (2024)
von: Du, Yuhao, et al.
Veröffentlicht: (2024)
PopAlign: Diversifying Contrasting Patterns for a More Comprehensive Alignment
von: Wang, Zekun Moore, et al.
Veröffentlicht: (2024)
von: Wang, Zekun Moore, et al.
Veröffentlicht: (2024)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
von: Zeng, Zhen, et al.
Veröffentlicht: (2024)
von: Zeng, Zhen, et al.
Veröffentlicht: (2024)
Aligning Large Language Models with Searcher Preferences
von: Wu, Wei, et al.
Veröffentlicht: (2026)
von: Wu, Wei, et al.
Veröffentlicht: (2026)
Human Alignment of Large Language Models through Online Preference Optimisation
von: Calandriello, Daniele, et al.
Veröffentlicht: (2024)
von: Calandriello, Daniele, et al.
Veröffentlicht: (2024)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
von: Yuan, Hongbang, et al.
Veröffentlicht: (2024)
Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer
von: Liu, Boan, et al.
Veröffentlicht: (2023)
von: Liu, Boan, et al.
Veröffentlicht: (2023)
DARC: Disagreement-Aware Alignment via Risk-Constrained Decoding
von: Zou, Mingxi, et al.
Veröffentlicht: (2026)
von: Zou, Mingxi, et al.
Veröffentlicht: (2026)
GRACE: A Dynamic Coreset Selection Framework for Large Language Model Optimization
von: Tang, Tianhao, et al.
Veröffentlicht: (2026)
von: Tang, Tianhao, et al.
Veröffentlicht: (2026)
FedCVD: The First Real-World Federated Learning Benchmark on Cardiovascular Disease Data
von: Zhang, Yukun, et al.
Veröffentlicht: (2024)
von: Zhang, Yukun, et al.
Veröffentlicht: (2024)
Chain-of-Thought as a Lens: Evaluating Structured Reasoning Alignment between Human Preferences and Large Language Models
von: Wang, Boxuan, et al.
Veröffentlicht: (2025)
von: Wang, Boxuan, et al.
Veröffentlicht: (2025)
An Uncertainty-Driven Adaptive Self-Alignment Framework for Large Language Models
von: Sun, Haoran, et al.
Veröffentlicht: (2025)
von: Sun, Haoran, et al.
Veröffentlicht: (2025)
CURATRON: Complete and Robust Preference Data for Rigorous Alignment of Large Language Models
von: Nguyen, Son The, et al.
Veröffentlicht: (2024)
von: Nguyen, Son The, et al.
Veröffentlicht: (2024)
LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language Models
von: Shen, Tiesunlong, et al.
Veröffentlicht: (2026)
von: Shen, Tiesunlong, et al.
Veröffentlicht: (2026)
UGMathBench: A Diverse and Dynamic Benchmark for Undergraduate-Level Mathematical Reasoning with Large Language Models
von: Xu, Xin, et al.
Veröffentlicht: (2025)
von: Xu, Xin, et al.
Veröffentlicht: (2025)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
von: Yu, Huimu, et al.
Veröffentlicht: (2024)
von: Yu, Huimu, et al.
Veröffentlicht: (2024)
Large Language Models as Code Executors: An Exploratory Study
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
Group Preference Optimization: Few-Shot Alignment of Large Language Models
von: Zhao, Siyan, et al.
Veröffentlicht: (2023)
von: Zhao, Siyan, et al.
Veröffentlicht: (2023)
Differentially Private Preference Data Synthesis for Large Language Model Alignment
von: Gao, Fengyu, et al.
Veröffentlicht: (2026)
von: Gao, Fengyu, et al.
Veröffentlicht: (2026)
Probabilistic Token Alignment for Large Language Model Fusion
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models
von: Jiang, Xinyan, et al.
Veröffentlicht: (2025)
von: Jiang, Xinyan, et al.
Veröffentlicht: (2025)
Machine Unlearning of Pre-trained Large Language Models
von: Yao, Jin, et al.
Veröffentlicht: (2024)
von: Yao, Jin, et al.
Veröffentlicht: (2024)
Large Language Model's Multi-Capability Alignment in Biomedical Domain
von: Wu, Wentao, et al.
Veröffentlicht: (2025)
von: Wu, Wentao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
von: Cheng, Pengyu, et al.
Veröffentlicht: (2023) -
Anchor-based Large Language Models
von: Pang, Jianhui, et al.
Veröffentlicht: (2024) -
Tree of Preferences for Diversified Recommendation
von: Yuan, Hanyang, et al.
Veröffentlicht: (2025) -
Chunk, Align, Select: A Simple Long-sequence Processing Method for Transformers
von: Xie, Jiawen, et al.
Veröffentlicht: (2023) -
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier
von: Badrinath, Anirudhan, et al.
Veröffentlicht: (2024)