Meet Dynamic Individual Preferences: Resolving Conflicting Human Value with Paired Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Shanyong, Lin, Shuhang, Zhao, Yining, Zhu, Xi, Zhang, Yongfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cache Mechanism for Agent RAG Systems
par: Lin, Shuhang, et autres
Publié: (2025)
par: Lin, Shuhang, et autres
Publié: (2025)
Entropy-Adaptive Fine-Tuning: Resolving Confident Conflicts to Mitigate Forgetting
par: Diao, Muxi, et autres
Publié: (2026)
par: Diao, Muxi, et autres
Publié: (2026)
LRHP: Learning Representations for Human Preferences via Preference Pairs
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
OmniRouter: Budget and Performance Controllable Multi-LLM Routing
par: Mei, Kai, et autres
Publié: (2025)
par: Mei, Kai, et autres
Publié: (2025)
TruthfulRAG: Resolving Factual-level Conflicts in Retrieval-Augmented Generation with Knowledge Graphs
par: Liu, Shuyi, et autres
Publié: (2025)
par: Liu, Shuyi, et autres
Publié: (2025)
UORA: Uniform Orthogonal Reinitialization Adaptation in Parameter-Efficient Fine-Tuning of Large Models
par: Zhang, Xueyan, et autres
Publié: (2025)
par: Zhang, Xueyan, et autres
Publié: (2025)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
par: Liang, Yao, et autres
Publié: (2025)
par: Liang, Yao, et autres
Publié: (2025)
ReaGAN: Node-as-Agent-Reasoning Graph Agentic Network
par: Guo, Minghao, et autres
Publié: (2025)
par: Guo, Minghao, et autres
Publié: (2025)
MPO: An Efficient Post-Processing Framework for Mixing Diverse Preference Alignment
par: Wang, Tianze, et autres
Publié: (2025)
par: Wang, Tianze, et autres
Publié: (2025)
Triplets Better Than Pairs: Towards Stable and Effective Self-Play Fine-Tuning for LLMs
par: Wang, Yibo, et autres
Publié: (2026)
par: Wang, Yibo, et autres
Publié: (2026)
Resolving Knowledge Conflicts in Large Language Models
par: Wang, Yike, et autres
Publié: (2023)
par: Wang, Yike, et autres
Publié: (2023)
DEFT: Distribution-guided Efficient Fine-Tuning for Human Alignment
par: Zhu, Liang, et autres
Publié: (2026)
par: Zhu, Liang, et autres
Publié: (2026)
SOLAR: Towards Characterizing Subjectivity of Individuals through Modeling Value Conflicts and Trade-offs
par: Lee, Younghun, et autres
Publié: (2025)
par: Lee, Younghun, et autres
Publié: (2025)
ConflictRAG: Detecting and Resolving Knowledge Conflicts in Retrieval Augmented Generation
par: Wang, Chenyu, et autres
Publié: (2026)
par: Wang, Chenyu, et autres
Publié: (2026)
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
par: Zhang, Jianfei, et autres
Publié: (2024)
par: Zhang, Jianfei, et autres
Publié: (2024)
$λ$-GRPO: Unifying the GRPO Frameworks with Learnable Token Preferences
par: Wang, Yining, et autres
Publié: (2025)
par: Wang, Yining, et autres
Publié: (2025)
Linear Alignment: A Closed-form Solution for Aligning Human Preferences without Tuning and Feedback
par: Gao, Songyang, et autres
Publié: (2024)
par: Gao, Songyang, et autres
Publié: (2024)
Align Generative Artificial Intelligence with Human Preferences: A Novel Large Language Model Fine-Tuning Method for Online Review Management
par: Wang, Yanan, et autres
Publié: (2026)
par: Wang, Yanan, et autres
Publié: (2026)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
par: Han, Yang, et autres
Publié: (2024)
par: Han, Yang, et autres
Publié: (2024)
COIG-P: A High-Quality and Large-Scale Chinese Preference Dataset for Alignment with Human Values
par: P Team, et autres
Publié: (2025)
par: P Team, et autres
Publié: (2025)
Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training
par: Lai, Song, et autres
Publié: (2025)
par: Lai, Song, et autres
Publié: (2025)
Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment
par: Huang, Yucong, et autres
Publié: (2026)
par: Huang, Yucong, et autres
Publié: (2026)
Beyond Single-Reward: Multi-Pair, Multi-Perspective Preference Optimization for Machine Translation
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
Preference-Oriented Supervised Fine-Tuning: Favoring Target Model Over Aligned Large Language Models
par: Fan, Yuchen, et autres
Publié: (2024)
par: Fan, Yuchen, et autres
Publié: (2024)
ValueSim: Generating Backstories to Model Individual Value Systems
par: Du, Bangde, et autres
Publié: (2025)
par: Du, Bangde, et autres
Publié: (2025)
Fine-Tuning LLMs with Fine-Grained Human Feedback on Text Spans
par: CH-Wang, Sky, et autres
Publié: (2025)
par: CH-Wang, Sky, et autres
Publié: (2025)
TuCo: Measuring the Contribution of Fine-Tuning to Individual Responses of LLMs
par: Nuti, Felipe, et autres
Publié: (2025)
par: Nuti, Felipe, et autres
Publié: (2025)
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models
par: Song, Chiyu, et autres
Publié: (2023)
par: Song, Chiyu, et autres
Publié: (2023)
Generalization to Political Beliefs from Fine-Tuning on Sports Team Preferences
par: Terry, Owen
Publié: (2026)
par: Terry, Owen
Publié: (2026)
Retrieval-Augmented Fine-Tuning With Preference Optimization For Visual Program Generation
par: Kang, Deokhyung, et autres
Publié: (2025)
par: Kang, Deokhyung, et autres
Publié: (2025)
Can Language Models Reason about Individualistic Human Values and Preferences?
par: Jiang, Liwei, et autres
Publié: (2024)
par: Jiang, Liwei, et autres
Publié: (2024)
SoRFT: Issue Resolving with Subtask-oriented Reinforced Fine-Tuning
par: Ma, Zexiong, et autres
Publié: (2025)
par: Ma, Zexiong, et autres
Publié: (2025)
ConflictBench: Evaluating Human-AI Conflict via Interactive and Visually Grounded Environments
par: Zhao, Weixiang, et autres
Publié: (2026)
par: Zhao, Weixiang, et autres
Publié: (2026)
LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning
par: Huang, Yining, et autres
Publié: (2025)
par: Huang, Yining, et autres
Publié: (2025)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
par: Zhang, Jia-Chen, et autres
Publié: (2024)
par: Zhang, Jia-Chen, et autres
Publié: (2024)
Consensus or Conflict? Fine-Grained Evaluation of Conflicting Answers in Question-Answering
par: Nachshoni, Eviatar, et autres
Publié: (2025)
par: Nachshoni, Eviatar, et autres
Publié: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
par: Zhang, Rongzhi, et autres
Publié: (2024)
par: Zhang, Rongzhi, et autres
Publié: (2024)
Fine-Tuning Language Models for Ethical Ambiguity: A Comparative Study of Alignment with Human Responses
par: Senthilkumar, Pranav, et autres
Publié: (2024)
par: Senthilkumar, Pranav, et autres
Publié: (2024)
Natural Language Fine-Tuning
par: Liu, Jia, et autres
Publié: (2024)
par: Liu, Jia, et autres
Publié: (2024)
Beyond QA Pairs: Assessing Parameter-Efficient Fine-Tuning for Fact Embedding in LLMs
par: Ratnakar, Shivam, et autres
Publié: (2025)
par: Ratnakar, Shivam, et autres
Publié: (2025)
Documents similaires
-
Cache Mechanism for Agent RAG Systems
par: Lin, Shuhang, et autres
Publié: (2025) -
Entropy-Adaptive Fine-Tuning: Resolving Confident Conflicts to Mitigate Forgetting
par: Diao, Muxi, et autres
Publié: (2026) -
LRHP: Learning Representations for Human Preferences via Preference Pairs
par: Wang, Chenglong, et autres
Publié: (2024) -
OmniRouter: Budget and Performance Controllable Multi-LLM Routing
par: Mei, Kai, et autres
Publié: (2025) -
TruthfulRAG: Resolving Factual-level Conflicts in Retrieval-Augmented Generation with Knowledge Graphs
par: Liu, Shuyi, et autres
Publié: (2025)