Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Yiju, Cui, Ganqu, Yuan, Lifan, Ding, Ning, Sun, Zexu, Sun, Bowen, Chen, Huimin, Xie, Ruobing, Zhou, Jie, Lin, Yankai, Liu, Zhiyuan, Sun, Maosong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Advancing LLM Reasoning Generalists with Preference Trees
par: Yuan, Lifan, et autres
Publié: (2024)
par: Yuan, Lifan, et autres
Publié: (2024)
Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning
par: Guo, Yiju, et autres
Publié: (2025)
par: Guo, Yiju, et autres
Publié: (2025)
UltraFeedback: Boosting Language Models with Scaled AI Feedback
par: Cui, Ganqu, et autres
Publié: (2023)
par: Cui, Ganqu, et autres
Publié: (2023)
Less Noise, More Voice: Reinforcement Learning for Reasoning via Instruction Purification
par: Guo, Yiju, et autres
Publié: (2026)
par: Guo, Yiju, et autres
Publié: (2026)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
par: Ding, Ning, et autres
Publié: (2024)
par: Ding, Ning, et autres
Publié: (2024)
From $f(x)$ and $g(x)$ to $f(g(x))$: LLMs Learn New Skills in RL by Composing Old Ones
par: Yuan, Lifan, et autres
Publié: (2025)
par: Yuan, Lifan, et autres
Publié: (2025)
Representation Learning for Natural Language Processing
par: Liu, Zhiyuan, et autres
Publié: (2020)
par: Liu, Zhiyuan, et autres
Publié: (2020)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
par: Xu, Wenzhe, et autres
Publié: (2026)
par: Xu, Wenzhe, et autres
Publié: (2026)
The Right Time Matters: Data Arrangement Affects Zero-Shot Generalization in Instruction Tuning
par: He, Bingxiang, et autres
Publié: (2024)
par: He, Bingxiang, et autres
Publié: (2024)
AIR: A Systematic Analysis of Annotations, Instructions, and Response Pairs in Preference Dataset
par: He, Bingxiang, et autres
Publié: (2025)
par: He, Bingxiang, et autres
Publié: (2025)
RLPR: Extrapolating RLVR to General Domains without Verifiers
par: Yu, Tianyu, et autres
Publié: (2025)
par: Yu, Tianyu, et autres
Publié: (2025)
Free Process Rewards without Process Labels
par: Yuan, Lifan, et autres
Publié: (2024)
par: Yuan, Lifan, et autres
Publié: (2024)
Exploring the Benefit of Activation Sparsity in Pre-training
par: Zhang, Zhengyan, et autres
Publié: (2024)
par: Zhang, Zhengyan, et autres
Publié: (2024)
The Overthinker's DIET: Cutting Token Calories with DIfficulty-AwarE Training
par: Chen, Weize, et autres
Publié: (2025)
par: Chen, Weize, et autres
Publié: (2025)
Noise Contrastive Alignment of Language Models with Explicit Rewards
par: Chen, Huayu, et autres
Publié: (2024)
par: Chen, Huayu, et autres
Publié: (2024)
RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback
par: Yu, Tianyu, et autres
Publié: (2023)
par: Yu, Tianyu, et autres
Publié: (2023)
LaSeR: Reinforcement Learning with Last-Token Self-Rewarding
par: Yang, Wenkai, et autres
Publié: (2025)
par: Yang, Wenkai, et autres
Publié: (2025)
Empowering Private Tutoring by Chaining Large Language Models
par: Chen, Yulin, et autres
Publié: (2023)
par: Chen, Yulin, et autres
Publié: (2023)
Variator: Accelerating Pre-trained Models with Plug-and-Play Compression Modules
par: Xiao, Chaojun, et autres
Publié: (2023)
par: Xiao, Chaojun, et autres
Publié: (2023)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
par: Zhou, Zhanhui, et autres
Publié: (2023)
par: Zhou, Zhanhui, et autres
Publié: (2023)
Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
par: Chen, Weize, et autres
Publié: (2024)
par: Chen, Weize, et autres
Publié: (2024)
M$^3$TN: Multi-gate Mixture-of-Experts based Multi-valued Treatment Network for Uplift Modeling
par: Sun, Zexu, et autres
Publié: (2024)
par: Sun, Zexu, et autres
Publié: (2024)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
par: Wang, Haoxiang, et autres
Publié: (2024)
par: Wang, Haoxiang, et autres
Publié: (2024)
Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization
par: Fu, Yuhan, et autres
Publié: (2024)
par: Fu, Yuhan, et autres
Publié: (2024)
Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
par: Chen, Weize, et autres
Publié: (2024)
par: Chen, Weize, et autres
Publié: (2024)
Quality-Diversity Optimization as Multi-Objective Optimization
par: Lin, Xi, et autres
Publié: (2026)
par: Lin, Xi, et autres
Publié: (2026)
H-Neurons: On the Existence, Impact, and Origin of Hallucination-Associated Neurons in LLMs
par: Gao, Cheng, et autres
Publié: (2025)
par: Gao, Cheng, et autres
Publié: (2025)
Enhancing Legal Case Retrieval via Scaling High-quality Synthetic Query-Candidate Pairs
par: Gao, Cheng, et autres
Publié: (2024)
par: Gao, Cheng, et autres
Publié: (2024)
TTRL: Test-Time Reinforcement Learning
par: Zuo, Yuxin, et autres
Publié: (2025)
par: Zuo, Yuxin, et autres
Publié: (2025)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
par: Liu, Biao, et autres
Publié: (2025)
par: Liu, Biao, et autres
Publié: (2025)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
par: Lv, Xingtai, et autres
Publié: (2024)
par: Lv, Xingtai, et autres
Publié: (2024)
Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models
par: Agnihotri, Akhil, et autres
Publié: (2025)
par: Agnihotri, Akhil, et autres
Publié: (2025)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
C-MORAL: Controllable Multi-Objective Molecular Optimization with Reinforcement Alignment for LLMs
par: Gao, Rui, et autres
Publié: (2026)
par: Gao, Rui, et autres
Publié: (2026)
Tell Me More! Towards Implicit User Intention Understanding of Language Model Driven Agents
par: Qian, Cheng, et autres
Publié: (2024)
par: Qian, Cheng, et autres
Publié: (2024)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
par: Lu, Jialin, et autres
Publié: (2026)
par: Lu, Jialin, et autres
Publié: (2026)
Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing
par: Sun, Yuhui, et autres
Publié: (2025)
par: Sun, Yuhui, et autres
Publié: (2025)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
par: Li, Moxin, et autres
Publié: (2025)
par: Li, Moxin, et autres
Publié: (2025)
Robust Multi-Objective Preference Alignment with Online DPO
par: Gupta, Raghav, et autres
Publié: (2025)
par: Gupta, Raghav, et autres
Publié: (2025)
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
par: Wang, Hanbin, et autres
Publié: (2023)
par: Wang, Hanbin, et autres
Publié: (2023)
Documents similaires
-
Advancing LLM Reasoning Generalists with Preference Trees
par: Yuan, Lifan, et autres
Publié: (2024) -
Learning to Focus: Causal Attention Distillation via Gradient-Guided Token Pruning
par: Guo, Yiju, et autres
Publié: (2025) -
UltraFeedback: Boosting Language Models with Scaled AI Feedback
par: Cui, Ganqu, et autres
Publié: (2023) -
Less Noise, More Voice: Reinforcement Learning for Reasoning via Instruction Purification
par: Guo, Yiju, et autres
Publié: (2026) -
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
par: Ding, Ning, et autres
Publié: (2024)