TPMM-DPO: Trajectory-aware Preference-guided Model Merging for Iterative Direct Preference Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Lingling, Xu, Yongfu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UMM-RM: An Upcycle-and-Merge MoE Reward Model for Mitigating Reward Hacking
di: Fu, Lingling, et al.
Pubblicazione: (2025)
di: Fu, Lingling, et al.
Pubblicazione: (2025)
FashionDPO:Fine-tune Fashion Outfit Generation Model using Direct Preference Optimization
di: Yu, Mingzhe, et al.
Pubblicazione: (2025)
di: Yu, Mingzhe, et al.
Pubblicazione: (2025)
RAD-DPO: Robust Adaptive Denoising Direct Preference Optimization for Generative Retrieval in E-commerce
di: Chen, Zhiguo, et al.
Pubblicazione: (2026)
di: Chen, Zhiguo, et al.
Pubblicazione: (2026)
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
di: Sun, Chao, et al.
Pubblicazione: (2024)
di: Sun, Chao, et al.
Pubblicazione: (2024)
On Negative-aware Preference Optimization for Recommendation
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
Proactive Recommendation with Iterative Preference Guidance
di: Bi, Shuxian, et al.
Pubblicazione: (2024)
di: Bi, Shuxian, et al.
Pubblicazione: (2024)
Listwise Preference Diffusion Optimization for User Behavior Trajectories Prediction
di: Huang, Hongtao, et al.
Pubblicazione: (2025)
di: Huang, Hongtao, et al.
Pubblicazione: (2025)
On Softmax Direct Preference Optimization for Recommendation
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
Reinforced Preference Optimization for Recommendation
di: Tan, Junfei, et al.
Pubblicazione: (2025)
di: Tan, Junfei, et al.
Pubblicazione: (2025)
Oracle-guided Dynamic User Preference Modeling for Sequential Recommendation
di: Xia, Jiafeng, et al.
Pubblicazione: (2024)
di: Xia, Jiafeng, et al.
Pubblicazione: (2024)
RankGR: Rank-Enhanced Generative Retrieval with Listwise Direct Preference Optimization in Recommendation
di: Fu, Kairui, et al.
Pubblicazione: (2026)
di: Fu, Kairui, et al.
Pubblicazione: (2026)
Preference Trajectory Modeling via Flow Matching for Sequential Recommendation
di: Li, Li, et al.
Pubblicazione: (2025)
di: Li, Li, et al.
Pubblicazione: (2025)
Coherence-guided Preference Disentanglement for Cross-domain Recommendations
di: Xiang, Zongyi, et al.
Pubblicazione: (2024)
di: Xiang, Zongyi, et al.
Pubblicazione: (2024)
Aligning Web Query Generation with Ranking Objectives via Direct Preference Optimization
di: Coelho, João, et al.
Pubblicazione: (2025)
di: Coelho, João, et al.
Pubblicazione: (2025)
Refining Text Generation for Realistic Conversational Recommendation via Direct Preference Optimization
di: Tajiri, Manato, et al.
Pubblicazione: (2025)
di: Tajiri, Manato, et al.
Pubblicazione: (2025)
Reinforced Preference Optimization for Reasoning-Augmented Recommendations
di: Gao, Jingtong, et al.
Pubblicazione: (2026)
di: Gao, Jingtong, et al.
Pubblicazione: (2026)
Causal Direct Preference Optimization for Distributionally Robust Generative Recommendation
di: Zhao, Chu, et al.
Pubblicazione: (2026)
di: Zhao, Chu, et al.
Pubblicazione: (2026)
Optimizing LLMs with Direct Preferences: A Data Efficiency Perspective
di: Bernardelle, Pietro, et al.
Pubblicazione: (2024)
di: Bernardelle, Pietro, et al.
Pubblicazione: (2024)
Align-for-Fusion: Harmonizing Triple Preferences via Dual-oriented Diffusion for Cross-domain Sequential Recommendation
di: Zha, Yongfu, et al.
Pubblicazione: (2025)
di: Zha, Yongfu, et al.
Pubblicazione: (2025)
OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
K-order Ranking Preference Optimization for Large Language Models
di: Cai, Shihao, et al.
Pubblicazione: (2025)
di: Cai, Shihao, et al.
Pubblicazione: (2025)
TrackRec: Iterative Alternating Feedback with Chain-of-Thought via Preference Alignment for Recommendation
di: Xia, Yu, et al.
Pubblicazione: (2025)
di: Xia, Yu, et al.
Pubblicazione: (2025)
Multimodal Large Language Models with Adaptive Preference Optimization for Sequential Recommendation
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
Clinical Reading Comprehension with Encoder-Decoder Models Enhanced by Direct Preference Optimization
di: Nahian, Md Sultan Al, et al.
Pubblicazione: (2024)
di: Nahian, Md Sultan Al, et al.
Pubblicazione: (2024)
Federated User Preference Modeling for Privacy-Preserving Cross-Domain Recommendation
di: Wang, Li, et al.
Pubblicazione: (2024)
di: Wang, Li, et al.
Pubblicazione: (2024)
Listwise Preference Alignment Optimization for Tail Item Recommendation
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Aligning Multimodal Sequential Recommendations via Robust Direct Preference Optimization with Sparse MoE
di: Huang, Hejin, et al.
Pubblicazione: (2026)
di: Huang, Hejin, et al.
Pubblicazione: (2026)
Fading to Grow: Growing Preference Ratios via Preference Fading Discrete Diffusion for Recommendation
di: Hu, Guoqing, et al.
Pubblicazione: (2025)
di: Hu, Guoqing, et al.
Pubblicazione: (2025)
Disentangled Modeling of Preferences and Social Influence for Group Recommendation
di: Ye, Guangze, et al.
Pubblicazione: (2025)
di: Ye, Guangze, et al.
Pubblicazione: (2025)
Vague Preference Policy Learning for Conversational Recommendation
di: Zhang, Gangyi, et al.
Pubblicazione: (2023)
di: Zhang, Gangyi, et al.
Pubblicazione: (2023)
DynamicPO: Dynamic Preference Optimization for Recommendation
di: Hu, Xingyu, et al.
Pubblicazione: (2026)
di: Hu, Xingyu, et al.
Pubblicazione: (2026)
CTR-Driven Ad Text Generation via Online Feedback Preference Optimization
di: Chen, Yanda, et al.
Pubblicazione: (2025)
di: Chen, Yanda, et al.
Pubblicazione: (2025)
Multi-Grained Preference Enhanced Transformer for Multi-Behavior Sequential Recommendation
di: He, Chuan, et al.
Pubblicazione: (2024)
di: He, Chuan, et al.
Pubblicazione: (2024)
Behavior-Contextualized Item Preference Modeling for Multi-Behavior Recommendation
di: Yan, Mingshi, et al.
Pubblicazione: (2024)
di: Yan, Mingshi, et al.
Pubblicazione: (2024)
Exploring Preference-Guided Diffusion Model for Cross-Domain Recommendation
di: Li, Xiaodong, et al.
Pubblicazione: (2025)
di: Li, Xiaodong, et al.
Pubblicazione: (2025)
NextQuill: Causal Preference Modeling for Enhancing LLM Personalization
di: Zhao, Xiaoyan, et al.
Pubblicazione: (2025)
di: Zhao, Xiaoyan, et al.
Pubblicazione: (2025)
Embed Progressive Implicit Preference in Unified Space for Deep Collaborative Filtering
di: Zhang, Zhongjin, et al.
Pubblicazione: (2025)
di: Zhang, Zhongjin, et al.
Pubblicazione: (2025)
Affect-aware Cross-Domain Recommendation for Art Therapy via Music Preference Elicitation
di: Yilma, Bereket A., et al.
Pubblicazione: (2025)
di: Yilma, Bereket A., et al.
Pubblicazione: (2025)
Generative Retrieval with Preference Optimization for E-commerce Search
di: Li, Mingming, et al.
Pubblicazione: (2024)
di: Li, Mingming, et al.
Pubblicazione: (2024)
Multi-Domain Recommendation to Attract Users via Domain Preference Modeling
di: Ju, Hyunjun, et al.
Pubblicazione: (2024)
di: Ju, Hyunjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
UMM-RM: An Upcycle-and-Merge MoE Reward Model for Mitigating Reward Hacking
di: Fu, Lingling, et al.
Pubblicazione: (2025) -
FashionDPO:Fine-tune Fashion Outfit Generation Model using Direct Preference Optimization
di: Yu, Mingzhe, et al.
Pubblicazione: (2025) -
RAD-DPO: Robust Adaptive Denoising Direct Preference Optimization for Generative Retrieval in E-commerce
di: Chen, Zhiguo, et al.
Pubblicazione: (2026) -
Direct Preference Optimization for LLM-Enhanced Recommendation Systems
di: Sun, Chao, et al.
Pubblicazione: (2024) -
On Negative-aware Preference Optimization for Recommendation
di: Ding, Chenlu, et al.
Pubblicazione: (2025)