MTRec: Learning to Align with User Preferences via Mental Reward Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Mengchen, Gao, Yifan, Hou, Yaqing, Li, Xiangyang, Gu, Pengjie, Dong, Zhenhua, Tang, Ruiming, Cai, Yi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Unified Framework for Multi-Domain CTR Prediction via Large Language Models
by: Fu, Zichuan, et al.
Published: (2023)
by: Fu, Zichuan, et al.
Published: (2023)
Prompt Tuning as User Inherent Profile Inference Machine
by: Lu, Yusheng, et al.
Published: (2024)
by: Lu, Yusheng, et al.
Published: (2024)
CAPTS: Channel-Aware, Preference-Aligned Trigger Selection for Multi-Channel Item-to-Item Retrieval
by: Zhou, Xiaoyou, et al.
Published: (2026)
by: Zhou, Xiaoyou, et al.
Published: (2026)
Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning
by: Zhang, Wenlin, et al.
Published: (2025)
by: Zhang, Wenlin, et al.
Published: (2025)
Recall-Augmented Ranking: Enhancing Click-Through Rate Prediction Accuracy with Cross-Stage Data
by: Huang, Junjie, et al.
Published: (2024)
by: Huang, Junjie, et al.
Published: (2024)
Exploring Recommender System Evaluation: A Multi-Modal User Agent Framework for A/B Testing
by: Zhang, Wenlin, et al.
Published: (2026)
by: Zhang, Wenlin, et al.
Published: (2026)
Task Aligned Meta-learning based Augmented Graph for Cold-Start Recommendation
by: Shi, Yuxiang, et al.
Published: (2022)
by: Shi, Yuxiang, et al.
Published: (2022)
Retrievable Domain-Sensitive Feature Memory for Multi-Domain Recommendation
by: Zhao, Yuang, et al.
Published: (2024)
by: Zhao, Yuang, et al.
Published: (2024)
SampleLLM: Optimizing Tabular Data Synthesis in Recommendations
by: Gao, Jingtong, et al.
Published: (2025)
by: Gao, Jingtong, et al.
Published: (2025)
LIBER: Lifelong User Behavior Modeling Based on Large Language Models
by: Zhu, Chenxu, et al.
Published: (2024)
by: Zhu, Chenxu, et al.
Published: (2024)
PROMISE: Process Reward Models Unlock Test-Time Scaling Laws in Generative Recommendations
by: Guo, Chengcheng, et al.
Published: (2026)
by: Guo, Chengcheng, et al.
Published: (2026)
Act-With-Think: Chunk Auto-Regressive Modeling for Generative Recommendation
by: Wang, Yifan, et al.
Published: (2025)
by: Wang, Yifan, et al.
Published: (2025)
LLM4Rerank: LLM-based Auto-Reranking Framework for Recommendations
by: Gao, Jingtong, et al.
Published: (2024)
by: Gao, Jingtong, et al.
Published: (2024)
Aligning Recommendations with User Popularity Preferences
by: Schirmer, Mona, et al.
Published: (2026)
by: Schirmer, Mona, et al.
Published: (2026)
Oracle-guided Dynamic User Preference Modeling for Sequential Recommendation
by: Xia, Jiafeng, et al.
Published: (2024)
by: Xia, Jiafeng, et al.
Published: (2024)
LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation
by: Xin, Haidong, et al.
Published: (2025)
by: Xin, Haidong, et al.
Published: (2025)
Aligning LLM Agents by Learning Latent Preference from User Edits
by: Gao, Ge, et al.
Published: (2024)
by: Gao, Ge, et al.
Published: (2024)
LLMTreeRec: Unleashing the Power of Large Language Models for Cold-Start Recommendations
by: Zhang, Wenlin, et al.
Published: (2024)
by: Zhang, Wenlin, et al.
Published: (2024)
Effective Knowledge Transfer for Multi-Task Recommendation Models
by: Cai, Guohao, et al.
Published: (2026)
by: Cai, Guohao, et al.
Published: (2026)
A Contextual-Aware Position Encoding for Sequential Recommendation
by: Yuan, Jun, et al.
Published: (2025)
by: Yuan, Jun, et al.
Published: (2025)
CoIR: A Comprehensive Benchmark for Code Information Retrieval Models
by: Li, Xiangyang, et al.
Published: (2024)
by: Li, Xiangyang, et al.
Published: (2024)
CELA: Cost-Efficient Language Model Alignment for CTR Prediction
by: Wang, Xingmei, et al.
Published: (2024)
by: Wang, Xingmei, et al.
Published: (2024)
AIE: Auction Information Enhanced Framework for CTR Prediction in Online Advertising
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
SyNeg: LLM-Driven Synthetic Hard-Negatives for Dense Retrieval
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
Counteracting Duration Bias in Video Recommendation via Counterfactual Watch Time
by: Zhao, Haiyuan, et al.
Published: (2024)
by: Zhao, Haiyuan, et al.
Published: (2024)
Evaluating Conversational Recommender Systems via Large Language Models: A User-Centric Framework
by: Chen, Nuo, et al.
Published: (2025)
by: Chen, Nuo, et al.
Published: (2025)
Unbiased Top-k Learning to Rank with Causal Likelihood Decomposition
by: Zhao, Haiyuan, et al.
Published: (2022)
by: Zhao, Haiyuan, et al.
Published: (2022)
LLM4MSR: An LLM-Enhanced Paradigm for Multi-Scenario Recommendation
by: Wang, Yuhao, et al.
Published: (2024)
by: Wang, Yuhao, et al.
Published: (2024)
User Invariant Preference Learning for Multi-Behavior Recommendation
by: Yan, Mingshi, et al.
Published: (2025)
by: Yan, Mingshi, et al.
Published: (2025)
MGFRec: Towards Reinforced Reasoning Recommendation with Multiple Groundings and Feedback
by: Cai, Shihao, et al.
Published: (2025)
by: Cai, Shihao, et al.
Published: (2025)
Aligning Web Query Generation with Ranking Objectives via Direct Preference Optimization
by: Coelho, João, et al.
Published: (2025)
by: Coelho, João, et al.
Published: (2025)
Aligning Multimodal Sequential Recommendations via Robust Direct Preference Optimization with Sparse MoE
by: Huang, Hejin, et al.
Published: (2026)
by: Huang, Hejin, et al.
Published: (2026)
Embedding Compression in Recommender Systems: A Survey
by: Li, Shiwei, et al.
Published: (2024)
by: Li, Shiwei, et al.
Published: (2024)
TruthSR: Trustworthy Sequential Recommender Systems via User-generated Multimodal Content
by: Yan, Meng, et al.
Published: (2024)
by: Yan, Meng, et al.
Published: (2024)
AlignGroup: Learning and Aligning Group Consensus with Member Preferences for Group Recommendation
by: Xu, Jinfeng, et al.
Published: (2024)
by: Xu, Jinfeng, et al.
Published: (2024)
Federated User Behavior Modeling for Privacy-Preserving LLM Recommendation
by: Guo, Lei, et al.
Published: (2026)
by: Guo, Lei, et al.
Published: (2026)
Multi-Domain Recommendation to Attract Users via Domain Preference Modeling
by: Ju, Hyunjun, et al.
Published: (2024)
by: Ju, Hyunjun, et al.
Published: (2024)
Warming Up Cold-Start CTR Prediction by Learning Item-Specific Feature Interactions
by: Wang, Yaqing, et al.
Published: (2024)
by: Wang, Yaqing, et al.
Published: (2024)
Learning Evolving Preferences: A Federated Continual Framework for User-Centric Recommendation
by: Zhang, Chunxu, et al.
Published: (2026)
by: Zhang, Chunxu, et al.
Published: (2026)
Align-for-Fusion: Harmonizing Triple Preferences via Dual-oriented Diffusion for Cross-domain Sequential Recommendation
by: Zha, Yongfu, et al.
Published: (2025)
by: Zha, Yongfu, et al.
Published: (2025)
Similar Items
-
A Unified Framework for Multi-Domain CTR Prediction via Large Language Models
by: Fu, Zichuan, et al.
Published: (2023) -
Prompt Tuning as User Inherent Profile Inference Machine
by: Lu, Yusheng, et al.
Published: (2024) -
CAPTS: Channel-Aware, Preference-Aligned Trigger Selection for Multi-Channel Item-to-Item Retrieval
by: Zhou, Xiaoyou, et al.
Published: (2026) -
Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning
by: Zhang, Wenlin, et al.
Published: (2025) -
Recall-Augmented Ranking: Enhancing Click-Through Rate Prediction Accuracy with Cross-Stage Data
by: Huang, Junjie, et al.
Published: (2024)