DARLR: Dual-Agent Offline Reinforcement Learning for Recommender Systems with Dynamic Reward
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yi, Qiu, Ruihong, Xu, Xuwei, Liu, Jiajun, Wang, Sen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
Beyond Static LLM Policies: Imitation-Enhanced Reinforcement Learning for Recommendation
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
MARCO: A Cooperative Knowledge Transfer Framework for Personalized Cross-domain Recommendations
di: Xie, Lili, et al.
Pubblicazione: (2025)
di: Xie, Lili, et al.
Pubblicazione: (2025)
Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems
di: Shu, Wenzheng, et al.
Pubblicazione: (2025)
di: Shu, Wenzheng, et al.
Pubblicazione: (2025)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling
di: Wang, Jie, et al.
Pubblicazione: (2024)
di: Wang, Jie, et al.
Pubblicazione: (2024)
RecRM-Bench: Benchmarking Multidimensional Reward Modeling for Agentic Recommender Systems
di: Zeng, Wenwen, et al.
Pubblicazione: (2026)
di: Zeng, Wenwen, et al.
Pubblicazione: (2026)
UNEX-RL: Reinforcing Long-Term Rewards in Multi-Stage Recommender Systems with UNidirectional EXecution
di: Zhang, Gengrui, et al.
Pubblicazione: (2024)
di: Zhang, Gengrui, et al.
Pubblicazione: (2024)
Reformulating Conversational Recommender Systems as Tri-Phase Offline Policy Learning
di: Zhang, Gangyi, et al.
Pubblicazione: (2024)
di: Zhang, Gangyi, et al.
Pubblicazione: (2024)
Policy-Guided Causal State Representation for Offline Reinforcement Learning Recommendation
di: Wang, Siyu, et al.
Pubblicazione: (2025)
di: Wang, Siyu, et al.
Pubblicazione: (2025)
Offline Evaluation Measures of Fairness in Recommender Systems
di: Rampisela, Theresia Veronika
Pubblicazione: (2026)
di: Rampisela, Theresia Veronika
Pubblicazione: (2026)
LEXA: Legal Case Retrieval via Graph Contrastive Learning with Contextualised LLM Embeddings
di: Tang, Yanran, et al.
Pubblicazione: (2024)
di: Tang, Yanran, et al.
Pubblicazione: (2024)
UQLegalAI@COLIEE2025: Advancing Legal Case Retrieval with Large Language Models and Graph Neural Networks
di: Tang, Yanran, et al.
Pubblicazione: (2025)
di: Tang, Yanran, et al.
Pubblicazione: (2025)
Reinforcement Learning to Rank Using Coarse-grained Rewards
di: Tu, Yiteng, et al.
Pubblicazione: (2022)
di: Tu, Yiteng, et al.
Pubblicazione: (2022)
Reinforced Preference Optimization for Recommendation
di: Tan, Junfei, et al.
Pubblicazione: (2025)
di: Tan, Junfei, et al.
Pubblicazione: (2025)
Towards Sample-Efficient and Stable Reinforcement Learning for LLM-based Recommendation
di: Ding, Hongxun, et al.
Pubblicazione: (2026)
di: Ding, Hongxun, et al.
Pubblicazione: (2026)
Maximum-Entropy Regularized Decision Transformer with Reward Relabelling for Dynamic Recommendation
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
di: Chen, Xiaocong, et al.
Pubblicazione: (2024)
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
di: Cui, Jiajun, et al.
Pubblicazione: (2024)
di: Cui, Jiajun, et al.
Pubblicazione: (2024)
FedSlate:A Federated Deep Reinforcement Learning Recommender System
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
CaseLink: Inductive Graph Learning for Legal Case Retrieval
di: Tang, Yanran, et al.
Pubblicazione: (2024)
di: Tang, Yanran, et al.
Pubblicazione: (2024)
UnifiedRL: A Reinforcement Learning Algorithm Tailored for Multi-Task Fusion in Large-Scale Recommender Systems
di: Liu, Peng, et al.
Pubblicazione: (2024)
di: Liu, Peng, et al.
Pubblicazione: (2024)
DIAURec: Dual-Intent Space Representation Optimization for Recommendation
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Can Offline Metrics Measure Explanation Goals? A Comparative Survey Analysis of Offline Explanation Metrics in Recommender Systems
di: Zanon, André Levi, et al.
Pubblicazione: (2023)
di: Zanon, André Levi, et al.
Pubblicazione: (2023)
DTRec: Learning Dynamic Reasoning Trajectories for Sequential Recommendation
di: Shao, Yifan, et al.
Pubblicazione: (2025)
di: Shao, Yifan, et al.
Pubblicazione: (2025)
Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning
di: Zhang, Wenlin, et al.
Pubblicazione: (2025)
di: Zhang, Wenlin, et al.
Pubblicazione: (2025)
Self-Distilled Reinforcement Learning for Co-Evolving Agentic Recommender Systems
di: Wang, Zongwei, et al.
Pubblicazione: (2026)
di: Wang, Zongwei, et al.
Pubblicazione: (2026)
Debiased Contrastive Representation Learning for Mitigating Dual Biases in Recommender Systems
di: Huang, Zhirong, et al.
Pubblicazione: (2024)
di: Huang, Zhirong, et al.
Pubblicazione: (2024)
ReaKase-8B: Legal Case Retrieval via Knowledge and Reasoning Representations with LLMs
di: Tang, Yanran, et al.
Pubblicazione: (2025)
di: Tang, Yanran, et al.
Pubblicazione: (2025)
Deep Pareto Reinforcement Learning for Multi-Objective Recommender Systems
di: Li, Pan, et al.
Pubblicazione: (2024)
di: Li, Pan, et al.
Pubblicazione: (2024)
Beyond Offline A/B Testing: Context-Aware Agent Simulation for Recommender System Evaluation
di: Bougie, Nicolas, et al.
Pubblicazione: (2026)
di: Bougie, Nicolas, et al.
Pubblicazione: (2026)
Mitigating Dual Latent Confounding Biases in Recommender Systems
di: Deng, Jianfeng, et al.
Pubblicazione: (2024)
di: Deng, Jianfeng, et al.
Pubblicazione: (2024)
Cache-Aware Reinforcement Learning in Large-Scale Recommender Systems
di: Chen, Xiaoshuang, et al.
Pubblicazione: (2024)
di: Chen, Xiaoshuang, et al.
Pubblicazione: (2024)
Dual-space Hierarchical Learning for Goal-guided Conversational Recommendation
di: Chen, Can, et al.
Pubblicazione: (2023)
di: Chen, Can, et al.
Pubblicazione: (2023)
EnhancedRL: An Enhanced-State Reinforcement Learning Algorithm for Multi-Task Fusion in Recommender Systems
di: Liu, Peng, et al.
Pubblicazione: (2024)
di: Liu, Peng, et al.
Pubblicazione: (2024)
CADRL: Category-aware Dual-agent Reinforcement Learning for Explainable Recommendations over Knowledge Graphs
di: Zheng, Shangfei, et al.
Pubblicazione: (2024)
di: Zheng, Shangfei, et al.
Pubblicazione: (2024)
From Hidden Profiles to Governable Personalization: Recommender Systems in the Age of LLM Agents
di: Liu, Jiahao, et al.
Pubblicazione: (2026)
di: Liu, Jiahao, et al.
Pubblicazione: (2026)
DIET: Learning to Distill Dataset Continually for Recommender Systems
di: Zhang, Jiaqing, et al.
Pubblicazione: (2026)
di: Zhang, Jiaqing, et al.
Pubblicazione: (2026)
xMTF: A Formula-Free Model for Reinforcement-Learning-Based Multi-Task Fusion in Recommender Systems
di: Cao, Yang, et al.
Pubblicazione: (2025)
di: Cao, Yang, et al.
Pubblicazione: (2025)
Dual-domain Collaborative Denoising for Social Recommendation
di: Chen, Wenjie, et al.
Pubblicazione: (2024)
di: Chen, Wenjie, et al.
Pubblicazione: (2024)
Unifying Search and Recommendation with Dual-View Representation Learning in a Generative Paradigm
di: Zhao, Jujia, et al.
Pubblicazione: (2025)
di: Zhao, Jujia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
di: Zhang, Yi, et al.
Pubblicazione: (2024) -
Beyond Static LLM Policies: Imitation-Enhanced Reinforcement Learning for Recommendation
di: Zhang, Yi, et al.
Pubblicazione: (2025) -
MARCO: A Cooperative Knowledge Transfer Framework for Personalized Cross-domain Recommendations
di: Xie, Lili, et al.
Pubblicazione: (2025) -
Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems
di: Shu, Wenzheng, et al.
Pubblicazione: (2025) -
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
di: Liu, Langming, et al.
Pubblicazione: (2025)