GRADE: Personalized Multi-Task Fusion via Group-relative Reinforcement Learning with Adaptive Dirichlet Exploration
Fuente:
arXiv
Saved in:
| Main Authors: | Hong, Tingfeng, Ren, Pingye, Xiao, Xinlong, Wang, Chao, Lei, Chenyi, Ou, Wenwu, Li, Han |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DiffusionGS: Generative Search with Query Conditioned Diffusion in Kuaishou
by: Li, Qinyao, et al.
Published: (2025)
by: Li, Qinyao, et al.
Published: (2025)
Group Fairness in Multi-Task Reinforcement Learning
by: Song, Kefan, et al.
Published: (2025)
by: Song, Kefan, et al.
Published: (2025)
Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling
by: Corrado, Nicholas E., et al.
Published: (2026)
by: Corrado, Nicholas E., et al.
Published: (2026)
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
by: Mao, Lingtao, et al.
Published: (2026)
by: Mao, Lingtao, et al.
Published: (2026)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
by: Li, Yupeng, et al.
Published: (2026)
by: Li, Yupeng, et al.
Published: (2026)
Distributed Neural Policy Gradient Algorithm for Global Convergence of Networked Multi-Agent Reinforcement Learning
by: Dai, Pengcheng, et al.
Published: (2025)
by: Dai, Pengcheng, et al.
Published: (2025)
Fairness-Aware Multi-Server Federated Learning Task Delegation over Wireless Networks
by: Gao, Yulan, et al.
Published: (2024)
by: Gao, Yulan, et al.
Published: (2024)
Task Assignment and Exploration Optimization for Low Altitude UAV Rescue via Generative AI Enhanced Multi-agent Reinforcement Learning
by: Tang, Xin, et al.
Published: (2025)
by: Tang, Xin, et al.
Published: (2025)
OneVision: An End-to-End Generative Framework for Multi-view E-commerce Vision Search
by: Zheng, Zexin, et al.
Published: (2025)
by: Zheng, Zexin, et al.
Published: (2025)
Rethinking Multi-objective Ranking Ensemble in Recommender System: From Score Fusion to Rank Consistency
by: Xia, Boyang, et al.
Published: (2026)
by: Xia, Boyang, et al.
Published: (2026)
Towards Context-aware Reasoning-enhanced Generative Searching in E-commerce
by: Liu, Zhiding, et al.
Published: (2025)
by: Liu, Zhiding, et al.
Published: (2025)
TAP: Two-Stage Adaptive Personalization of Multi-Task and Multi-Modal Foundation Models in Federated Learning
by: Lee, Seohyun, et al.
Published: (2025)
by: Lee, Seohyun, et al.
Published: (2025)
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
by: Sun, Xinyu, et al.
Published: (2026)
by: Sun, Xinyu, et al.
Published: (2026)
Bootstrapping Exploration with Group-Level Natural Language Feedback in Reinforcement Learning
by: Huang, Lei, et al.
Published: (2026)
by: Huang, Lei, et al.
Published: (2026)
UnifiedRL: A Reinforcement Learning Algorithm Tailored for Multi-Task Fusion in Large-Scale Recommender Systems
by: Liu, Peng, et al.
Published: (2024)
by: Liu, Peng, et al.
Published: (2024)
A Unified Graph Language Model for Multi-Domain Multi-Task Graph Alignment Instruction Tuning
by: Chen, Haibo, et al.
Published: (2026)
by: Chen, Haibo, et al.
Published: (2026)
AdaTask: A Task-aware Adaptive Learning Rate Approach to Multi-task Learning
by: Yang, Enneng, et al.
Published: (2022)
by: Yang, Enneng, et al.
Published: (2022)
Token Hidden Reward: Steering Exploration-Exploitation in Group Relative Deep Reinforcement Learning
by: Deng, Wenlong, et al.
Published: (2025)
by: Deng, Wenlong, et al.
Published: (2025)
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
by: Chen, Ben, et al.
Published: (2025)
by: Chen, Ben, et al.
Published: (2025)
Hierarchical Multi-Interest Co-Network For Coarse-Grained Ranking
by: Yuan, Xu, et al.
Published: (2022)
by: Yuan, Xu, et al.
Published: (2022)
Speeding Up Path Planning via Reinforcement Learning in MCTS for Automated Parking
by: Zheng, Xinlong, et al.
Published: (2024)
by: Zheng, Xinlong, et al.
Published: (2024)
Deep Reinforcement Learning with Task-Adaptive Retrieval via Hypernetwork
by: Jin, Yonggang, et al.
Published: (2023)
by: Jin, Yonggang, et al.
Published: (2023)
Beyond Relevance: Improving User Engagement by Personalization for Short-Video Search
by: Bao, Wentian, et al.
Published: (2024)
by: Bao, Wentian, et al.
Published: (2024)
Deep Reinforcement Learning for Decentralized Multi-Robot Exploration With Macro Actions
by: Tan, Aaron Hao, et al.
Published: (2021)
by: Tan, Aaron Hao, et al.
Published: (2021)
Goal Exploration via Adaptive Skill Distribution for Goal-Conditioned Reinforcement Learning
by: Wu, Lisheng, et al.
Published: (2024)
by: Wu, Lisheng, et al.
Published: (2024)
Streaming SQL Multi-Way Join Method for Long State Streams
by: Hu, Jinlong, et al.
Published: (2024)
by: Hu, Jinlong, et al.
Published: (2024)
Solving Robotics Tasks with Prior Demonstration via Exploration-Efficient Deep Reinforcement Learning
by: Shen, Chengyandan, et al.
Published: (2025)
by: Shen, Chengyandan, et al.
Published: (2025)
Runtime-optimized Multi-way Stream Join Operator for Large-scale Streaming data
by: Hu, Jinlong, et al.
Published: (2024)
by: Hu, Jinlong, et al.
Published: (2024)
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
by: Ma, Yufei, et al.
Published: (2026)
by: Ma, Yufei, et al.
Published: (2026)
IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning
by: Liang, Zihan, et al.
Published: (2026)
by: Liang, Zihan, et al.
Published: (2026)
pFedAFM: Adaptive Feature Mixture for Batch-Level Personalization in Heterogeneous Federated Learning
by: Yi, Liping, et al.
Published: (2024)
by: Yi, Liping, et al.
Published: (2024)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
by: Luijkx, Jelle, et al.
Published: (2025)
by: Luijkx, Jelle, et al.
Published: (2025)
LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards
by: Ping, Bowen, et al.
Published: (2026)
by: Ping, Bowen, et al.
Published: (2026)
VisNet: Efficient Person Re-Identification via Alpha-Divergence Loss, Feature Fusion and Dynamic Multi-Task Learning
by: Ijaz, Anns, et al.
Published: (2026)
by: Ijaz, Anns, et al.
Published: (2026)
Comprehend, Divide, and Conquer: Feature Subspace Exploration via Multi-Agent Hierarchical Reinforcement Learning
by: Zhang, Weiliang, et al.
Published: (2025)
by: Zhang, Weiliang, et al.
Published: (2025)
Variational Dynamic for Self-Supervised Exploration in Deep Reinforcement Learning
by: Bai, Chenjia, et al.
Published: (2020)
by: Bai, Chenjia, et al.
Published: (2020)
AVP-Fusion: Adaptive Multi-Modal Fusion and Contrastive Learning for Two-Stage Antiviral Peptide Identification
by: Wen, Xinru, et al.
Published: (2025)
by: Wen, Xinru, et al.
Published: (2025)
Reinforcement Learning Enabled Adaptive Multi-Task Control for Bipedal Soccer Robots
by: Zhang, Yulai, et al.
Published: (2026)
by: Zhang, Yulai, et al.
Published: (2026)
Heterogeneity-aware Personalized Federated Learning via Adaptive Dual-Agent Reinforcement Learning
by: Chen, Xi, et al.
Published: (2025)
by: Chen, Xi, et al.
Published: (2025)
Ultrasound‐switchable fluorescence thermometry with dual detection channels using temperature‐sensitive liposomes
by: Tingfeng Yao, et al.
Published: (2024)
by: Tingfeng Yao, et al.
Published: (2024)
Similar Items
-
DiffusionGS: Generative Search with Query Conditioned Diffusion in Kuaishou
by: Li, Qinyao, et al.
Published: (2025) -
Group Fairness in Multi-Task Reinforcement Learning
by: Song, Kefan, et al.
Published: (2025) -
Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling
by: Corrado, Nicholas E., et al.
Published: (2026) -
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
by: Mao, Lingtao, et al.
Published: (2026) -
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
by: Li, Yupeng, et al.
Published: (2026)