Session-Level Dynamic Ad Load Optimization using Offline Robust Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Tao, Xu, Qi, Shi, Wei, Hua, Zhigang, Yang, Shuang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025)
Ads Supply Personalization via Doubly Robust Learning
von: Shi, Wei, et al.
Veröffentlicht: (2024)
von: Shi, Wei, et al.
Veröffentlicht: (2024)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
von: Yang, Letian, et al.
Veröffentlicht: (2026)
von: Yang, Letian, et al.
Veröffentlicht: (2026)
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)
Robust Offline Reinforcement learning with Heavy-Tailed Rewards
von: Zhu, Jin, et al.
Veröffentlicht: (2023)
von: Zhu, Jin, et al.
Veröffentlicht: (2023)
Epistemic Robust Offline Reinforcement Learning
von: Chenreddy, Abhilash Reddy, et al.
Veröffentlicht: (2026)
von: Chenreddy, Abhilash Reddy, et al.
Veröffentlicht: (2026)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
von: Guo, Yihong, et al.
Veröffentlicht: (2025)
Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
von: Zhou, Xue, et al.
Veröffentlicht: (2025)
von: Zhou, Xue, et al.
Veröffentlicht: (2025)
Robust Offline Reinforcement Learning for Non-Markovian Decision Processes
von: Huang, Ruiquan, et al.
Veröffentlicht: (2024)
von: Huang, Ruiquan, et al.
Veröffentlicht: (2024)
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning
von: Liu, Zhishuai, et al.
Veröffentlicht: (2024)
von: Liu, Zhishuai, et al.
Veröffentlicht: (2024)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
von: Liu, Zeyuan, et al.
Veröffentlicht: (2025)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
von: Ye, Chenlu, et al.
Veröffentlicht: (2023)
von: Ye, Chenlu, et al.
Veröffentlicht: (2023)
Sparse Offline Reinforcement Learning with Corruption Robustness
von: Tran, Nam Phuong, et al.
Veröffentlicht: (2025)
von: Tran, Nam Phuong, et al.
Veröffentlicht: (2025)
Making Offline RL Online: Collaborative World Models for Offline Visual Reinforcement Learning
von: Wang, Qi, et al.
Veröffentlicht: (2023)
von: Wang, Qi, et al.
Veröffentlicht: (2023)
Distributionally Robust Model-Based Offline Reinforcement Learning with Near-Optimal Sample Complexity
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
von: Shi, Laixi, et al.
Veröffentlicht: (2022)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
von: Tang, Cheng, et al.
Veröffentlicht: (2024)
von: Tang, Cheng, et al.
Veröffentlicht: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
von: Hu, Jifeng, et al.
Veröffentlicht: (2025)
von: Hu, Jifeng, et al.
Veröffentlicht: (2025)
Is Mamba Compatible with Trajectory Optimization in Offline Reinforcement Learning?
von: Dai, Yang, et al.
Veröffentlicht: (2024)
von: Dai, Yang, et al.
Veröffentlicht: (2024)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
von: Xia, Zhangjie, et al.
Veröffentlicht: (2026)
Unleashing the Power of Pre-trained Language Models for Offline Reinforcement Learning
von: Shi, Ruizhe, et al.
Veröffentlicht: (2023)
von: Shi, Ruizhe, et al.
Veröffentlicht: (2023)
Sample-Efficient Tabular Self-Play for Offline Robust Reinforcement Learning
von: Li, Na, et al.
Veröffentlicht: (2025)
von: Li, Na, et al.
Veröffentlicht: (2025)
Tackling Data Corruption in Offline Reinforcement Learning via Sequence Modeling
von: Xu, Jiawei, et al.
Veröffentlicht: (2024)
von: Xu, Jiawei, et al.
Veröffentlicht: (2024)
Trajectory-Level Data Augmentation for Offline Reinforcement Learning
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
von: Schmähling, Tobias, et al.
Veröffentlicht: (2026)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
von: Yang, Rui, et al.
Veröffentlicht: (2023)
von: Yang, Rui, et al.
Veröffentlicht: (2023)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
von: Wen, Xiaoyu, et al.
Veröffentlicht: (2023)
Large Vision Model-Enhanced Digital Twin with Deep Reinforcement Learning for User Association and Load Balancing in Dynamic Wireless Networks
von: Tao, Zhenyu, et al.
Veröffentlicht: (2024)
von: Tao, Zhenyu, et al.
Veröffentlicht: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
von: Wu, Kun, et al.
Veröffentlicht: (2024)
von: Wu, Kun, et al.
Veröffentlicht: (2024)
Preserving Expert-Level Privacy in Offline Reinforcement Learning
von: Sharma, Navodita, et al.
Veröffentlicht: (2024)
von: Sharma, Navodita, et al.
Veröffentlicht: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
von: Ma, Yunchang, et al.
Veröffentlicht: (2025)
To Switch or Not to Switch? Balanced Policy Switching in Offline Reinforcement Learning
von: Ma, Tao, et al.
Veröffentlicht: (2024)
von: Ma, Tao, et al.
Veröffentlicht: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
Reinforcement Learning for Compositional Generalization with Outcome-Level Optimization
von: Fu, Xiyan, et al.
Veröffentlicht: (2026)
von: Fu, Xiyan, et al.
Veröffentlicht: (2026)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
von: Liu, Xu-Hui, et al.
Veröffentlicht: (2024)
From Static Constraints to Dynamic Adaptation: Sample-Level Constraint Relaxation for Offline-to-Online Reinforcement Learning
von: Zu, Lipeng, et al.
Veröffentlicht: (2025)
von: Zu, Lipeng, et al.
Veröffentlicht: (2025)
Target-Aligned Bellman Backup for Cross-domain Offline Reinforcement Learning
von: Liu, Wei, et al.
Veröffentlicht: (2026)
von: Liu, Wei, et al.
Veröffentlicht: (2026)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
Percentile Criterion Optimization in Offline Reinforcement Learning
von: Lobo, Elita A., et al.
Veröffentlicht: (2024)
von: Lobo, Elita A., et al.
Veröffentlicht: (2024)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Dual-Robust Cross-Domain Offline Reinforcement Learning Against Dynamics Shifts
von: Qiao, Zhongjian, et al.
Veröffentlicht: (2025) -
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2025) -
Ads Supply Personalization via Doubly Robust Learning
von: Shi, Wei, et al.
Veröffentlicht: (2024) -
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
von: Yang, Letian, et al.
Veröffentlicht: (2026) -
Offline Trajectory Optimization for Offline Reinforcement Learning
von: Zhao, Ziqi, et al.
Veröffentlicht: (2024)